home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. Qwen и Grok отгадывают советские загадки на внимательность

    Кто лучше справляется с советскими загадками на внимательность — Qwen, Grok или человек? Сравнили две классические головоломки и получили любопытные результаты.

    habr.com/ru/articles/1079530/

    #сравнение_моделей #qwen #grok #мультимодальные_модели #vlm #visionlanguage_models #галлюцинации_ии #искусственный_интеллект #нейросети

  2. KI-Modelle als Werkzeug für Angriffe auf Behörden und Bildungseinrichtungen in Asien

    Sprachmodelle übernehmen Koordinationsaufgaben, während die eigentliche Ausnutzung von Schwachstellen weiterhin auf klassischen Methoden beruht – öffentlich verfügbarem Exploit-Code, gestohlenen Zugangsdaten, Webshells und selbst entwickelter Schadsoftware.

    all-about-security.de/ki-model

    #hacker #deepseek #claude #qwen #kimodelle #kiagenten #itsicherheit #itsecurity #cybersecurity

  3. You have to be shitting me. Even #OpenCode Big Pickle fucks over Gemini 3.1 Pro.

    Welp, I'm not renewing that shit anymore, so it's time to find a cheap AI Agent around.

    Curently aiming for OpenCode. What are your recommendations under $20?

    #AI #AIAgents #VibeCoding #VibeCode #Programming #SoftwareDevelopment #WebDevelopment #WebDev #PHP #JavaScript #TypeScript #Python #Golang #Rust #ArtificialIntelligence #Codex #Claude #Copilot #Kimi #ZenAI #Perplexity #DeepSeek #MistralAI #Grok #Qwen

  4. [Перевод] Qwen3.8-27B: лучший локальный LLM, который вы, вероятно, не сможете запустить

    В этом месяце Alibaba выпустила две модели, и та, о которой все писали, оказалась не той, что мы ждали. Qwen3.8-Max — это API с 2,4 триллионами параметров, и пару недель назад я с большим энтузиазмом написал о ней обзор. Но релиз, которого я действительно ждал, вышел 14 августа: Qwen3.8-27B, Apache 2.0, веса на Hugging Face, модель достаточно компактна, чтобы работать на ноутбуке. Я должен кое в чем признаться. Я не провел полный тест этой модели. Я попробовал, на своем MacBook Air M4 получал около восьми токенов в секунду и потерял терпение где-то на втором запросе. По большей части этот пост посвящен именно моей неудаче, потому что я подозреваю, что у многих из вас вечер сложится так же, как у меня. Что представляет собой Qwen3.8-27B на самом деле 27,78 миллиарда параметров, плотная модель, включающая в себя визуальный энкодер, о котором никто не объявлял заранее. Принимает на вход текст, изображения и видео. Собственный контекст — 262 144 токена, с помощью YaRN можно увеличить его примерно до миллиона, если запускать модель на сервере. Архитектура — это по-настоящему интересная часть, и это не обычный трансформер. На протяжении 64 слоёв Qwen чередует 48 слоёв Gated DeltaNet (линейное внимание) с 16 полными слоями Gated Attention в соотношении 3:1. Только эти 16 слоёв с полным вниманием имеют KV-кэш. Таким образом, на каждый токен приходится около 64 КБ, что составляет примерно четверть от объёма памяти, необходимого для обычной 64-слойной модели с плотным кодированием. Если вы запомните только одно число из этого поста, пусть это будет именно оно. Всё, что касается того, поместится ли эта модель на вашем компьютере, зависит от объёма KV-кэша.

    habr.com/ru/articles/1072048/

    #qwen #llm #quantization #apple_silicon #lmstudio #ollama

  5. Как установить OpenJarvis: разворачиваем локального ИИ-агента

    Гений, миллиардер, плейбой, филантроп — цитата из «Железного человека», которую знают все. И полетать в железном костюме, конечно, тоже все хотели. Но раз уж собрать его на коленке в гараже не получится (а попытки были), можно начать с малого — настроить умного помощника, который управлял мастерской, да и этой броней. Команда из Стэнфорда как раз выпустила OpenJarvis — открытый фреймворк для создания персональных ИИ-агентов. Давайте посмотрим, как его развернуть на собственной инфраструктуре и действительно ли проект оправдывает свое название.

    habr.com/ru/companies/selectel

    #selectel #qwen #openjarvis #облако

  6. نماذج ذكاء اصطناعي حرة مفتوحة المصدر: دليل شامل لأبرز النماذج المتاحة في 2026

    استعراض شامل لأبرز نماذج الذكاء الاصطناعي مفتوحة المصدر والمفتوحة الوزن في 2026، مع توضيح الفرق بين الترخيصين، وقائمة بأقوى النماذج في البرمجة والاستدلال والاستخدام المحلي، وطرق تشغيلها على أجهزتك ...

    🔗 https://salehgnutux.github.io/GT-NEWSTECH/ar/ai/open-source-llms-guide-2026/

    #LLM #مفتوح_المصدر #ذكاء_اصطناعي #DeepSeek #Qwen #Llama #Gemma #Mistral #Apache_2_0 #MIT #gnutux
  7. PromptPilot: шедулер задач для Claude Code, Codex и других AI CLI

    «Всё у нас, Луцилий, чужое, одно лишь время наше» Сенека, Письма к Луцилию, I, 3. С подписками на AI это буквально: квоты токенов, лимиты запросов и «окна» сброса — не твои, их задаёт провайдер. Остаётся то, что ты можешь распорядиться сам: когда отправить задачу, в каком порядке её выполнить и где ты в этот момент находишься — за столом, в такси или уже в постели. Я собрал PromptPilot — очередь промптов для AI CLI (Claude Code, Codex, Qwen): задачи ставятся из терминала, веб-интерфейса или Telegram-бота, воркер выполняет их по очереди, с планированием, приоритетами и повтором при rate limit. Идея простая: не гнаться за лимитом глазами, а заранее разложить работу так, чтобы к моменту, когда ты реально сел кодить, под рукой уже был результат — или чтобы «разогрев» сессии случился без тебя у монитора в пять утра. Ниже — зачем это кому-то кроме меня, как устроена архитектура на SQLite и трёх процессах, и как из бота ответить модели в середине диалога, не открывая терминал. Если узнаёте себя в историях про сгорающие токены и ночные дедлайны по лимитам — добро пожаловать в комментарии.

    habr.com/ru/articles/1018950/

    #claude #codex #qwen #workflow #claude_code #очередь_задач #telegramбот #AI_CLI #PromptPilot #taskqueue