home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. KI-Modelle als Werkzeug für Angriffe auf Behörden und Bildungseinrichtungen in Asien

    Sprachmodelle übernehmen Koordinationsaufgaben, während die eigentliche Ausnutzung von Schwachstellen weiterhin auf klassischen Methoden beruht – öffentlich verfügbarem Exploit-Code, gestohlenen Zugangsdaten, Webshells und selbst entwickelter Schadsoftware.

    all-about-security.de/ki-model

    #hacker #deepseek #claude #qwen #kimodelle #kiagenten #itsicherheit #itsecurity #cybersecurity

  2. Переводим книги нейронками для себя: год спустя. Словари, скорости и почему переводчики всё ещё нужны

    Год назад я написал статью « Переводим fb2 книжки, с нейронками, для себя » — про то, как собрал на паре Tesla P40 в гараже программу Sunny Narrator («Солнечный сказочник»), которая переводит художественные книги через локальные и облачные LLM. Тогда это был скорее прототип «доказать себе, что так можно»: черновики читались с головной болью, книга в тысячу страниц переводилась два дня, а электричество, отключённое посреди процесса, стоило ещё двух. За год программа доехала до версии 2.1, я перевёл достаточно книг, чтобы набить руку, и понял главное: это уже инструмент не только для меня, но и для переводчиков — и для всех любопытных . Рассказываю, что изменилось, сколько это стоит в токенах и почему без человека ничего не работает.

    habr.com/ru/articles/1077366/

    #перевод #переводы #fb2 #epub #llm #llmприложения #словари #tesla_p40 #qwen #gemma

  3. 🖥️ Runs on 14 agent hosts: #ClaudeCode, #Cursor, #Codex, #Kimi Code CLI, #Cline, Grok Build CLI, #Devin, #GitHubCopilot, Factory Droid, #Qwen Code, #OpenCode, Pi, oh-my-pi and Antigravity CLI

    ⚙️ Install in Claude Code with /plugin marketplace add plus /plugin install, then run /ce-setup to create .compound-engineering/config.yaml and check tool capabilities

  4. Какая LLM поможет вам заработать в 2026/27 году

    Сегодня у айтишников появилось новое хобби - делать свой SaaS или писать торговых ботов с помощью LLM Порог входа резко снизился: достаточно хорошей идеи, немного свободного времени и подписки на одну из современных LLM Но есть одна проблема Модель, которая набирает 90%+ в бенчмарке, совсем не обязательно поможет вам заработать деньги Потому что между «написать хороший код» и создать работающий продукт есть огромная разница Я дал шести LLM одну задачу - написать торгового бота и проверил, что из этого можно использовать на практике GPT, Claude Opus, DeepSeek, Qwen, GigaChat, YandexGPT Pro

    habr.com/ru/articles/1070596/

    #ai #algorithm #algotrading #bigdata #process #gpt #claude #gemini #qwen #deepseek

  5. Looks like #qwen was trained to use #duckduckgo

    Even the AI companies think that the google search is dogshit 🤣

    #LLM #AI #LMstudio

  6. [Перевод] Qwen3.8-27B: лучший локальный LLM, который вы, вероятно, не сможете запустить

    В этом месяце Alibaba выпустила две модели, и та, о которой все писали, оказалась не той, что мы ждали. Qwen3.8-Max — это API с 2,4 триллионами параметров, и пару недель назад я с большим энтузиазмом написал о ней обзор. Но релиз, которого я действительно ждал, вышел 14 августа: Qwen3.8-27B, Apache 2.0, веса на Hugging Face, модель достаточно компактна, чтобы работать на ноутбуке. Я должен кое в чем признаться. Я не провел полный тест этой модели. Я попробовал, на своем MacBook Air M4 получал около восьми токенов в секунду и потерял терпение где-то на втором запросе. По большей части этот пост посвящен именно моей неудаче, потому что я подозреваю, что у многих из вас вечер сложится так же, как у меня. Что представляет собой Qwen3.8-27B на самом деле 27,78 миллиарда параметров, плотная модель, включающая в себя визуальный энкодер, о котором никто не объявлял заранее. Принимает на вход текст, изображения и видео. Собственный контекст — 262 144 токена, с помощью YaRN можно увеличить его примерно до миллиона, если запускать модель на сервере. Архитектура — это по-настоящему интересная часть, и это не обычный трансформер. На протяжении 64 слоёв Qwen чередует 48 слоёв Gated DeltaNet (линейное внимание) с 16 полными слоями Gated Attention в соотношении 3:1. Только эти 16 слоёв с полным вниманием имеют KV-кэш. Таким образом, на каждый токен приходится около 64 КБ, что составляет примерно четверть от объёма памяти, необходимого для обычной 64-слойной модели с плотным кодированием. Если вы запомните только одно число из этого поста, пусть это будет именно оно. Всё, что касается того, поместится ли эта модель на вашем компьютере, зависит от объёма KV-кэша.

    habr.com/ru/articles/1072048/

    #qwen #llm #quantization #apple_silicon #lmstudio #ollama

  7. ИИ снова закрывается: почему нейросети оказались на грани блокировок

    ИИ снова закрывается. Пока мир следит за технологической войной чипов, Пекин и Вашингтон начали закрывать доступ к самому главному — готовым моделям. США уже убрали Claude Mythos из общего доступа, из-за рисков в кибербезопасности. Китай в свою очередь готовится заблокировать экспорт GLM, Qwen и DouBao. Добро пожаловать в эпоху «цифрового суверенитета», где нейросети официально признаны стратегическим оружием. Разбираемся, к чему приведет эта односторонняя прозрачность.

    habr.com/ru/companies/selectel

    #selectel #ai #llmмодели #alibaba #glm #qwen #DouBao #claude_mythos #claude #искусственный_интеллект

  8. Free AI Chat, locally in your browser. 💻
    - No signup required
    - 100% data privacy
    - No API keys 🔒

    Supported Models:
    #SmolLM2
    #Qwen
    #Llama
    #DeepSeek R1
    #Phi
    #TinyLlama
    • & More

    🔗 zalt.me/tools/free-ai-chat-onl

    #FreeAI #Free #LocalLLM #WebGPU #AI #WebLLM #ChatGPT #JS #opensource

  9. North Mini Code v1.0 - a Qwen 3.6 35B MoE alternative

    North Mini Code v1.0 - a Qwen 3.6 35B MoE alternative #qwen #llama #cohere

    fedia.io/m/[email protected]

  10. Вайбкодим .EXE под Windows с GUI на AutoHotkey v2

    История о том, как превратить консольный скрипт в полноценное Windows приложение с GUI на AutoHotkey v2 при помощи нейросетей и вайбкодинга. Разбираем этапы от поиска инструментов до борьбы с интерфейсом в стиле софта нулевых без единой строчки кода, написанной вручную.

    habr.com/ru/articles/1016392/

    #вайбкодинг #нейросети #программирование #autohotkey #cmd #ffmpeg #gemini #qwen

  11. Как заставить LLM считать точно: генерация кода вместо генерации ответов

    Недавно в популярном Facebook-посте: «GPT работает всё хуже. Просишь пересчитать формулу на 600 грамм, он бодро выдаёт две по 300. Пора, видимо, валить». Проблема знакомая каждому, кто пытался использовать LLM для расчётов. Но это не деградация конкретной модели. Это фундаментальное ограничение архитектуры. И у него есть решение.

    habr.com/ru/articles/1015434/

    #LLM #Python #Docker #code_generation #бухгалтерия #Qwen #DeepSeek #sandbox #excel

  12. Как заставить LLM считать точно: генерация кода вместо генерации ответов Недавно в популярном Facebook-посте: «GPT...

    #LLM #Python #Docker #code #generation #бухгалтерия #Qwen #DeepSeek #sandbox #excel

    Origin | Interest | Match
  13. Tested Qwen2.5 Coder 14B on my Linux server. Same code, same prompt I used on DeepSeek R1 last week. 12 seconds. Consistent across 3 runs. Zero drama. It cleaned up the code nicely and didn't go insane.
    Two models + same task = completely different personalities.
    Now I understand why many devs use Qwen Coder as their tool of choice.

    Read below to find out how it can help you.

    #LocalAI #Qwen #CodeRefactoring #AIAtHome #Ope

    goarcherdynamics.com/2026/03/1

  14. 🦁📨 LöwenPost 43 - Sino Kolumne: Qwen AI ~ Great Wall Motor ~ Volkskongress
    0cn.de/LoPo43

    #china #qwen #ai #ki #gwm #volkskongress

  15. Что пугает лично меня в развитии искусственных помощников

    Пока генераторы текста на базе языковых моделей соревнуются в скорости производства поверхностных текстов на тему отъема рабочих мест, мне тоже есть, что сказать про гонку вооружений человека искусственными помощниками (которых здесь и далее я для простоты буду называть малорелевантным, но устоявшимся термином «ИИ»). Я не боюсь, что меня вышвырнут на улицу, потому что ИИ начнет писать код и проектировать системы лучше меня. Неважно даже, почему я так спокоен: оттого ли, что мой уникальный опыт — в некоторых областях — не получить путем всасывания и переработки всей мудрости интернета, или просто потому, что я — беспечный дурак. Речь не об этом. Есть вещи, связанные с бешеным распространением ИИ в шарнармассах, которые меня по-настоящему, действительно беспокоят. Нытьё Кассандры

    habr.com/ru/articles/1002644/

    #openai #claude #warp #deepseek #qwen #бям #llm #assistants

  16. Что пугает лично меня в развитии искусственных помощников Пока генераторы текста на базе языковых моделей ...

    #openai #claude #warp #deepseek #qwen #бям #llm #assistants

    Origin | Interest | Match
  17. So, I just heard a lawyer that create huge legal documents to avoid other people to upload these to AI:

    - Deliverately make documents over 20MB
    - Having documents with "shadow text" to exceed a context window
    - Use PDF-as-image to avoid LLM reading text correctly.
    - Having "white text" for false afirmations.

    #AI #LLM #LargeLanguageModels #Grok #Gemini #ChatGPT #Copilot #Mistral #Perplexity #DeepSeek #Qwen #DuckAi #Kimi

  18. Большой бенчмарк: ROCm vs Vulkan в LM Studio 0.4 и добавление параллельных запросов

    27 января вышла LM Studio версии 0.4.0 и это обновление принесло долгожданную функцию параллельной обработки запросов через continuous batching. Это критически важное обновление для production-использования локальных LLM, которое обещает значительное увеличение пропускной способности. Теперь можно не просто "крутить модельку для себя", а разворачивать реальные multi-user сервисы. Но как это работает на практике? Я провел комплексное исследование на своем домашнем ПК, сравнив производительность ROCm и Vulkan, а также влияние количества потоков на пропускную способность (TPS). Спойлер: Разница между ROCm и Vulkan оказалась шокирующей — до 2 раз в пользу ROCm, а правильная настройка потоков дает +50% бесплатной производительности.

    habr.com/ru/articles/991282/

    #lmstudio #qwen #qwen3 #mistral #ministral_3 #gpt #llm #llmмодели #llmприложения #llmагент

  19. От страха к успеху: история появления ИИ-помощника в системе «АФИДА»

    Привет, Хабр! На связи снова Всеволод Зайковский, заместитель руководителя проекта в «Газпром ЦПС». В прошлый раз я рассказывал, как мы научили нашу систему «АФИДА» распознавать и раскладывать по полочкам тысячи строительных актов с помощью компьютерного зрения. Хаос был побежден, документы оцифрованы, лежали в нужных папках, и их даже можно было найти. Казалось бы — живи и радуйся, но аппетит приходит во время еды. Мы поняли, что система «видит» текст, и задали логичный вопрос: «А можно просто спросить у нее, какую марку бетона использовали для заливки фундамента, и она ответит?». Подумали и решили, что можно. Тогда нам казалось, что прикрутить LLM к нашему архиву, чтобы она работала как умный поисковик, очень просто. Но все оказалось не так радужно. Первая версия нашего «строительного чат-бота» галлюцинировала так, что путала проектную документацию с веб-дизайном, а ответы генерировались по три минуты. Это история о том, как мы прошли путь от игрушечного чат-бота до полноценной RAG-системы в закрытом контуре. Расскажу, как мы запускали нейросети на CPU, почему в нашем сравнительном тесте победил Qwen, и как мы оценивали качество ответов в Excel, когда поняли, что стандартные бенчмарки нам не подходят. Статья будет полезна архитекторам, ML-инженерам, и руководителям, которые ищут рабочие on-premise решения. Если вы тоже пытаетесь внедрить LLM в энтерпрайз без бюджета и тысячи видеокарт — этот кейс для вас.

    habr.com/ru/companies/gazpromc

    #Искусственный_интеллект #RAG #Корпоративные_решения #ChromaDB #Qwen #Интеграция_AI #llm #Бэнчмарк

  20. Päätin testata ovatko kiinalaiset tekoälymallit rehellisiä vai propagandakoneita. Rakensin testiasetelman seitsemälle eri tekoälylle, mukana sekä kiinalaisia haastajia että länsimaisia verrokkeja.

    Ja tulokset: propagandaa löytyi kaikista... paitsi yhdestä. 👉 youtu.be/9JzyZPdRT1M

    #tekoäly #deepseek #qwen #luotettavuus #propaganda #tekoälyvalehtelee
    youtu.be/9JzyZPdRT1M

  21. Päätin testata ovatko kiinalaiset tekoälymallit rehellisiä vai propagandakoneita. Rakensin testiasetelman seitsemälle eri tekoälylle, mukana sekä kiinalaisia haastajia että länsimaisia verrokkeja.

    Ja tulokset: propagandaa löytyi kaikista... paitsi yhdestä. 👉 youtu.be/9JzyZPdRT1M

    #tekoäly #deepseek #qwen #luotettavuus #propaganda #tekoälyvalehtelee
    youtu.be/9JzyZPdRT1M

  22. Päätin testata ovatko kiinalaiset tekoälymallit rehellisiä vai propagandakoneita. Rakensin testiasetelman seitsemälle eri tekoälylle, mukana sekä kiinalaisia haastajia että länsimaisia verrokkeja.

    Ja tulokset: propagandaa löytyi kaikista... paitsi yhdestä. 👉 youtu.be/9JzyZPdRT1M

    #tekoäly #deepseek #qwen #luotettavuus #propaganda #tekoälyvalehtelee
    youtu.be/9JzyZPdRT1M

  23. Päätin testata ovatko kiinalaiset tekoälymallit rehellisiä vai propagandakoneita. Rakensin testiasetelman seitsemälle eri tekoälylle, mukana sekä kiinalaisia haastajia että länsimaisia verrokkeja.

    Ja tulokset: propagandaa löytyi kaikista... paitsi yhdestä. 👉 youtu.be/9JzyZPdRT1M

    #tekoäly #deepseek #qwen #luotettavuus #propaganda #tekoälyvalehtelee
    youtu.be/9JzyZPdRT1M

  24. Päätin testata ovatko kiinalaiset tekoälymallit rehellisiä vai propagandakoneita. Rakensin testiasetelman seitsemälle eri tekoälylle, mukana sekä kiinalaisia haastajia että länsimaisia verrokkeja.

    Ja tulokset: propagandaa löytyi kaikista... paitsi yhdestä. 👉 youtu.be/9JzyZPdRT1M

    #tekoäly #deepseek #qwen #luotettavuus #propaganda #tekoälyvalehtelee
    youtu.be/9JzyZPdRT1M

  25. Какая LLM лучше распознает чертежи? Мы сравнили 6 LLM и узнали ответ

    Инженерные чертежи содержат десятки типов размеров и допусков: линейные и угловые, радиальные и диаметральные, справочные и базовые, а также геометрические характеристики вроде плоскостности или перпендикулярности. Для инженера это привычный язык, но для автоматической обработки такие документы представляют серьёзную задачу. С появлением мультимодальных LLM возник вопрос: способны ли они заменить классические OCR-решения и специализированные пайплайны постобработки? Насколько хорошо современные модели справляются с извлечением размеров и допусков из коробки, без дообучения? Какие модели дают максимальную точность, какие быстрее, а какие дешевле? И можно ли комбинировать разные подходы, чтобы повысить результат? Чтобы ответить на эти вопросы, мы протестировали шесть актуальных vision-LLM на одном наборе реальных механических чертежей и сравнили их точность, скорость и стоимость обработки.

    habr.com/ru/articles/946080/

    #llmмодели #chatgpt4 #chatgpt5 #claudeopus4 #gemini_flash #gemini_pro #qwen #языковые_модели #чертежи #обработка_изображений

  26. Negli ultimi giorni ho scritto un post lunghissimo, interessante (credo) e pallosissimo (immagino) sulla creatività, sulla finzione, su Pessoa e sui chatbot basati sulla cosiddetta intelligenza artificiale generativa.

    Vi consiglio di leggere almeno la prima parte e spulciare il resto.

    aitanblog.wordpress.com/2025/0

    #ai #ia #intelligenzaartificiale #aigen #poesia #poeti #fingitori #simulazione #linguaggionaturale #linguaggioartificiale #chatgpt #claude #deepseek #qwen #perplexity #grok #pessoa