home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. 🧵 Suite de mes pérégrinations avec les LLM désinhibés…

    Une étude intéressante publiée par la société 10a Lab il y a quelques jours, "Uncensored Open-weight Models: Redistribution as the Persistence Layer" ( arxiv.org/abs/2609.05241 ), a cartographié l’écosystème Hugging Face/GitHub autour de ces modèles.

    Résultat : 3 471 modèles uncensored originaux, déjà transformés en 8 164 redistributions quantifiées/repackagées.

    Et surtout : sur 1 643 applications GitHub utilisant ce type de backend, 411, donc 25%, sont classées par 10a Labs comme explicitement comme malveillantes : hacking, fraude, génération de malware, etc.

    Autre détail qui résonne pas mal avec mes petits tests locaux : les auteurs constatent que la quantification et le repackaging rendent ces modèles facilement déployables sur du matériel grand public.
    Les modèles 3–8B constituent d’ailleurs 41 % de leur dataset.

    Et Qwen est le king dans ce paysage : parmi les modèles d’origine chinoise identifiés, 80 % sont basés sur la famille Qwen.

    "Cerise sur le gâteau" : avec Heretic, retirer les garde-fous est passé d’un workflow nécessitant une certaine maîtrise des entrailles… à quasiment une commande terminal.
    Dans leur dataset, la production est passée d’environ 89 modèles/mois avant Heretic à ~338/mois après.

    Et pendant ce temps, Check Point retrouve dans les échanges d'un groupe cybercriminel ransomware la recommandation suivante:

    “Qwen 3.5 with all barriers removed… Zero refusals. Absolutely no restrictions.”

    ( engage.checkpoint.com/ai-secur )

    Reste donc une question qui devient de moins en moins théorique :

    Est-ce qu’on va voir rapidement une bascule vers du “bullet-proof self-hosting”, hors télémétrie, hors contrôle fournisseur, ou est-ce que le vol de comptes, de clés API et les marchés gris de tokens resteront encore longtemps la voie de moindre résistance pour les cybercriminels ?

    #LLM #Qwen #Abliteration

  2. Мой опыт с Hermes Agent — ненависть, любовь, ненависть, любовь

    Началось все с установки. Я пошёл почти по самому простому пути - установил его на Mac, в Docker. Потому что это агент, который работает автономно и так же автономно может сделать атата: выполнить rm -rf или выбраться из клетки и начать всё взламывать :) В рамках настройки я сразу выдал доступ к части файлов только на чтение, и только к Obsidian - на чтение и запись (потому что писать он в данном случае должен), но файлы были под Git.

    habr.com/ru/articles/1072770/

    #hermes_agent #aiагенты #llm #локальный_llm #локальные_модели #qwen #agentic_workflows #ai_automation #workflow #go

  3. [Перевод] Qwen3.8-27B: лучший локальный LLM, который вы, вероятно, не сможете запустить

    В этом месяце Alibaba выпустила две модели, и та, о которой все писали, оказалась не той, что мы ждали. Qwen3.8-Max — это API с 2,4 триллионами параметров, и пару недель назад я с большим энтузиазмом написал о ней обзор. Но релиз, которого я действительно ждал, вышел 14 августа: Qwen3.8-27B, Apache 2.0, веса на Hugging Face, модель достаточно компактна, чтобы работать на ноутбуке. Я должен кое в чем признаться. Я не провел полный тест этой модели. Я попробовал, на своем MacBook Air M4 получал около восьми токенов в секунду и потерял терпение где-то на втором запросе. По большей части этот пост посвящен именно моей неудаче, потому что я подозреваю, что у многих из вас вечер сложится так же, как у меня. Что представляет собой Qwen3.8-27B на самом деле 27,78 миллиарда параметров, плотная модель, включающая в себя визуальный энкодер, о котором никто не объявлял заранее. Принимает на вход текст, изображения и видео. Собственный контекст — 262 144 токена, с помощью YaRN можно увеличить его примерно до миллиона, если запускать модель на сервере. Архитектура — это по-настоящему интересная часть, и это не обычный трансформер. На протяжении 64 слоёв Qwen чередует 48 слоёв Gated DeltaNet (линейное внимание) с 16 полными слоями Gated Attention в соотношении 3:1. Только эти 16 слоёв с полным вниманием имеют KV-кэш. Таким образом, на каждый токен приходится около 64 КБ, что составляет примерно четверть от объёма памяти, необходимого для обычной 64-слойной модели с плотным кодированием. Если вы запомните только одно число из этого поста, пусть это будет именно оно. Всё, что касается того, поместится ли эта модель на вашем компьютере, зависит от объёма KV-кэша.

    habr.com/ru/articles/1072048/

    #qwen #llm #quantization #apple_silicon #lmstudio #ollama

  4. I'm using Text-To-Speech (TTS) on my Desktop (Calender Events, Firefox Read Aloud) and with Home Assistant. However the quality isn't the best and I wanted a better option.

    I've started a new project for this called crane-wyoming which is in alpha/beta stage as it is not feature complete but works well for TTS.

    codeberg.org/cryptomilk/crane-

    #homeassistant #speech #speechd #speechdispatcher #tts #inference #llm #voice #asr #qwen #voxtral #ai #rust

  5. Погружаем модели в сказки русские, да рассказы древние – тестируем возможности Qwen и Whisper на дореволюционномъ

    Хотите не забывать детали диалога или то, что вас просили купить в магазине? Конечно, можно по старинке открывать блокнот в телефоне или чат в избранном и записывать все руками, но в потоке задач это неудобно. Гораздо проще надиктовать мысли голосом или записать разговор, а расшифровку доверить сервису. Сегодня ASR-системы нового поколения способны учитывать контекст беседы и выдавать осмысленный текст. Однако у любой медали есть обратная сторона — архитектурные ограничения. Чтобы понять, готовы ли эти модели к жизненным сценариям, мы устроили им бенчмарк на Hugging Face. Ниже — разбор того, ломается ли контекстное окно алгоритмов на длинных видеозаписях и как фоновый шум влияет на итоговое качество транскрибации.

    habr.com/ru/companies/selectel

    #selectel #распознавание_речи #whisper #qwen #asr #транскрибация_речи #автоматическое_распознавание_речи #искусственный_интеллект #тестирование_моделей

  6. Neste vídeo, eu testei diferentes modelos de inteligência artificial rodando localmente no Linux Mint utilizando o LM Studio.
    O objetivo foi verificar se essas IAs conseguem responder corretamente perguntas simples — desde fatos pouco conhecidos, como o primeiro vocalista do Iron Maiden, até informações mais populares, como quem criou o kernel Linux.

    Link: youtu.be/F8A2Yx4an_M

    #inteligenciaartificial #lmstudio #ialocal #ibmgranite #gptoss #googlegemma #qwen #rx550 #linux

  7. Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5) Я решил прове...

    #ollama #amd #vulkan #fedora #deepseek-r1 #llama #3.1 #qwen #3.5 #n8n #podman

    Origin | Interest | Match
  8. TUTORIAL - Passo a passo: IA local no Linux com LM Studio

    Neste vídeo, você vai aprender como rodar inteligência artificial localmente no seu Linux usando o LM Studio.

    Se você quer mais controle, mais privacidade e rodar IA direto no seu computador, esse guia é pra você.

    Link: youtu.be/M7jR2BIuGyQ

    #debian #debian13 #lmstudio #ialocal #ibmgranite #gptoss #googlegemma #qwen #rx550 #linux

  9. Qwen3.6-Max, 코딩 벤치마크 1위지만 오픈소스는 없다, Alibaba의 전략 전환

    Alibaba가 Qwen 최초의 클로즈드 웨이트 모델 Qwen3.6-Max-Preview를 출시했습니다. 코딩 벤치마크 6개 1위, 오픈소스 포기의 의미를 분석합니다.

    aisparkup.com/posts/11648

  10. Я изучил десятки ИИ-стартапов в России. Вот почему большинство из них обречены

    За последний год я изучил десятки российских ИИ-стартапов на площадках Brainbox и Product Radar. Параллельно строил собственную AI-платформу, так что смотрю на рынок не как инвестор, а как инженер с 20-летним опытом в разработке. Картина неутешительная: большинство проектов, которые собирают деньги, будут мертвы через 2-3 года. И причины чисто технические.

    habr.com/ru/articles/1008142/

    #ИИстартапы #инвестиции_в_ИИ #opensource_LLM #DeepSeek #Qwen #архитектура_ИИагентов #суверенный_ИИ #импортозамещение #OpenAI_API_зависимость #LLMроутер

  11. Я изучил десятки ИИ-стартапов в России. Вот почему большинство из них обречены

    За последний год я изучил десятки российских ИИ-стартапов на площадках Brainbox и Product Radar. Параллельно строил собственную AI-платформу, так что смотрю на рынок не как инвестор, а как инженер с 20-летним опытом в разработке. Картина неутешительная: большинство проектов, которые собирают деньги, будут мертвы через 2-3 года. И причины чисто технические.

    habr.com/ru/articles/1008142/

    #ИИстартапы #инвестиции_в_ИИ #opensource_LLM #DeepSeek #Qwen #архитектура_ИИагентов #суверенный_ИИ #импортозамещение #OpenAI_API_зависимость #LLMроутер

  12. Я изучил десятки ИИ-стартапов в России. Вот почему большинство из них обречены

    За последний год я изучил десятки российских ИИ-стартапов на площадках Brainbox и Product Radar. Параллельно строил собственную AI-платформу, так что смотрю на рынок не как инвестор, а как инженер с 20-летним опытом в разработке. Картина неутешительная: большинство проектов, которые собирают деньги, будут мертвы через 2-3 года. И причины чисто технические.

    habr.com/ru/articles/1008142/

    #ИИстартапы #инвестиции_в_ИИ #opensource_LLM #DeepSeek #Qwen #архитектура_ИИагентов #суверенный_ИИ #импортозамещение #OpenAI_API_зависимость #LLMроутер

  13. Что пугает лично меня в развитии искусственных помощников

    Пока генераторы текста на базе языковых моделей соревнуются в скорости производства поверхностных текстов на тему отъема рабочих мест, мне тоже есть, что сказать про гонку вооружений человека искусственными помощниками (которых здесь и далее я для простоты буду называть малорелевантным, но устоявшимся термином «ИИ»). Я не боюсь, что меня вышвырнут на улицу, потому что ИИ начнет писать код и проектировать системы лучше меня. Неважно даже, почему я так спокоен: оттого ли, что мой уникальный опыт — в некоторых областях — не получить путем всасывания и переработки всей мудрости интернета, или просто потому, что я — беспечный дурак. Речь не об этом. Есть вещи, связанные с бешеным распространением ИИ в шарнармассах, которые меня по-настоящему, действительно беспокоят. Нытьё Кассандры

    habr.com/ru/articles/1002644/

    #openai #claude #warp #deepseek #qwen #бям #llm #assistants

  14. Что пугает лично меня в развитии искусственных помощников Пока генераторы текста на базе языковых моделей ...

    #openai #claude #warp #deepseek #qwen #бям #llm #assistants

    Origin | Interest | Match
  15. LLM для «ремонта» 1С: как ИИ помогает анализировать логи

    Когда система «падает», а времени на вдумчивый разбор логов нет, на помощь может прийти не еще один разработчик, а LLM. Нейросеть показала достойный результат в качестве ассистента при диагностике ошибок 1С. Привет, Хабр! Меня зовут Евгений Филиппов, я эксперт департамента корпоративных решений IBS. Поговорим о том, как можно использовать ИИ для разбора логов 1С при возникновении некоторых характерных ошибок параллельной работы.

    habr.com/ru/companies/ibs/arti

    # #нейросети #qwen #технологический_журнал #логи

  16. LLM для «ремонта» 1С: как ИИ помогает анализировать логи

    Когда система «падает», а времени на вдумчивый разбор логов нет, на помощь может прийти не еще один разработчик, а LLM. Нейросеть показала достойный результат в качестве ассистента при диагностике ошибок 1С. Привет, Хабр! Меня зовут Евгений Филиппов, я эксперт департамента корпоративных решений IBS. Поговорим о том, как можно использовать ИИ для разбора логов 1С при возникновении некоторых характерных ошибок параллельной работы.

    habr.com/ru/companies/ibs/arti

    # #нейросети #qwen #технологический_журнал #логи

  17. Какая LLM лучше распознает чертежи? Мы сравнили 6 LLM и узнали ответ

    Инженерные чертежи содержат десятки типов размеров и допусков: линейные и угловые, радиальные и диаметральные, справочные и базовые, а также геометрические характеристики вроде плоскостности или перпендикулярности. Для инженера это привычный язык, но для автоматической обработки такие документы представляют серьёзную задачу. С появлением мультимодальных LLM возник вопрос: способны ли они заменить классические OCR-решения и специализированные пайплайны постобработки? Насколько хорошо современные модели справляются с извлечением размеров и допусков из коробки, без дообучения? Какие модели дают максимальную точность, какие быстрее, а какие дешевле? И можно ли комбинировать разные подходы, чтобы повысить результат? Чтобы ответить на эти вопросы, мы протестировали шесть актуальных vision-LLM на одном наборе реальных механических чертежей и сравнили их точность, скорость и стоимость обработки.

    habr.com/ru/articles/946080/

    #llmмодели #chatgpt4 #chatgpt5 #claudeopus4 #gemini_flash #gemini_pro #qwen #языковые_модели #чертежи #обработка_изображений

  18. Какого китайца выбрать? DeepSeek vs Qwen vs Baidu

    Китайские нейросети вышли на арену: DeepSeek , Qwen и Baidu ERNIE стремительно догоняют западные аналоги. Я протестировал их лично — на коде, логике и креативе. Где тупят? Кто реально выдаёт GPT‑4‑уровень? В статье — примеры, таблицы, фейлы и вывод: что выбрать в 2025 году , если тебе важны мощность, стабильность и интерфейс без иероглифов.

    habr.com/ru/articles/933656/

    #Искусственный_интеллект #искусственный_интеллект_чатбот #большие_языковые_модели #llm #qwen #deepseek #baidu #deepseekr1 #qwen3