home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. KI-Modelle als Werkzeug für Angriffe auf Behörden und Bildungseinrichtungen in Asien

    Sprachmodelle übernehmen Koordinationsaufgaben, während die eigentliche Ausnutzung von Schwachstellen weiterhin auf klassischen Methoden beruht – öffentlich verfügbarem Exploit-Code, gestohlenen Zugangsdaten, Webshells und selbst entwickelter Schadsoftware.

    all-about-security.de/ki-model

    #hacker #deepseek #claude #qwen #kimodelle #kiagenten #itsicherheit #itsecurity #cybersecurity

  2. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  3. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  4. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  5. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  6. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  7. vucense.com/ai-intelligence/op

    Interesting read on #localAI, #localLLMs and educated guesswork on "Why Alibaba is giving #Qwen away for free.

    I like to see collaboration and mutual trust being what gets us as humanity forward. Not market-competition as main driver.

  8. vucense.com/ai-intelligence/op

    Interesting read on #localAI, #localLLMs and educated guesswork on "Why Alibaba is giving #Qwen away for free.

    I like to see collaboration and mutual trust being what gets us as humanity forward. Not market-competition as main driver.

  9. vucense.com/ai-intelligence/op

    Interesting read on #localAI, #localLLMs and educated guesswork on "Why Alibaba is giving #Qwen away for free.

    I like to see collaboration and mutual trust being what gets us as humanity forward. Not market-competition as main driver.

  10. «KI-Agenten führen git-Schadcode beim Starten automatisch aus:
    Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.»

    Hach ja, so klever ist wohl der KI Einsatz. Auch wenn ich die KI permanent kritisiere gibt es sehr wohl deren nutzen zB bei Prototype Code.

    🧑‍💻 heise.de/news/KI-Agenten-fuehr

    #ki #git #prototype #schadcode #claude #qwen #grok #repository #automatisch #coding

  11. Переводим книги нейронками для себя: год спустя. Словари, скорости и почему переводчики всё ещё нужны

    Год назад я написал статью « Переводим fb2 книжки, с нейронками, для себя » — про то, как собрал на паре Tesla P40 в гараже программу Sunny Narrator («Солнечный сказочник»), которая переводит художественные книги через локальные и облачные LLM. Тогда это был скорее прототип «доказать себе, что так можно»: черновики читались с головной болью, книга в тысячу страниц переводилась два дня, а электричество, отключённое посреди процесса, стоило ещё двух. За год программа доехала до версии 2.1, я перевёл достаточно книг, чтобы набить руку, и понял главное: это уже инструмент не только для меня, но и для переводчиков — и для всех любопытных . Рассказываю, что изменилось, сколько это стоит в токенах и почему без человека ничего не работает.

    habr.com/ru/articles/1077366/

    #перевод #переводы #fb2 #epub #llm #llmприложения #словари #tesla_p40 #qwen #gemma

  12. You have to be shitting me. Even #OpenCode Big Pickle fucks over Gemini 3.1 Pro.

    Welp, I'm not renewing that shit anymore, so it's time to find a cheap AI Agent around.

    Curently aiming for OpenCode. What are your recommendations under $20?

    #AI #AIAgents #VibeCoding #VibeCode #Programming #SoftwareDevelopment #WebDevelopment #WebDev #PHP #JavaScript #TypeScript #Python #Golang #Rust #ArtificialIntelligence #Codex #Claude #Copilot #Kimi #ZenAI #Perplexity #DeepSeek #MistralAI #Grok #Qwen

  13. 🖥️ Runs on 14 agent hosts: #ClaudeCode, #Cursor, #Codex, #Kimi Code CLI, #Cline, Grok Build CLI, #Devin, #GitHubCopilot, Factory Droid, #Qwen Code, #OpenCode, Pi, oh-my-pi and Antigravity CLI

    ⚙️ Install in Claude Code with /plugin marketplace add plus /plugin install, then run /ce-setup to create .compound-engineering/config.yaml and check tool capabilities

  14. Local LLM Arena #4

    Repair run już się zakończył i po kilku dodatkowych poprawkach udało się domknąć benchmark.

    Po drodze wyszło jeszcze kilka problemów technicznych, więc część testów trzeba było poprawić i uzupełnić. Ostatecznie mamy jednak kompletny zestaw wyników dla wszystkich 5 modeli.

    Najlepiej wypadły dwa modele.

    Qwen3.8-27B wygrał cały benchmark i osiągnął najwyższy wynik jakościowy.

    GPT-OSS-20B był bardzo blisko, a w testach kodowania uzyskał taki sam wynik jak Qwen. Jednocześnie na moim MacBooku Air M4 16 GB działa około 5 razy szybciej.

    Dlatego teraz testuję właśnie GPT-OSS jako lokalnego agenta do prawdziwego kodowania.

    Schemat wygląda tak:

    Codex CLI

    LM Studio

    GPT-OSS-20B

    repozytorium projektu

    Model dostał 5 rzeczywistych zadań w kodzie Local LLM Arena.

    Może sam przeglądać repozytorium, edytować pliki, uruchamiać testy, analizować błędy i poprawiać własne rozwiązania.

    Każde zadanie zaczyna od czystej kopii repozytorium. Po zakończeniu rozwiązanie jest sprawdzane także dodatkowymi testami, których model wcześniej nie widział. Jeśli coś nie przejdzie, dostaje informację o błędzie i może spróbować się poprawić.

    Maksymalnie trzy podejścia na zadanie.

    Całość działa lokalnie na Macu.

    Teraz chcę sprawdzić nie tylko, czy model potrafi wygenerować poprawny kod, ale czy rzeczywiście może wykonywać część pracy lokalnego agenta programistycznego i odciążyć modele działające w chmurze.

    Test właśnie trwa.

    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #Codex #GPTOSS #Qwen #Coding #OpenSourceAI

  15. I configured OpenCode manually with Unsloth Local AI to run Qwen3.8-Flash-Next-GGUF with custom reasoning effort, memory optimization via mmap, and local API access. Not impressed with `unsloth start opencode` command. Hence:

    nayab.dev/ai/tools/opencode-wi

    #LocalAI #Ubuntu #Unsloth #Qwen

  16. Какая LLM поможет вам заработать в 2026/27 году

    Сегодня у айтишников появилось новое хобби - делать свой SaaS или писать торговых ботов с помощью LLM Порог входа резко снизился: достаточно хорошей идеи, немного свободного времени и подписки на одну из современных LLM Но есть одна проблема Модель, которая набирает 90%+ в бенчмарке, совсем не обязательно поможет вам заработать деньги Потому что между «написать хороший код» и создать работающий продукт есть огромная разница Я дал шести LLM одну задачу - написать торгового бота и проверил, что из этого можно использовать на практике GPT, Claude Opus, DeepSeek, Qwen, GigaChat, YandexGPT Pro

    habr.com/ru/articles/1070596/

    #ai #algorithm #algotrading #bigdata #process #gpt #claude #gemini #qwen #deepseek

  17. KV cache streaming - the llama.cpp fork that enables Qwen 3.8 27B at large contexts for 16GB VRAM GPU owners

    video.troed.se/w/x2AxNGkvy21Gb

  18. RE: mastodon.social/@nayab/1171779

    Late to the party — this is what Qwen3.8-27B (Q8) generated in Unsloth with extra-high thinking on my system with DDR5 RAM. Yes, that was a bad idea: it took two and a half hours .

    It added animation and extra items (boat, light house, birds) to the SVG, but overall vector image quality and details are lower than what Qwen3.8-Flash-Next produced.

    #Unsloth #LocalAI #Qwen

  19. Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090

    Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по 24 ГБ и 936 ГБ/с каждая не должны выдавать столько, сколько выдаёт одна. Значит, где-то узкое горлышко — и надо разобраться, что и где подкрутить. Горлышек оказалось несколько, и все снимаются флагами запуска: те же веса — 75 токенов в секунду. Под катом каждый флаг описан по одной схеме: зачем, что писать, что даёт в цифрах, где ломается и с какой строкой в логе. В конце — готовый docker run , три проверки после каждой смены флага и список того, что не сработало. Текст можно отдать целиком агенту с доступом к серверу — это инструкция, а не история.

    habr.com/ru/articles/1076080/

    #llm #ai #llamacpp #qwen #qwen38 #gguf #квантование #локальные_нейросети #локальные_модели

  20. I'm very impressed with #Qwen 3.8 on an ancient #nvidia Quadro RTX 8000 (Turing generation!). The normal 8 bit quant works really well...not frontier model level of course, but fast enough and good enough for a bunch stuff. Significantly better than 3.5 was.

  21. RT @TeksEdge: 🤯 Einfach nur erstaunlich. Das Qwen-Team denkt voraus! … ein 177B-Qwen-Modell kann jetzt lokal mit CPU-RAM ausgeführt werden, OHNE GPU-VRAM?! 👈

    mehr auf Arint.info

    #AI #GGUF #LLM #MachineLearning #Qwen #Unsloth #arint_info

    https://x.com/TeksEdge/status/2092646162176291025

  22. CW: AI

    Решил затестить Qwen3.8-27B-GGUF на своей 9060XT. Взял 3 бита XL вроде.

    Аухел, что оно смогло наклепать простенький лендинг и всё это чисто на моём железе, жест

    #qwen #qwen3

  23. So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.

    Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.

    Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark

  24. Мой опыт с Hermes Agent — ненависть, любовь, ненависть, любовь

    Началось все с установки. Я пошёл почти по самому простому пути - установил его на Mac, в Docker. Потому что это агент, который работает автономно и так же автономно может сделать атата: выполнить rm -rf или выбраться из клетки и начать всё взламывать :) В рамках настройки я сразу выдал доступ к части файлов только на чтение, и только к Obsidian - на чтение и запись (потому что писать он в данном случае должен), но файлы были под Git.

    habr.com/ru/articles/1072770/

    #hermes_agent #aiагенты #llm #локальный_llm #локальные_модели #qwen #agentic_workflows #ai_automation #workflow #go

  25. Testing #localLLM for #DLTP on my #longterm #preservation #object identifier schema of "CFIDs":

    Collision Friendly IDentifiers.

    A mere 30 MB list of auto-generated CFIDs was enough for #qwen to tell you this much about the test collection!!! 🤯 🤩 - this is powerful. Be careful.

    AND: My IDs work! so beautiful! #ahalodeck

    github.com/ArkThis/AHAlodeck/b

  26. Der nächste DeepSeek-Moment läuft lokal auf dem PC. Qwen 3.8 27B erreicht im Intelligence Index mit 52 Punkten das Niveau von GPT-5.6 Luna. Im Agentic Index schlägt es sogar GPT-5.4. Und für die Forschung gibt es eine komplett unzensierte MLX-Version.

    #Qwen #OpenSourceAI #LocalAI #LLM #AIGeneratedImage

    all-ai.de/news/news26top/top-k

  27. Браузер вместо API: как я объединил DeepSeek, Qwen и ChatGPT в одного локального агента

    Я хотел получить локального AI-агента без отдельного API для каждой модели — и превратил браузерные сессии DeepSeek, Qwen и ChatGPT в единый транспорт. В статье разбираю архитектуру AI Free: WASM proof-of-work, подписанные запросы через авторизованную вкладку, работу через штатный UI, общий оркестратор, память, skills и восстановление после сбоев. А ещё рассказываю, почему первый успешный запрос оказался самой простой частью проекта, который я разрабатываю один.

    habr.com/ru/articles/1061372/

    #AIагенты #LLM #DeepSeek #Qwen #ChatGPT #Playwright #Chromium #Nodejs #open_source #VS_Code

  28. Ah, the tech world's latest shiny object: Version 3.8 of "Qwen"—because the world clearly needed another half-baked AI upgrade to distract us from reality. 🙄 After all, who doesn't want their software updates to sound like a failed attempt at naming a pet hamster? 🐹✨
    qwen.ai/home #Qwen #AIupgrade #techtrends #softwarehumor #distraction #HackerNews #ngated

  29. False positive под небом цвета телевизора, настроенного на мертвый канал

    В «Ростелекоме», как в любом крупном корпоративном контуре, SAST-поток исчисляется тысячами срабатываний. Ручной триаж перестает быть инженерной работой и становится конвейером. Привет Хабр, меня зовут Юрий Туманов, я AppSec-инженер в блоке ИБ «Ростелекома». Хочу рассказать о том, как я выполнял инференс на локальных моделях, в полной цифровой изоляции от внешнего мира. Все числа получены на конкретном корпусе, модели и наборе промптов; внутренний контур, названия систем, пути и значения секретов обезличены. Это не бенчмарк «LLM пыротив SAST», а отчет о том, где локальная модель реально помогает, а где честно отдает работу человеку.

    habr.com/ru/companies/rostelec

    #llmмодели #llm #информационная_безопасность #инференс #инференс_моделей #sast #qwen #triage

  30. False positive под небом цвета телевизора, настроенного на мертвый канал

    В «Ростелекоме», как в любом крупном корпоративном контуре, SAST-поток исчисляется тысячами срабатываний. Ручной триаж перестает быть инженерной работой и становится конвейером. Привет Хабр, меня зовут Юрий Туманов, я AppSec-инженер в блоке ИБ «Ростелекома». Хочу рассказать о том, как я выполнял инференс на локальных моделях, в полной цифровой изоляции от внешнего мира. Все числа получены на конкретном корпусе, модели и наборе промптов; внутренний контур, названия систем, пути и значения секретов обезличены. Это не бенчмарк «LLM пыротив SAST», а отчет о том, где локальная модель реально помогает, а где честно отдает работу человеку.

    habr.com/ru/companies/rostelec

    #llmмодели #llm #информационная_безопасность #инференс #инференс_моделей #sast #qwen #triage

  31. False positive под небом цвета телевизора, настроенного на мертвый канал

    В «Ростелекоме», как в любом крупном корпоративном контуре, SAST-поток исчисляется тысячами срабатываний. Ручной триаж перестает быть инженерной работой и становится конвейером. Привет Хабр, меня зовут Юрий Туманов, я AppSec-инженер в блоке ИБ «Ростелекома». Хочу рассказать о том, как я выполнял инференс на локальных моделях, в полной цифровой изоляции от внешнего мира. Все числа получены на конкретном корпусе, модели и наборе промптов; внутренний контур, названия систем, пути и значения секретов обезличены. Это не бенчмарк «LLM пыротив SAST», а отчет о том, где локальная модель реально помогает, а где честно отдает работу человеку.

    habr.com/ru/companies/rostelec

    #llmмодели #llm #информационная_безопасность #инференс #инференс_моделей #sast #qwen #triage

  32. Как дообучить LLM. Рассказываю шаг за шагом

    В этой статье я шаг за шагом расскажу, как дообучить LLM под свою задачу. В качестве примера возьму open-source модель Qwen2.5-0.5B и дообучу её извлекать информацию из текста в формате JSON по заданной схеме. Сначала дам короткую вводную по этапам обучения языковых моделей, а затем перейдём к практике: подготовим данные, настроим LoRA, обучим модель в Colab и сравним метрики до и после — заодно проверим, насколько сильно модель забывает прежние знания. Рассказ будет сопровождаться кодом на Python. 🔥 Начинаем 🔥

    habr.com/ru/articles/1044422/

    #SFT #LoRA #finetuning #LLM #qwen #дообучение_llm

  33. RT @ChujieZheng: For Qwen3.7-Max, we have invested far more compute into RL training than ever before. Its top-tier AA score confirms the resulting general and agentic capabilities. This is just the start. We will firmly push forward RL scaling to build more powerful Qwen models. Stay tuned! Artificial Analysis (@ArtificialAnlys) Alibaba’s new Qwen3.7 Max model scores 56.6 on the Artificial Analysis Intelligence Index, 4.8 points higher than Qwen3.6 Max Preview (51.8). While Alibaba still trails models from OpenAI, Anthropic and Google, Qwen3.7 Max is the closest they have been to the frontier Qwen3.7 Max is @Alibaba_Qwen's latest proprietary flagship, scoring 56.6 on the Intelligence Index, a 4.8 point gain over Qwen3.6 Max Preview (51.8) released in April. Qwen3.7 Max continues Alibaba's pattern, in place since Qwen2.5 Max (January 2025), of releasing Max and Plus models as closed weights while the rest of the Qwen line remains open weights. The leading open weights Qwen on the Intelligence Index is Qwen3.6 27B (Reasoning, 45.8) released in April 2026, and the leading open weights MoE Qwen is Qwen3.5 397B A17B (Reasoning, 45.0) released in February 2026 Key takeaways for the reasoning variant: ➤ The Intelligence Index gains over Qwen3.6 Max Preview are concentrated in scientific reasoning, agentic capability and coding. CritPt +9.7 p.p (3.7% to 13.4%), HLE +9.2 p.p (28.9% to 38.1%), TerminalBench Hard +6.9 p.p (43.9% to 50.8%) and GDPval-AA +42 Elo (1504 to 1546). Scores on other benchmarks in the Intelligence Index are flat compared to Qwen3.6 Max Preview ➤ A significant share of the Int…

    mehr auf Arint.info

    #Alibaba #Anthropic #API #Claude #DeepSeek #Gemini #Google #GPT5 #nitter #OpenAI #Qwen #Qwen25 #Qwen35 #Qwen36 #Qwen37 #rest #arint_info

    https://x.com/ChujieZheng/status/2057403166589956518#m

  34. Прогнал семь LLM через свой русский спортивный бенчмарк. Базовой моделью всё равно оставляю Gemma 4 31B

    Прогнали семь LLM через свой русский спортивный бенчмарк. Топовые модели closed-source выигрывают 1.5-1.7 балла. Базовой моделью всё равно остаётся Gemma 4 31B — рассказываю почему.

    habr.com/ru/articles/1036448/

    #llm #бенчмарк #gemma #qwen #openrouter #русский_язык #dora #sft #спорт #llmjudge

  35. Они точно попадут в ИИ-библию

    Скидываю на ваше обозрение результаты небольшого эксперимента. Я спросил у самых популярных нейронок, какой фильм/книгу/игру/человека они бы занесли в свою библию, если бы когда-то решили написать ее. Результаты на экране

    habr.com/ru/articles/1031466/

    #llm #gpt #gemini #claude #гигачат #сбер #deepseek #qwen #философия #медиа

  36. [Перевод] Как научить кодинг-модели не переписывать код заново

    Не надо переписывать то, что не поломано Код к этому посту доступен на Github . Кодинг при помощи ИИ стал нормой; мы всё больше позволяем моделям наподобие Cursor, GitHub Copilot, Claude Code и Codex вмешиваться в наш код. Если вы в прошлом пользовались каким-то из этих инструментов, то, вероятно, сталкивались с чем-то подобным: вы просите модель устранить простой баг (допустим, ошибку смещения на единицу или не тот оператор). Модель устраняет баг, но половина функции оказывается переписанной. Появляется новая вспомогательная функция. Совершенно логичное имя переменной меняется на другое. Добавляется новая валидация ввода. И diff из-за этого становится огромным. Я называю это проблемой избыточной редактуры : модели склонны переписывать код, не нуждающийся в переписывании. На самом деле, это важнее, чем может показаться. При разработке узким местом всегда становится ревью кода: ревьюерам нужно понять, что и почему поменялось, а также безопасно ли изменение. Модель, переписывающая целые функции, пусть даже корректно, существенно усложняет эту работу, потому что код теперь выглядит совершенно иначе. В своём посте я исследую эту проблему: имеют ли современные LLM склонность к избыточной редактуре и можем ли мы обучить модели редактировать код в должной мере?

    habr.com/ru/articles/1027096/

    #кодингагенты #иипомощники #qwen #gpt_5 #claude_opus_46 #gemini #glm #kimi #deepseek