home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. KI-Modelle als Werkzeug für Angriffe auf Behörden und Bildungseinrichtungen in Asien

    Sprachmodelle übernehmen Koordinationsaufgaben, während die eigentliche Ausnutzung von Schwachstellen weiterhin auf klassischen Methoden beruht – öffentlich verfügbarem Exploit-Code, gestohlenen Zugangsdaten, Webshells und selbst entwickelter Schadsoftware.

    all-about-security.de/ki-model

    #hacker #deepseek #claude #qwen #kimodelle #kiagenten #itsicherheit #itsecurity #cybersecurity

  2. You have to be shitting me. Even #OpenCode Big Pickle fucks over Gemini 3.1 Pro.

    Welp, I'm not renewing that shit anymore, so it's time to find a cheap AI Agent around.

    Curently aiming for OpenCode. What are your recommendations under $20?

    #AI #AIAgents #VibeCoding #VibeCode #Programming #SoftwareDevelopment #WebDevelopment #WebDev #PHP #JavaScript #TypeScript #Python #Golang #Rust #ArtificialIntelligence #Codex #Claude #Copilot #Kimi #ZenAI #Perplexity #DeepSeek #MistralAI #Grok #Qwen

  3. Local LLM Arena #4

    Repair run już się zakończył i po kilku dodatkowych poprawkach udało się domknąć benchmark.

    Po drodze wyszło jeszcze kilka problemów technicznych, więc część testów trzeba było poprawić i uzupełnić. Ostatecznie mamy jednak kompletny zestaw wyników dla wszystkich 5 modeli.

    Najlepiej wypadły dwa modele.

    Qwen3.8-27B wygrał cały benchmark i osiągnął najwyższy wynik jakościowy.

    GPT-OSS-20B był bardzo blisko, a w testach kodowania uzyskał taki sam wynik jak Qwen. Jednocześnie na moim MacBooku Air M4 16 GB działa około 5 razy szybciej.

    Dlatego teraz testuję właśnie GPT-OSS jako lokalnego agenta do prawdziwego kodowania.

    Schemat wygląda tak:

    Codex CLI

    LM Studio

    GPT-OSS-20B

    repozytorium projektu

    Model dostał 5 rzeczywistych zadań w kodzie Local LLM Arena.

    Może sam przeglądać repozytorium, edytować pliki, uruchamiać testy, analizować błędy i poprawiać własne rozwiązania.

    Każde zadanie zaczyna od czystej kopii repozytorium. Po zakończeniu rozwiązanie jest sprawdzane także dodatkowymi testami, których model wcześniej nie widział. Jeśli coś nie przejdzie, dostaje informację o błędzie i może spróbować się poprawić.

    Maksymalnie trzy podejścia na zadanie.

    Całość działa lokalnie na Macu.

    Teraz chcę sprawdzić nie tylko, czy model potrafi wygenerować poprawny kod, ale czy rzeczywiście może wykonywać część pracy lokalnego agenta programistycznego i odciążyć modele działające w chmurze.

    Test właśnie trwa.

    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #Codex #GPTOSS #Qwen #Coding #OpenSourceAI

  4. Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090

    Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по 24 ГБ и 936 ГБ/с каждая не должны выдавать столько, сколько выдаёт одна. Значит, где-то узкое горлышко — и надо разобраться, что и где подкрутить. Горлышек оказалось несколько, и все снимаются флагами запуска: те же веса — 75 токенов в секунду. Под катом каждый флаг описан по одной схеме: зачем, что писать, что даёт в цифрах, где ломается и с какой строкой в логе. В конце — готовый docker run , три проверки после каждой смены флага и список того, что не сработало. Текст можно отдать целиком агенту с доступом к серверу — это инструкция, а не история.

    habr.com/ru/articles/1076080/

    #llm #ai #llamacpp #qwen #qwen38 #gguf #квантование #локальные_нейросети #локальные_модели

  5. RT @TeksEdge: 🤯 Einfach nur erstaunlich. Das Qwen-Team denkt voraus! … ein 177B-Qwen-Modell kann jetzt lokal mit CPU-RAM ausgeführt werden, OHNE GPU-VRAM?! 👈

    mehr auf Arint.info

    #AI #GGUF #LLM #MachineLearning #Qwen #Unsloth #arint_info

    https://x.com/TeksEdge/status/2092646162176291025

  6. 🧪 LLM Benchmark Showdown: 5 lokale Ollama-Modelle im Vergleich

    Getestet auf derselben Hardware (#gmktecevo2 #AMDRyzenAIMaxPlus395 #strixhalo):
    #GSM8K (100 Samples) — Math
    #BFCL (100/Kategorie) — Function Calling
    #MBPP+ (50) — Python Coding
    #HumanEval+ (20) — Python Coding

    📊 Ergebnisse (Accuracy / Output TK/s / VRAM):

    **qwen3.8:27b**
    GSM8K 82% | BFCL 91.5% | MBPP+ 100% | HE+ 100%
    ⚡ 25.5 TK/s | 💾 18 GB VRAM

    **qwen3.6:27b**
    GSM8K 83% | BFCL 93% | MBPP+ 98% | HE+ 75%
    ⚡ 12.7 TK/s | 💾 33 GB VRAM

    **qwen3.6:35b**
    GSM8K 84% | BFCL 90% | MBPP+ 98% | HE+ 55%
    ⚡ 61.8 TK/s | 💾 27 GB VRAM

    **ornith-1.5:35b**
    GSM8K 75% | BFCL 92.5% | MBPP+ 78% | HE+ 0%
    ⚡ 63.6 TK/s | 💾 26 GB VRAM

    **nemotron-3.5-lightning:30b**
    GSM8K 59% | BFCL 74% | MBPP+ 94% | HE+ 0%
    ⚡ 91.9 TK/s | 💾 26 GB VRAM

    🏆 Fazit:

    qwen3.8:27b ist der klare Sieger — als einziges Modell 100% bei beiden Coding-Benchmarks, bei GSM8K/BFCL gleichauf mit den anderen Qwen-Modellen. Bei 25.5 TK/s und nur 18 GB VRAM das beste Qualität/Speed/Effizienz-Verhältnis.

    qwen3.6:27b ist qualitativ nah dran (BFCL sogar 93%), aber mit 12.7 TK/s unerträglich langsam und frisst 33 GB VRAM — fast 2× so viel wie qwen3.8 bei halber Speed.

    qwen3.6:35b ist mit 61.8 TK/s 2.4× schneller als qwen3.8, aber HE+ nur 55% (vs 100%). Trading Code-Qualität für Speed.

    ornith-1.5:35b und nemotron-3.5-lightning:30b fallen bei Coding komplett durch (HE+ 0%), sind aber die schnellsten Modelle im Feld (64 / 92 TK/s).

    💡 TK/s = generierte Tokens/Sekunde (Warm-Run, ollama --verbose).
    💾 VRAM = GPU-Speicher bei max context (262K bzw. 1M bei nemotron).

    #LLM #Benchmark #Ollama #LocalAI #Qwen #OpenSource

  7. CW: AI

    Решил затестить Qwen3.8-27B-GGUF на своей 9060XT. Взял 3 бита XL вроде.

    Аухел, что оно смогло наклепать простенький лендинг и всё это чисто на моём железе, жест

    #qwen #qwen3

  8. [Перевод] Qwen3.8-27B: лучший локальный LLM, который вы, вероятно, не сможете запустить

    В этом месяце Alibaba выпустила две модели, и та, о которой все писали, оказалась не той, что мы ждали. Qwen3.8-Max — это API с 2,4 триллионами параметров, и пару недель назад я с большим энтузиазмом написал о ней обзор. Но релиз, которого я действительно ждал, вышел 14 августа: Qwen3.8-27B, Apache 2.0, веса на Hugging Face, модель достаточно компактна, чтобы работать на ноутбуке. Я должен кое в чем признаться. Я не провел полный тест этой модели. Я попробовал, на своем MacBook Air M4 получал около восьми токенов в секунду и потерял терпение где-то на втором запросе. По большей части этот пост посвящен именно моей неудаче, потому что я подозреваю, что у многих из вас вечер сложится так же, как у меня. Что представляет собой Qwen3.8-27B на самом деле 27,78 миллиарда параметров, плотная модель, включающая в себя визуальный энкодер, о котором никто не объявлял заранее. Принимает на вход текст, изображения и видео. Собственный контекст — 262 144 токена, с помощью YaRN можно увеличить его примерно до миллиона, если запускать модель на сервере. Архитектура — это по-настоящему интересная часть, и это не обычный трансформер. На протяжении 64 слоёв Qwen чередует 48 слоёв Gated DeltaNet (линейное внимание) с 16 полными слоями Gated Attention в соотношении 3:1. Только эти 16 слоёв с полным вниманием имеют KV-кэш. Таким образом, на каждый токен приходится около 64 КБ, что составляет примерно четверть от объёма памяти, необходимого для обычной 64-слойной модели с плотным кодированием. Если вы запомните только одно число из этого поста, пусть это будет именно оно. Всё, что касается того, поместится ли эта модель на вашем компьютере, зависит от объёма KV-кэша.

    habr.com/ru/articles/1072048/

    #qwen #llm #quantization #apple_silicon #lmstudio #ollama

  9. Der nächste DeepSeek-Moment läuft lokal auf dem PC. Qwen 3.8 27B erreicht im Intelligence Index mit 52 Punkten das Niveau von GPT-5.6 Luna. Im Agentic Index schlägt es sogar GPT-5.4. Und für die Forschung gibt es eine komplett unzensierte MLX-Version.

    #Qwen #OpenSourceAI #LocalAI #LLM #AIGeneratedImage

    all-ai.de/news/news26top/top-k

  10. Not a fan of Qwen 3.8 27B.

    Overthinks too much => wasted tokens.

    Has someone ran it without too much thinking? Does it perform well with that knob down, or letting it think all the way is required to be good?

    #AI #ArtificialIntelligence #LLM #Qwen #Qwen38 #Qwen3 #Ollama #LlamaCCP #vLLM #LargeLanguageModels #LocalAI

  11. 🎉 Oh great, the *latest* version of #Qwen is here, now with even more #overthinking per byte! 🤔💡 Just what we needed—an #AI that contemplates the #universe while you're simply trying to draft an #email. 🙄✨
    simonwillison.net/2026/Aug/16/ #Drafts #Contemplation #Technology #HackerNews #ngated

  12. 🎉 Oh great, the *latest* version of #Qwen is here, now with even more #overthinking per byte! 🤔💡 Just what we needed—an #AI that contemplates the #universe while you're simply trying to draft an #email. 🙄✨
    simonwillison.net/2026/Aug/16/ #Drafts #Contemplation #Technology #HackerNews #ngated

  13. 🎉 Oh great, the *latest* version of #Qwen is here, now with even more #overthinking per byte! 🤔💡 Just what we needed—an #AI that contemplates the #universe while you're simply trying to draft an #email. 🙄✨
    simonwillison.net/2026/Aug/16/ #Drafts #Contemplation #Technology #HackerNews #ngated

  14. 🎉 Oh great, the *latest* version of #Qwen is here, now with even more #overthinking per byte! 🤔💡 Just what we needed—an #AI that contemplates the #universe while you're simply trying to draft an #email. 🙄✨
    simonwillison.net/2026/Aug/16/ #Drafts #Contemplation #Technology #HackerNews #ngated

  15. 🎉 Oh great, the *latest* version of #Qwen is here, now with even more #overthinking per byte! 🤔💡 Just what we needed—an #AI that contemplates the #universe while you're simply trying to draft an #email. 🙄✨
    simonwillison.net/2026/Aug/16/ #Drafts #Contemplation #Technology #HackerNews #ngated

  16. #China turns up the heat with #openmodel blitz as #US model makers panic
    For first time, #Alibaba's #Qwen team is letting its 'Max' model out of API pen; meanwhile, #DeepSeek #V4Flash gives new meaning to cheap and cheerful competition
    Chinese model devs like #Moonshot, Alibaba, and DeepSeek are now attacking their American counterparts on both price and performance. Comes as US model devs like #Anthropic and #OpenAI stoke fears over origins and safety of China-made #AI.
    theregister.com/ai-and-ml/2026

  17. RT @ModelScope2022: Nur 3B aktive Parameter, dennoch State-of-the-Art-Performance beim agentic Coding in seiner Größenordnung. 🚀 KAT-Coder-V2.5-Dev, das neue 35B Open-Weight-MoE-Coding-Modell von @KwaiAICoder. 🤖 modelscope.ai/models/Kwaipilot 📄 modelscope.ai/papers/2607.05471 🏆 Führt jede berichtete Benchmark gleicher Skala an: 69,4 auf SWE-bench Verified, 63,0 auf Multilingual und 41,02 auf Terminal-Bench 2,1. ⚡ Native 256K-Kontext, Tool-Calling, Denk-/Nicht-Denk-Modi und optionale Speicherung der Reasoning-Historie. 🧠 Aufgebaut auf Qwen3.6-35B-A3B mit 127K SFT-Beispielen + RL. Abnormale Tool-Labels sanken von 9,34% auf 0,28%, während kontinuierliche Wiederholungen auf 0% fielen. 📄 Open-Weight und nur Text—ohne Vision-Komponenten. Apache 2.0.

    mehr auf Arint.info

    #CodingAI #KATCoder #MoEModel #OpenSource #Qwen #SWEbench #arint_info

    https://x.com/ModelScope2022/status/2082043389025857891#m

  18. RT @ModelScope2022: Nur 3B aktive Parameter, dennoch State-of-the-Art-Performance beim agentic Coding in seiner Größenordnung. 🚀 KAT-Coder-V2.5-Dev, das neue 35B Open-Weight-MoE-Coding-Modell von @KwaiAICoder. 🤖 modelscope.ai/models/Kwaipilot 📄 modelscope.ai/papers/2607.05471 🏆 Führt jede berichtete Benchmark gleicher Skala an: 69,4 auf SWE-bench Verified, 63,0 auf Multilingual und 41,02 auf Terminal-Bench 2,1. ⚡ Native 256K-Kontext, Tool-Calling, Denk-/Nicht-Denk-Modi und optionale Speicherung der Reasoning-Historie. 🧠 Aufgebaut auf Qwen3.6-35B-A3B mit 127K SFT-Beispielen + RL. Abnormale Tool-Labels sanken von 9,34% auf 0,28%, während kontinuierliche Wiederholungen auf 0% fielen. 📄 Open-Weight und nur Text—ohne Vision-Komponenten. Apache 2.0.

    mehr auf Arint.info

    #CodingAI #KATCoder #MoEModel #OpenSource #Qwen #SWEbench #arint_info

    https://x.com/ModelScope2022/status/2082043389025857891#m

  19. RT @ModelScope2022: Nur 3B aktive Parameter, dennoch State-of-the-Art-Performance beim agentic Coding in seiner Größenordnung. 🚀 KAT-Coder-V2.5-Dev, das neue 35B Open-Weight-MoE-Coding-Modell von @KwaiAICoder. 🤖 modelscope.ai/models/Kwaipilot 📄 modelscope.ai/papers/2607.05471 🏆 Führt jede berichtete Benchmark gleicher Skala an: 69,4 auf SWE-bench Verified, 63,0 auf Multilingual und 41,02 auf Terminal-Bench 2,1. ⚡ Native 256K-Kontext, Tool-Calling, Denk-/Nicht-Denk-Modi und optionale Speicherung der Reasoning-Historie. 🧠 Aufgebaut auf Qwen3.6-35B-A3B mit 127K SFT-Beispielen + RL. Abnormale Tool-Labels sanken von 9,34% auf 0,28%, während kontinuierliche Wiederholungen auf 0% fielen. 📄 Open-Weight und nur Text—ohne Vision-Komponenten. Apache 2.0.

    mehr auf Arint.info

    #CodingAI #KATCoder #MoEModel #OpenSource #Qwen #SWEbench #arint_info

    https://x.com/ModelScope2022/status/2082043389025857891#m

  20. 中等強國組「開源反抗軍」抗衡美中AI霸權,但這條路真的行得通嗎?
    TNL國際編譯 2026-07-13 18:58:00 CST
    一封美國政府的信,讓Anthropic旗艦AI模型全球下架18天。加拿大、歐盟、英國決心押注開源突圍,Mozilla稱這群國家為「開源反抗軍」。但這個聯盟真的組得起來?
    https://www.thenewslens.com/article/269151
    #開源反抗軍 #開源AI #Meta #加拿大 #歐盟 #阿里巴巴 #Europa #中國 #Qwen #Llama #德國 #中等強國 #Mozilla #美國 #Fable 5 #OpenEuroLLM #Anthropic #科技 #大型語言模型 #英國 #日本
  21. ИИ снова закрывается: почему нейросети оказались на грани блокировок

    ИИ снова закрывается. Пока мир следит за технологической войной чипов, Пекин и Вашингтон начали закрывать доступ к самому главному — готовым моделям. США уже убрали Claude Mythos из общего доступа, из-за рисков в кибербезопасности. Китай в свою очередь готовится заблокировать экспорт GLM, Qwen и DouBao. Добро пожаловать в эпоху «цифрового суверенитета», где нейросети официально признаны стратегическим оружием. Разбираемся, к чему приведет эта односторонняя прозрачность.

    habr.com/ru/companies/selectel

    #selectel #ai #llmмодели #alibaba #glm #qwen #DouBao #claude_mythos #claude #искусственный_интеллект

  22. Free AI Chat, locally in your browser. 💻
    - No signup required
    - 100% data privacy
    - No API keys 🔒

    Supported Models:
    #SmolLM2
    #Qwen
    #Llama
    #DeepSeek R1
    #Phi
    #TinyLlama
    • & More

    🔗 zalt.me/tools/free-ai-chat-onl

    #FreeAI #Free #LocalLLM #WebGPU #AI #WebLLM #ChatGPT #JS #opensource

  23. Почему маленькие модели побеждают большие – и что это значит для вашего стека

    Есть такое устойчивое интеллектуальное заблуждение: если модель больше — значит, она лучше. Больше параметров, больше обучающих данных, больше денег в предобучении — и вот вам SOTA. Гонка за размером казалась единственной игрой в городе. Но в 2025–2026 годах что‑то сломалось в этой логике. И сломалось публично, с цифрами и бенчмарками. Я хочу рассказать три истории, которые произошли практически одновременно и складываются в одну картину. Первая — про то, как Microsoft заткнула за пояс «самую опасную» языковую модель Anthropic с помощью ста специализированных агентов. Вторая — про MIT‑трюк, позволяющий маленькой GPT-5-mini обогнать полноразмерный GPT-5 вдвое на сложных задачах. Третья — про китайскую модель Qwen, которую сделала небольшая команда с ограниченными ресурсами, и которая сейчас работает в 200 000 продуктах по всему миру. В каждой истории маленький (или менее очевидный) игрок побеждает «большого». И каждый раз причина примерно одна и та же.

    habr.com/ru/articles/1043590/

    #llm #gpt5mini #qwen #claude_mythos #rlm #архитектура_иимоделей #ииоркестрация #rag

  24. Почему маленькие модели побеждают большие – и что это значит для вашего стека

    Есть такое устойчивое интеллектуальное заблуждение: если модель больше — значит, она лучше. Больше параметров, больше обучающих данных, больше денег в предобучении — и вот вам SOTA. Гонка за размером казалась единственной игрой в городе. Но в 2025–2026 годах что‑то сломалось в этой логике. И сломалось публично, с цифрами и бенчмарками. Я хочу рассказать три истории, которые произошли практически одновременно и складываются в одну картину. Первая — про то, как Microsoft заткнула за пояс «самую опасную» языковую модель Anthropic с помощью ста специализированных агентов. Вторая — про MIT‑трюк, позволяющий маленькой GPT-5-mini обогнать полноразмерный GPT-5 вдвое на сложных задачах. Третья — про китайскую модель Qwen, которую сделала небольшая команда с ограниченными ресурсами, и которая сейчас работает в 200 000 продуктах по всему миру. В каждой истории маленький (или менее очевидный) игрок побеждает «большого». И каждый раз причина примерно одна и та же.

    habr.com/ru/articles/1043590/

    #llm #gpt5mini #qwen #claude_mythos #rlm #архитектура_иимоделей #ииоркестрация #rag

  25. Почему маленькие модели побеждают большие – и что это значит для вашего стека

    Есть такое устойчивое интеллектуальное заблуждение: если модель больше — значит, она лучше. Больше параметров, больше обучающих данных, больше денег в предобучении — и вот вам SOTA. Гонка за размером казалась единственной игрой в городе. Но в 2025–2026 годах что‑то сломалось в этой логике. И сломалось публично, с цифрами и бенчмарками. Я хочу рассказать три истории, которые произошли практически одновременно и складываются в одну картину. Первая — про то, как Microsoft заткнула за пояс «самую опасную» языковую модель Anthropic с помощью ста специализированных агентов. Вторая — про MIT‑трюк, позволяющий маленькой GPT-5-mini обогнать полноразмерный GPT-5 вдвое на сложных задачах. Третья — про китайскую модель Qwen, которую сделала небольшая команда с ограниченными ресурсами, и которая сейчас работает в 200 000 продуктах по всему миру. В каждой истории маленький (или менее очевидный) игрок побеждает «большого». И каждый раз причина примерно одна и та же.

    habr.com/ru/articles/1043590/

    #llm #gpt5mini #qwen #claude_mythos #rlm #архитектура_иимоделей #ииоркестрация #rag

  26. **Chào các bạn!** 🌟 Tóm tắt tuần AI: Sâu và CPC. OpenAI phát ra công cụ tạo hình ảnh direkt, dễ van duyệt trongальфа (-deepfake!). Đồng thời đang tìm Head của Preparedness để kiểm tra rủi ro. China kêu kh/error với model Qwen, đẩy mạnh cạnh tranh multipolar. Vì sao? Hख đến "slop" -Ao content AIním.fill ouvrages. Tag: #AI #ChatGPT #Qwen #DataCenters #slop #Ethics #Tech #GlobalTech. Hãy cập nhật nhé! 🚀

    dev.to/ethan_zhang_e501fea89c2

  27. Negli ultimi giorni ho scritto un post lunghissimo, interessante (credo) e pallosissimo (immagino) sulla creatività, sulla finzione, su Pessoa e sui chatbot basati sulla cosiddetta intelligenza artificiale generativa.

    Vi consiglio di leggere almeno la prima parte e spulciare il resto.

    aitanblog.wordpress.com/2025/0

    #ai #ia #intelligenzaartificiale #aigen #poesia #poeti #fingitori #simulazione #linguaggionaturale #linguaggioartificiale #chatgpt #claude #deepseek #qwen #perplexity #grok #pessoa