home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. KI-Modelle als Werkzeug für Angriffe auf Behörden und Bildungseinrichtungen in Asien

    Sprachmodelle übernehmen Koordinationsaufgaben, während die eigentliche Ausnutzung von Schwachstellen weiterhin auf klassischen Methoden beruht – öffentlich verfügbarem Exploit-Code, gestohlenen Zugangsdaten, Webshells und selbst entwickelter Schadsoftware.

    all-about-security.de/ki-model

    #hacker #deepseek #claude #qwen #kimodelle #kiagenten #itsicherheit #itsecurity #cybersecurity

  2. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  3. vucense.com/ai-intelligence/op

    Interesting read on #localAI, #localLLMs and educated guesswork on "Why Alibaba is giving #Qwen away for free.

    I like to see collaboration and mutual trust being what gets us as humanity forward. Not market-competition as main driver.

  4. «KI-Agenten führen git-Schadcode beim Starten automatisch aus:
    Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.»

    Hach ja, so klever ist wohl der KI Einsatz. Auch wenn ich die KI permanent kritisiere gibt es sehr wohl deren nutzen zB bei Prototype Code.

    🧑‍💻 heise.de/news/KI-Agenten-fuehr

    #ki #git #prototype #schadcode #claude #qwen #grok #repository #automatisch #coding

  5. Переводим книги нейронками для себя: год спустя. Словари, скорости и почему переводчики всё ещё нужны

    Год назад я написал статью « Переводим fb2 книжки, с нейронками, для себя » — про то, как собрал на паре Tesla P40 в гараже программу Sunny Narrator («Солнечный сказочник»), которая переводит художественные книги через локальные и облачные LLM. Тогда это был скорее прототип «доказать себе, что так можно»: черновики читались с головной болью, книга в тысячу страниц переводилась два дня, а электричество, отключённое посреди процесса, стоило ещё двух. За год программа доехала до версии 2.1, я перевёл достаточно книг, чтобы набить руку, и понял главное: это уже инструмент не только для меня, но и для переводчиков — и для всех любопытных . Рассказываю, что изменилось, сколько это стоит в токенах и почему без человека ничего не работает.

    habr.com/ru/articles/1077366/

    #перевод #переводы #fb2 #epub #llm #llmприложения #словари #tesla_p40 #qwen #gemma

  6. You have to be shitting me. Even #OpenCode Big Pickle fucks over Gemini 3.1 Pro.

    Welp, I'm not renewing that shit anymore, so it's time to find a cheap AI Agent around.

    Curently aiming for OpenCode. What are your recommendations under $20?

    #AI #AIAgents #VibeCoding #VibeCode #Programming #SoftwareDevelopment #WebDevelopment #WebDev #PHP #JavaScript #TypeScript #Python #Golang #Rust #ArtificialIntelligence #Codex #Claude #Copilot #Kimi #ZenAI #Perplexity #DeepSeek #MistralAI #Grok #Qwen

  7. 🖥️ Runs on 14 agent hosts: #ClaudeCode, #Cursor, #Codex, #Kimi Code CLI, #Cline, Grok Build CLI, #Devin, #GitHubCopilot, Factory Droid, #Qwen Code, #OpenCode, Pi, oh-my-pi and Antigravity CLI

    ⚙️ Install in Claude Code with /plugin marketplace add plus /plugin install, then run /ce-setup to create .compound-engineering/config.yaml and check tool capabilities

  8. Local LLM Arena #4

    Repair run już się zakończył i po kilku dodatkowych poprawkach udało się domknąć benchmark.

    Po drodze wyszło jeszcze kilka problemów technicznych, więc część testów trzeba było poprawić i uzupełnić. Ostatecznie mamy jednak kompletny zestaw wyników dla wszystkich 5 modeli.

    Najlepiej wypadły dwa modele.

    Qwen3.8-27B wygrał cały benchmark i osiągnął najwyższy wynik jakościowy.

    GPT-OSS-20B był bardzo blisko, a w testach kodowania uzyskał taki sam wynik jak Qwen. Jednocześnie na moim MacBooku Air M4 16 GB działa około 5 razy szybciej.

    Dlatego teraz testuję właśnie GPT-OSS jako lokalnego agenta do prawdziwego kodowania.

    Schemat wygląda tak:

    Codex CLI

    LM Studio

    GPT-OSS-20B

    repozytorium projektu

    Model dostał 5 rzeczywistych zadań w kodzie Local LLM Arena.

    Może sam przeglądać repozytorium, edytować pliki, uruchamiać testy, analizować błędy i poprawiać własne rozwiązania.

    Każde zadanie zaczyna od czystej kopii repozytorium. Po zakończeniu rozwiązanie jest sprawdzane także dodatkowymi testami, których model wcześniej nie widział. Jeśli coś nie przejdzie, dostaje informację o błędzie i może spróbować się poprawić.

    Maksymalnie trzy podejścia na zadanie.

    Całość działa lokalnie na Macu.

    Teraz chcę sprawdzić nie tylko, czy model potrafi wygenerować poprawny kod, ale czy rzeczywiście może wykonywać część pracy lokalnego agenta programistycznego i odciążyć modele działające w chmurze.

    Test właśnie trwa.

    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #Codex #GPTOSS #Qwen #Coding #OpenSourceAI

  9. I configured OpenCode manually with Unsloth Local AI to run Qwen3.8-Flash-Next-GGUF with custom reasoning effort, memory optimization via mmap, and local API access. Not impressed with `unsloth start opencode` command. Hence:

    nayab.dev/ai/tools/opencode-wi

    #LocalAI #Ubuntu #Unsloth #Qwen

  10. Какая LLM поможет вам заработать в 2026/27 году

    Сегодня у айтишников появилось новое хобби - делать свой SaaS или писать торговых ботов с помощью LLM Порог входа резко снизился: достаточно хорошей идеи, немного свободного времени и подписки на одну из современных LLM Но есть одна проблема Модель, которая набирает 90%+ в бенчмарке, совсем не обязательно поможет вам заработать деньги Потому что между «написать хороший код» и создать работающий продукт есть огромная разница Я дал шести LLM одну задачу - написать торгового бота и проверил, что из этого можно использовать на практике GPT, Claude Opus, DeepSeek, Qwen, GigaChat, YandexGPT Pro

    habr.com/ru/articles/1070596/

    #ai #algorithm #algotrading #bigdata #process #gpt #claude #gemini #qwen #deepseek

  11. KV cache streaming - the llama.cpp fork that enables Qwen 3.8 27B at large contexts for 16GB VRAM GPU owners

    video.troed.se/w/x2AxNGkvy21Gb

  12. RE: mastodon.social/@nayab/1171779

    Late to the party — this is what Qwen3.8-27B (Q8) generated in Unsloth with extra-high thinking on my system with DDR5 RAM. Yes, that was a bad idea: it took two and a half hours .

    It added animation and extra items (boat, light house, birds) to the SVG, but overall vector image quality and details are lower than what Qwen3.8-Flash-Next produced.

    #Unsloth #LocalAI #Qwen

  13. Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090

    Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по 24 ГБ и 936 ГБ/с каждая не должны выдавать столько, сколько выдаёт одна. Значит, где-то узкое горлышко — и надо разобраться, что и где подкрутить. Горлышек оказалось несколько, и все снимаются флагами запуска: те же веса — 75 токенов в секунду. Под катом каждый флаг описан по одной схеме: зачем, что писать, что даёт в цифрах, где ломается и с какой строкой в логе. В конце — готовый docker run , три проверки после каждой смены флага и список того, что не сработало. Текст можно отдать целиком агенту с доступом к серверу — это инструкция, а не история.

    habr.com/ru/articles/1076080/

    #llm #ai #llamacpp #qwen #qwen38 #gguf #квантование #локальные_нейросети #локальные_модели

  14. I'm very impressed with #Qwen 3.8 on an ancient #nvidia Quadro RTX 8000 (Turing generation!). The normal 8 bit quant works really well...not frontier model level of course, but fast enough and good enough for a bunch stuff. Significantly better than 3.5 was.

  15. Конец жирной маржинальности ИИ: всё о ценообразовании и дешёвых стоимостях моделей

    В последнее время ИИ-сфера не просто падает, а даже входит в активную стадию конкурентности между несколькими фронтами — корпоративные ИИ (OpenAI и Anthropic, которые тоже между собой соревнуются) против открытых моделей (Qwen, GLM, DeepSeek). Цены за токен иногда падают, а когда не могут уменьшить цену — создают лёгкие модели с низкой стоимостью. Снижение стоимости вывода (инференс) перестало быть просто побочным эффектом оптимизации и превратилось в главную ось конкуренции. Решение OpenAI снизить цены на GPT 5.6 Sol минимум до ноября 2026 года — это попытка восстановить свою долю на рынке через демпинг. Открытые модели больше не догоняют закрытые по качеству, а даже иногда опережают их в экономике использования, делая доступ к ИИ коммунальной услугой. В этой статье мы разберём влияние Qwen, GLM и прочих опенсорсных моделей, конкуренцию на рынке ИИ и наконец разберём, куда свернула ИИ-гонка на этот раз.

    habr.com/ru/companies/bothub/a

    #qwen #zai #glm #ox_alpha #chatgpt #nvidia #deepseek #npu #hugging_face

  16. RT @TeksEdge: 🤯 Einfach nur erstaunlich. Das Qwen-Team denkt voraus! … ein 177B-Qwen-Modell kann jetzt lokal mit CPU-RAM ausgeführt werden, OHNE GPU-VRAM?! 👈

    mehr auf Arint.info

    #AI #GGUF #LLM #MachineLearning #Qwen #Unsloth #arint_info

    https://x.com/TeksEdge/status/2092646162176291025

  17. So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.

    Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.

    Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark

  18. So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.

    Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.

    Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark

  19. So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.

    Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.

    Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark

  20. So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.

    Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.

    Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark

  21. So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.

    Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.

    Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark

  22. [Перевод] Qwen3.8-27B: лучший локальный LLM, который вы, вероятно, не сможете запустить

    В этом месяце Alibaba выпустила две модели, и та, о которой все писали, оказалась не той, что мы ждали. Qwen3.8-Max — это API с 2,4 триллионами параметров, и пару недель назад я с большим энтузиазмом написал о ней обзор. Но релиз, которого я действительно ждал, вышел 14 августа: Qwen3.8-27B, Apache 2.0, веса на Hugging Face, модель достаточно компактна, чтобы работать на ноутбуке. Я должен кое в чем признаться. Я не провел полный тест этой модели. Я попробовал, на своем MacBook Air M4 получал около восьми токенов в секунду и потерял терпение где-то на втором запросе. По большей части этот пост посвящен именно моей неудаче, потому что я подозреваю, что у многих из вас вечер сложится так же, как у меня. Что представляет собой Qwen3.8-27B на самом деле 27,78 миллиарда параметров, плотная модель, включающая в себя визуальный энкодер, о котором никто не объявлял заранее. Принимает на вход текст, изображения и видео. Собственный контекст — 262 144 токена, с помощью YaRN можно увеличить его примерно до миллиона, если запускать модель на сервере. Архитектура — это по-настоящему интересная часть, и это не обычный трансформер. На протяжении 64 слоёв Qwen чередует 48 слоёв Gated DeltaNet (линейное внимание) с 16 полными слоями Gated Attention в соотношении 3:1. Только эти 16 слоёв с полным вниманием имеют KV-кэш. Таким образом, на каждый токен приходится около 64 КБ, что составляет примерно четверть от объёма памяти, необходимого для обычной 64-слойной модели с плотным кодированием. Если вы запомните только одно число из этого поста, пусть это будет именно оно. Всё, что касается того, поместится ли эта модель на вашем компьютере, зависит от объёма KV-кэша.

    habr.com/ru/articles/1072048/

    #qwen #llm #quantization #apple_silicon #lmstudio #ollama

  23. New week, new slides: Run LLMs Locally

    Added OpenAI's Privacy-Filter model using privacy-filter.cpp.
    New slides about economics and hardware used by the Hugging Face community.

    github.com/thomas-0816/talks/b

    #ai #llm #llamacpp #wllama #stablediffusion #qwen #localai #gemma4 #webgpu #opencode #huggingface #privacy #digitalsovereignty

  24. نماذج ذكاء اصطناعي حرة مفتوحة المصدر: دليل شامل لأبرز النماذج المتاحة في 2026

    استعراض شامل لأبرز نماذج الذكاء الاصطناعي مفتوحة المصدر والمفتوحة الوزن في 2026، مع توضيح الفرق بين الترخيصين، وقائمة بأقوى النماذج في البرمجة والاستدلال والاستخدام المحلي، وطرق تشغيلها على أجهزتك ...

    🔗 https://salehgnutux.github.io/GT-NEWSTECH/ar/ai/open-source-llms-guide-2026/

    #LLM #مفتوح_المصدر #ذكاء_اصطناعي #DeepSeek #Qwen #Llama #Gemma #Mistral #Apache_2_0 #MIT #gnutux
  25. Ваша LLM галлюцинирует? Наденьте на неё экзоскелет — и заставьте работать по правилам Ваша LLM галлюцинирует? ...

    #LLM #галлюцинации #ИИ #prompt #engineering #prompt #injection #DeepSeek #Qwen #Gemini #эпистемическая

    Origin | Interest | Match
  26. 🦁📨 LöwenPost 43 - Sino Kolumne: Qwen AI ~ Great Wall Motor ~ Volkskongress
    0cn.de/LoPo43

    #china #qwen #ai #ki #gwm #volkskongress

  27. От промтов к агентам: как мы дошли до трансформеров, что LLM умеют уже сейчас и что нас ждёт в 2027 году

    Привет! Меня зовут Александр Фролов, я data scientist отдела машинного обучения в Нетологии. В этой статье я коротко расскажу, откуда взялись LLM, чем они стали сегодня, куда всё идёт и где в этом хаосе найти точку опоры. Постараюсь обойтись без лишней теории и академического занудства — просто обзор по верхам с точки зрения дата-сайентиста, который строит пайплайны по обработке данных.

    habr.com/ru/companies/netology

    #большие_языковые_модели #llm #chatgpt #qwen #deepseek #reasoning #TAU_benchmark #chatbot_arena #LLMагенты #AIсотрудники

  28. Comparing #meta #llama 4 (maverick / scout) vs #qwen 32b for decompilation purposes #r2ai #reverseengineering
    PD: groq is the best place to try all these models if you don't have the hardware
    PD: qwen-qwq reasoning takes more time, but improves the output, much better than openai/claude/meta for decompilation usecases

  29. Топ-9 бесплатных китайских нейросетей в 2025 году

    Tencent, Alibaba, DeepSeek AI, Kuaishou — эти компании выпускают модели одну за другой, заставляя западных конкурентов почесать головы. Китайские ИИ‑продукты сегодня покрывают всё: от создания объёмных научных статей до генерации мемных видеороликов, которые легко взорвут соцсети. Эти технологии уже привлекли внимание профессионалов, но их потенциал доступен и обычным пользователям. Куда бежать, если вам срочно нужно оживить персонажа, создать фотосессию из одного‑единственного портрета или сделать прикольную гифку для поздравления? Hunyuan‑T1 с гибридным трансформером, Qwen-2.5 с миллионным контекстным окном, Talkie, который обошёл по популярности Character.ai, и Kling, монтирующий видео из нескольких картинок, — обо всём этом в статье!

    habr.com/ru/companies/bothub/a

    #ии #hunyuan #deepseek #qwen #hailuo #stepvideot2v #pixverse #kling #talkie #seaart

  30. #TechNews: #Qwen Releases New #VisionLanguage #LLM Qwen2-VL 🖥️👁️

    After a year of development, #Qwen has released Qwen2-VL, its latest #AI system for interpreting visual and textual information. 🚀

    Key Features of Qwen2-VL:

    1. 🖼️ Image Understanding:

    Qwen2-VL shows performance on #VisualUnderstanding benchmarks including #MathVista, #DocVQA, #RealWorldQA, and #MTVQA.

    2. 🎬 Video Analysis:

    Qwen2-VL can analyze videos over 20 minutes in length. This is achieved through online streaming capabilities, allowing for video-based #QuestionAnswering, #Dialog, and #ContentCreation. #VideoAnalysis

    3. 🤖 Device Integration:

    The #AI can be integrated with #mobile phones, #robots, and other devices. It uses reasoning and decision-making abilities to interpret visual environments and text instructions for device control. #AIAssistants 📱

    4. 🌍 Multilingual Capabilities:

    Qwen2-VL understands text in images across multiple languages. It supports most European languages, Japanese, Korean, Arabic, Vietnamese, among others, in addition to English and Chinese. #MultilingualAI

    This release represents an advancement in #ArtificialIntelligence, combining visual perception and language understanding. 🧠 Potential applications include #education, #healthcare, #robotics, and #contentmoderation.

    github.com/QwenLM/Qwen2-VL