home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. Qwen и Grok отгадывают советские загадки на внимательность

    Кто лучше справляется с советскими загадками на внимательность — Qwen, Grok или человек? Сравнили две классические головоломки и получили любопытные результаты.

    habr.com/ru/articles/1079530/

    #сравнение_моделей #qwen #grok #мультимодальные_модели #vlm #visionlanguage_models #галлюцинации_ии #искусственный_интеллект #нейросети

  2. KI-Modelle als Werkzeug für Angriffe auf Behörden und Bildungseinrichtungen in Asien

    Sprachmodelle übernehmen Koordinationsaufgaben, während die eigentliche Ausnutzung von Schwachstellen weiterhin auf klassischen Methoden beruht – öffentlich verfügbarem Exploit-Code, gestohlenen Zugangsdaten, Webshells und selbst entwickelter Schadsoftware.

    all-about-security.de/ki-model

    #hacker #deepseek #claude #qwen #kimodelle #kiagenten #itsicherheit #itsecurity #cybersecurity

  3. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  4. vucense.com/ai-intelligence/op

    Interesting read on #localAI, #localLLMs and educated guesswork on "Why Alibaba is giving #Qwen away for free.

    I like to see collaboration and mutual trust being what gets us as humanity forward. Not market-competition as main driver.

  5. «KI-Agenten führen git-Schadcode beim Starten automatisch aus:
    Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.»

    Hach ja, so klever ist wohl der KI Einsatz. Auch wenn ich die KI permanent kritisiere gibt es sehr wohl deren nutzen zB bei Prototype Code.

    🧑‍💻 heise.de/news/KI-Agenten-fuehr

    #ki #git #prototype #schadcode #claude #qwen #grok #repository #automatisch #coding

  6. Переводим книги нейронками для себя: год спустя. Словари, скорости и почему переводчики всё ещё нужны

    Год назад я написал статью « Переводим fb2 книжки, с нейронками, для себя » — про то, как собрал на паре Tesla P40 в гараже программу Sunny Narrator («Солнечный сказочник»), которая переводит художественные книги через локальные и облачные LLM. Тогда это был скорее прототип «доказать себе, что так можно»: черновики читались с головной болью, книга в тысячу страниц переводилась два дня, а электричество, отключённое посреди процесса, стоило ещё двух. За год программа доехала до версии 2.1, я перевёл достаточно книг, чтобы набить руку, и понял главное: это уже инструмент не только для меня, но и для переводчиков — и для всех любопытных . Рассказываю, что изменилось, сколько это стоит в токенах и почему без человека ничего не работает.

    habr.com/ru/articles/1077366/

    #перевод #переводы #fb2 #epub #llm #llmприложения #словари #tesla_p40 #qwen #gemma

  7. You have to be shitting me. Even #OpenCode Big Pickle fucks over Gemini 3.1 Pro.

    Welp, I'm not renewing that shit anymore, so it's time to find a cheap AI Agent around.

    Curently aiming for OpenCode. What are your recommendations under $20?

    #AI #AIAgents #VibeCoding #VibeCode #Programming #SoftwareDevelopment #WebDevelopment #WebDev #PHP #JavaScript #TypeScript #Python #Golang #Rust #ArtificialIntelligence #Codex #Claude #Copilot #Kimi #ZenAI #Perplexity #DeepSeek #MistralAI #Grok #Qwen

  8. 🖥️ Runs on 14 agent hosts: #ClaudeCode, #Cursor, #Codex, #Kimi Code CLI, #Cline, Grok Build CLI, #Devin, #GitHubCopilot, Factory Droid, #Qwen Code, #OpenCode, Pi, oh-my-pi and Antigravity CLI

    ⚙️ Install in Claude Code with /plugin marketplace add plus /plugin install, then run /ce-setup to create .compound-engineering/config.yaml and check tool capabilities

  9. Local LLM Arena #4

    Repair run już się zakończył i po kilku dodatkowych poprawkach udało się domknąć benchmark.

    Po drodze wyszło jeszcze kilka problemów technicznych, więc część testów trzeba było poprawić i uzupełnić. Ostatecznie mamy jednak kompletny zestaw wyników dla wszystkich 5 modeli.

    Najlepiej wypadły dwa modele.

    Qwen3.8-27B wygrał cały benchmark i osiągnął najwyższy wynik jakościowy.

    GPT-OSS-20B był bardzo blisko, a w testach kodowania uzyskał taki sam wynik jak Qwen. Jednocześnie na moim MacBooku Air M4 16 GB działa około 5 razy szybciej.

    Dlatego teraz testuję właśnie GPT-OSS jako lokalnego agenta do prawdziwego kodowania.

    Schemat wygląda tak:

    Codex CLI

    LM Studio

    GPT-OSS-20B

    repozytorium projektu

    Model dostał 5 rzeczywistych zadań w kodzie Local LLM Arena.

    Może sam przeglądać repozytorium, edytować pliki, uruchamiać testy, analizować błędy i poprawiać własne rozwiązania.

    Każde zadanie zaczyna od czystej kopii repozytorium. Po zakończeniu rozwiązanie jest sprawdzane także dodatkowymi testami, których model wcześniej nie widział. Jeśli coś nie przejdzie, dostaje informację o błędzie i może spróbować się poprawić.

    Maksymalnie trzy podejścia na zadanie.

    Całość działa lokalnie na Macu.

    Teraz chcę sprawdzić nie tylko, czy model potrafi wygenerować poprawny kod, ale czy rzeczywiście może wykonywać część pracy lokalnego agenta programistycznego i odciążyć modele działające w chmurze.

    Test właśnie trwa.

    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #Codex #GPTOSS #Qwen #Coding #OpenSourceAI

  10. I configured OpenCode manually with Unsloth Local AI to run Qwen3.8-Flash-Next-GGUF with custom reasoning effort, memory optimization via mmap, and local API access. Not impressed with `unsloth start opencode` command. Hence:

    nayab.dev/ai/tools/opencode-wi

    #LocalAI #Ubuntu #Unsloth #Qwen

  11. Какая LLM поможет вам заработать в 2026/27 году

    Сегодня у айтишников появилось новое хобби - делать свой SaaS или писать торговых ботов с помощью LLM Порог входа резко снизился: достаточно хорошей идеи, немного свободного времени и подписки на одну из современных LLM Но есть одна проблема Модель, которая набирает 90%+ в бенчмарке, совсем не обязательно поможет вам заработать деньги Потому что между «написать хороший код» и создать работающий продукт есть огромная разница Я дал шести LLM одну задачу - написать торгового бота и проверил, что из этого можно использовать на практике GPT, Claude Opus, DeepSeek, Qwen, GigaChat, YandexGPT Pro

    habr.com/ru/articles/1070596/

    #ai #algorithm #algotrading #bigdata #process #gpt #claude #gemini #qwen #deepseek

  12. KV cache streaming - the llama.cpp fork that enables Qwen 3.8 27B at large contexts for 16GB VRAM GPU owners

    video.troed.se/w/x2AxNGkvy21Gb

  13. RE: mastodon.social/@nayab/1171779

    Late to the party — this is what Qwen3.8-27B (Q8) generated in Unsloth with extra-high thinking on my system with DDR5 RAM. Yes, that was a bad idea: it took two and a half hours .

    It added animation and extra items (boat, light house, birds) to the SVG, but overall vector image quality and details are lower than what Qwen3.8-Flash-Next produced.

    #Unsloth #LocalAI #Qwen

  14. Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090

    Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по 24 ГБ и 936 ГБ/с каждая не должны выдавать столько, сколько выдаёт одна. Значит, где-то узкое горлышко — и надо разобраться, что и где подкрутить. Горлышек оказалось несколько, и все снимаются флагами запуска: те же веса — 75 токенов в секунду. Под катом каждый флаг описан по одной схеме: зачем, что писать, что даёт в цифрах, где ломается и с какой строкой в логе. В конце — готовый docker run , три проверки после каждой смены флага и список того, что не сработало. Текст можно отдать целиком агенту с доступом к серверу — это инструкция, а не история.

    habr.com/ru/articles/1076080/

    #llm #ai #llamacpp #qwen #qwen38 #gguf #квантование #локальные_нейросети #локальные_модели

  15. I'm very impressed with #Qwen 3.8 on an ancient #nvidia Quadro RTX 8000 (Turing generation!). The normal 8 bit quant works really well...not frontier model level of course, but fast enough and good enough for a bunch stuff. Significantly better than 3.5 was.

  16. Testing #localLLM for #DLTP on my #longterm #preservation #object identifier schema of "CFIDs":

    Collision Friendly IDentifiers.

    A mere 30 MB list of auto-generated CFIDs was enough for #qwen to tell you this much about the test collection!!! 🤯 🤩 - this is powerful. Be careful.

    AND: My IDs work! so beautiful! #ahalodeck

    github.com/ArkThis/AHAlodeck/b

  17. Der nächste DeepSeek-Moment läuft lokal auf dem PC. Qwen 3.8 27B erreicht im Intelligence Index mit 52 Punkten das Niveau von GPT-5.6 Luna. Im Agentic Index schlägt es sogar GPT-5.4. Und für die Forschung gibt es eine komplett unzensierte MLX-Version.

    #Qwen #OpenSourceAI #LocalAI #LLM #AIGeneratedImage

    all-ai.de/news/news26top/top-k

  18. Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5) Я решил прове...

    #ollama #amd #vulkan #fedora #deepseek-r1 #llama #3.1 #qwen #3.5 #n8n #podman

    Origin | Interest | Match
  19. Какого китайца выбрать? DeepSeek vs Qwen vs Baidu

    Китайские нейросети вышли на арену: DeepSeek , Qwen и Baidu ERNIE стремительно догоняют западные аналоги. Я протестировал их лично — на коде, логике и креативе. Где тупят? Кто реально выдаёт GPT‑4‑уровень? В статье — примеры, таблицы, фейлы и вывод: что выбрать в 2025 году , если тебе важны мощность, стабильность и интерфейс без иероглифов.

    habr.com/ru/articles/933656/

    #Искусственный_интеллект #искусственный_интеллект_чатбот #большие_языковые_модели #llm #qwen #deepseek #baidu #deepseekr1 #qwen3