home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. KI-Modelle als Werkzeug für Angriffe auf Behörden und Bildungseinrichtungen in Asien

    Sprachmodelle übernehmen Koordinationsaufgaben, während die eigentliche Ausnutzung von Schwachstellen weiterhin auf klassischen Methoden beruht – öffentlich verfügbarem Exploit-Code, gestohlenen Zugangsdaten, Webshells und selbst entwickelter Schadsoftware.

    all-about-security.de/ki-model

    #hacker #deepseek #claude #qwen #kimodelle #kiagenten #itsicherheit #itsecurity #cybersecurity

  2. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  3. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  4. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  5. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  6. The author exhaustively analyzes the Qwen 3.8:27B model at different levels of quantization to see at what point accuracy drops below a minimal threshold.

    #AI #LLM #Qwen #localai #localllm

    kaitchup.substack.com/p/qwen38

  7. Local LLM Arena #4

    Repair run już się zakończył i po kilku dodatkowych poprawkach udało się domknąć benchmark.

    Po drodze wyszło jeszcze kilka problemów technicznych, więc część testów trzeba było poprawić i uzupełnić. Ostatecznie mamy jednak kompletny zestaw wyników dla wszystkich 5 modeli.

    Najlepiej wypadły dwa modele.

    Qwen3.8-27B wygrał cały benchmark i osiągnął najwyższy wynik jakościowy.

    GPT-OSS-20B był bardzo blisko, a w testach kodowania uzyskał taki sam wynik jak Qwen. Jednocześnie na moim MacBooku Air M4 16 GB działa około 5 razy szybciej.

    Dlatego teraz testuję właśnie GPT-OSS jako lokalnego agenta do prawdziwego kodowania.

    Schemat wygląda tak:

    Codex CLI

    LM Studio

    GPT-OSS-20B

    repozytorium projektu

    Model dostał 5 rzeczywistych zadań w kodzie Local LLM Arena.

    Może sam przeglądać repozytorium, edytować pliki, uruchamiać testy, analizować błędy i poprawiać własne rozwiązania.

    Każde zadanie zaczyna od czystej kopii repozytorium. Po zakończeniu rozwiązanie jest sprawdzane także dodatkowymi testami, których model wcześniej nie widział. Jeśli coś nie przejdzie, dostaje informację o błędzie i może spróbować się poprawić.

    Maksymalnie trzy podejścia na zadanie.

    Całość działa lokalnie na Macu.

    Teraz chcę sprawdzić nie tylko, czy model potrafi wygenerować poprawny kod, ale czy rzeczywiście może wykonywać część pracy lokalnego agenta programistycznego i odciążyć modele działające w chmurze.

    Test właśnie trwa.

    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #Codex #GPTOSS #Qwen #Coding #OpenSourceAI

  8. KV cache streaming - the llama.cpp fork that enables Qwen 3.8 27B at large contexts for 16GB VRAM GPU owners

    video.troed.se/w/x2AxNGkvy21Gb

  9. Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090

    Плотная 27-миллиардная модель на двух RTX 3090 в llama.cpp из коробки даёт 32 токена в секунду. Интуитивно понятно, что это не предел: две карты по 24 ГБ и 936 ГБ/с каждая не должны выдавать столько, сколько выдаёт одна. Значит, где-то узкое горлышко — и надо разобраться, что и где подкрутить. Горлышек оказалось несколько, и все снимаются флагами запуска: те же веса — 75 токенов в секунду. Под катом каждый флаг описан по одной схеме: зачем, что писать, что даёт в цифрах, где ломается и с какой строкой в логе. В конце — готовый docker run , три проверки после каждой смены флага и список того, что не сработало. Текст можно отдать целиком агенту с доступом к серверу — это инструкция, а не история.

    habr.com/ru/articles/1076080/

    #llm #ai #llamacpp #qwen #qwen38 #gguf #квантование #локальные_нейросети #локальные_модели

  10. I'm using Text-To-Speech (TTS) on my Desktop (Calender Events, Firefox Read Aloud) and with Home Assistant. However the quality isn't the best and I wanted a better option.

    I've started a new project for this called crane-wyoming which is in alpha/beta stage as it is not feature complete but works well for TTS.

    codeberg.org/cryptomilk/crane-

    #homeassistant #speech #speechd #speechdispatcher #tts #inference #llm #voice #asr #qwen #voxtral #ai #rust

  11. I'm using Text-To-Speech (TTS) on my Desktop (Calender Events, Firefox Read Aloud) and with Home Assistant. However the quality isn't the best and I wanted a better option.

    I've started a new project for this called crane-wyoming which is in alpha/beta stage as it is not feature complete but works well for TTS.

    codeberg.org/cryptomilk/crane-

    #homeassistant #speech #speechd #speechdispatcher #tts #inference #llm #voice #asr #qwen #voxtral #ai #rust

  12. I'm using Text-To-Speech (TTS) on my Desktop (Calender Events, Firefox Read Aloud) and with Home Assistant. However the quality isn't the best and I wanted a better option.

    I've started a new project for this called crane-wyoming which is in alpha/beta stage as it is not feature complete but works well for TTS.

    codeberg.org/cryptomilk/crane-

    #homeassistant #speech #speechd #speechdispatcher #tts #inference #llm #voice #asr #qwen #voxtral #ai #rust

  13. I'm using Text-To-Speech (TTS) on my Desktop (Calender Events, Firefox Read Aloud) and with Home Assistant. However the quality isn't the best and I wanted a better option.

    I've started a new project for this called crane-wyoming which is in alpha/beta stage as it is not feature complete but works well for TTS.

    codeberg.org/cryptomilk/crane-

    #homeassistant #speech #speechd #speechdispatcher #tts #inference #llm #voice #asr #qwen #voxtral #ai #rust

  14. I'm using Text-To-Speech (TTS) on my Desktop (Calender Events, Firefox Read Aloud) and with Home Assistant. However the quality isn't the best and I wanted a better option.

    I've started a new project for this called crane-wyoming which is in alpha/beta stage as it is not feature complete but works well for TTS.

    codeberg.org/cryptomilk/crane-

    #homeassistant #speech #speechd #speechdispatcher #tts #inference #llm #voice #asr #qwen #voxtral #ai #rust

  15. Ah, the tech world's latest shiny object: Version 3.8 of "Qwen"—because the world clearly needed another half-baked AI upgrade to distract us from reality. 🙄 After all, who doesn't want their software updates to sound like a failed attempt at naming a pet hamster? 🐹✨
    qwen.ai/home #Qwen #AIupgrade #techtrends #softwarehumor #distraction #HackerNews #ngated

  16. New week, new slides: Run LLMs Locally

    Added OpenAI's Privacy-Filter model using privacy-filter.cpp.
    New slides about economics and hardware used by the Hugging Face community.

    github.com/thomas-0816/talks/b

    #ai #llm #llamacpp #wllama #stablediffusion #qwen #localai #gemma4 #webgpu #opencode #huggingface #privacy #digitalsovereignty

  17. Идеальный склероз в сером ящике — мой опыт в ИИ-программировании

    ИИ все прочнее входит в работу программиста. Кто-то все еще отрицает его роль, кто-то с энтузиазмом пробует все новые возможности, но квалифицированное большинство все же трезво замечает, что ИИ пока не годится для сложных проектов, хотя простые задачи уже выполняет неплохо. Расскажу, как я сделал свой первый шаг к большому проекту на ИИ. Он в значительной степени изобретён с нуля, а не скопирован. Нейросети пока не могут работать с большими проектами. Даже лучшие их образцы начинают тупить, если кода больше 40-100 кб, и галлюцинировать после 10-60 итераций одного и того же проекта (1000 циклов - это пока что грубый маркетинг). Шестьдесят итераций - это много? Если речь об автономной ИИ-разработке, то очень мало. Если о man-in-the-loop, то более-менее уже потянет. Я выбрал такие условия:

    habr.com/ru/articles/1044384/

    #llm #aicoding #архитектура #qwen #gemma #гранулярность #опыт

  18. Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5) Я решил прове...

    #ollama #amd #vulkan #fedora #deepseek-r1 #llama #3.1 #qwen #3.5 #n8n #podman

    Origin | Interest | Match
  19. 攻 AI 雲市占,阿里 / 字節跳動擬春節期間推新模型搶市 綜合港媒及中媒報導,中國科技巨頭字節跳動(ByteDance)與阿里巴巴集團正準備在即將到來的...

    #AI #人工智慧 #中國觀察 #DeepSeek #Qwen #字節跳動 #豆包 #阿里巴巴 #騰訊

    Origin | Interest | Match
  20. Какая LLM лучше распознает чертежи? Мы сравнили 6 LLM и узнали ответ

    Инженерные чертежи содержат десятки типов размеров и допусков: линейные и угловые, радиальные и диаметральные, справочные и базовые, а также геометрические характеристики вроде плоскостности или перпендикулярности. Для инженера это привычный язык, но для автоматической обработки такие документы представляют серьёзную задачу. С появлением мультимодальных LLM возник вопрос: способны ли они заменить классические OCR-решения и специализированные пайплайны постобработки? Насколько хорошо современные модели справляются с извлечением размеров и допусков из коробки, без дообучения? Какие модели дают максимальную точность, какие быстрее, а какие дешевле? И можно ли комбинировать разные подходы, чтобы повысить результат? Чтобы ответить на эти вопросы, мы протестировали шесть актуальных vision-LLM на одном наборе реальных механических чертежей и сравнили их точность, скорость и стоимость обработки.

    habr.com/ru/articles/946080/

    #llmмодели #chatgpt4 #chatgpt5 #claudeopus4 #gemini_flash #gemini_pro #qwen #языковые_модели #чертежи #обработка_изображений

  21. Какого китайца выбрать? DeepSeek vs Qwen vs Baidu

    Китайские нейросети вышли на арену: DeepSeek , Qwen и Baidu ERNIE стремительно догоняют западные аналоги. Я протестировал их лично — на коде, логике и креативе. Где тупят? Кто реально выдаёт GPT‑4‑уровень? В статье — примеры, таблицы, фейлы и вывод: что выбрать в 2025 году , если тебе важны мощность, стабильность и интерфейс без иероглифов.

    habr.com/ru/articles/933656/

    #Искусственный_интеллект #искусственный_интеллект_чатбот #большие_языковые_модели #llm #qwen #deepseek #baidu #deepseekr1 #qwen3

  22. Negli ultimi giorni ho scritto un post lunghissimo, interessante (credo) e pallosissimo (immagino) sulla creatività, sulla finzione, su Pessoa e sui chatbot basati sulla cosiddetta intelligenza artificiale generativa.

    Vi consiglio di leggere almeno la prima parte e spulciare il resto.

    aitanblog.wordpress.com/2025/0

    #ai #ia #intelligenzaartificiale #aigen #poesia #poeti #fingitori #simulazione #linguaggionaturale #linguaggioartificiale #chatgpt #claude #deepseek #qwen #perplexity #grok #pessoa