home.social

#qwen — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.

  1. KI-Modelle als Werkzeug für Angriffe auf Behörden und Bildungseinrichtungen in Asien

    Sprachmodelle übernehmen Koordinationsaufgaben, während die eigentliche Ausnutzung von Schwachstellen weiterhin auf klassischen Methoden beruht – öffentlich verfügbarem Exploit-Code, gestohlenen Zugangsdaten, Webshells und selbst entwickelter Schadsoftware.

    all-about-security.de/ki-model

    #hacker #deepseek #claude #qwen #kimodelle #kiagenten #itsicherheit #itsecurity #cybersecurity

  2. vucense.com/ai-intelligence/op

    Interesting read on #localAI, #localLLMs and educated guesswork on "Why Alibaba is giving #Qwen away for free.

    I like to see collaboration and mutual trust being what gets us as humanity forward. Not market-competition as main driver.

  3. «KI-Agenten führen git-Schadcode beim Starten automatisch aus:
    Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.»

    Hach ja, so klever ist wohl der KI Einsatz. Auch wenn ich die KI permanent kritisiere gibt es sehr wohl deren nutzen zB bei Prototype Code.

    🧑‍💻 heise.de/news/KI-Agenten-fuehr

    #ki #git #prototype #schadcode #claude #qwen #grok #repository #automatisch #coding

  4. «KI-Agenten führen git-Schadcode beim Starten automatisch aus:
    Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.»

    Hach ja, so klever ist wohl der KI Einsatz. Auch wenn ich die KI permanent kritisiere gibt es sehr wohl deren nutzen zB bei Prototype Code.

    🧑‍💻 heise.de/news/KI-Agenten-fuehr

    #ki #git #prototype #schadcode #claude #qwen #grok #repository #automatisch #coding

  5. «KI-Agenten führen git-Schadcode beim Starten automatisch aus:
    Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.»

    Hach ja, so klever ist wohl der KI Einsatz. Auch wenn ich die KI permanent kritisiere gibt es sehr wohl deren nutzen zB bei Prototype Code.

    🧑‍💻 heise.de/news/KI-Agenten-fuehr

    #ki #git #prototype #schadcode #claude #qwen #grok #repository #automatisch #coding

  6. «KI-Agenten führen git-Schadcode beim Starten automatisch aus:
    Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.»

    Hach ja, so klever ist wohl der KI Einsatz. Auch wenn ich die KI permanent kritisiere gibt es sehr wohl deren nutzen zB bei Prototype Code.

    🧑‍💻 heise.de/news/KI-Agenten-fuehr

    #ki #git #prototype #schadcode #claude #qwen #grok #repository #automatisch #coding

  7. «KI-Agenten führen git-Schadcode beim Starten automatisch aus:
    Agenten von Claude, Qwen, Grok usw. starten in manipulierten Repositories automatisch Schadcode – ohne Zutun des Anwenders, aber mit dessen vollen Rechten.»

    Hach ja, so klever ist wohl der KI Einsatz. Auch wenn ich die KI permanent kritisiere gibt es sehr wohl deren nutzen zB bei Prototype Code.

    🧑‍💻 heise.de/news/KI-Agenten-fuehr

    #ki #git #prototype #schadcode #claude #qwen #grok #repository #automatisch #coding

  8. You have to be shitting me. Even #OpenCode Big Pickle fucks over Gemini 3.1 Pro.

    Welp, I'm not renewing that shit anymore, so it's time to find a cheap AI Agent around.

    Curently aiming for OpenCode. What are your recommendations under $20?

    #AI #AIAgents #VibeCoding #VibeCode #Programming #SoftwareDevelopment #WebDevelopment #WebDev #PHP #JavaScript #TypeScript #Python #Golang #Rust #ArtificialIntelligence #Codex #Claude #Copilot #Kimi #ZenAI #Perplexity #DeepSeek #MistralAI #Grok #Qwen

  9. Local LLM Arena #4

    Repair run już się zakończył i po kilku dodatkowych poprawkach udało się domknąć benchmark.

    Po drodze wyszło jeszcze kilka problemów technicznych, więc część testów trzeba było poprawić i uzupełnić. Ostatecznie mamy jednak kompletny zestaw wyników dla wszystkich 5 modeli.

    Najlepiej wypadły dwa modele.

    Qwen3.8-27B wygrał cały benchmark i osiągnął najwyższy wynik jakościowy.

    GPT-OSS-20B był bardzo blisko, a w testach kodowania uzyskał taki sam wynik jak Qwen. Jednocześnie na moim MacBooku Air M4 16 GB działa około 5 razy szybciej.

    Dlatego teraz testuję właśnie GPT-OSS jako lokalnego agenta do prawdziwego kodowania.

    Schemat wygląda tak:

    Codex CLI

    LM Studio

    GPT-OSS-20B

    repozytorium projektu

    Model dostał 5 rzeczywistych zadań w kodzie Local LLM Arena.

    Może sam przeglądać repozytorium, edytować pliki, uruchamiać testy, analizować błędy i poprawiać własne rozwiązania.

    Każde zadanie zaczyna od czystej kopii repozytorium. Po zakończeniu rozwiązanie jest sprawdzane także dodatkowymi testami, których model wcześniej nie widział. Jeśli coś nie przejdzie, dostaje informację o błędzie i może spróbować się poprawić.

    Maksymalnie trzy podejścia na zadanie.

    Całość działa lokalnie na Macu.

    Teraz chcę sprawdzić nie tylko, czy model potrafi wygenerować poprawny kod, ale czy rzeczywiście może wykonywać część pracy lokalnego agenta programistycznego i odciążyć modele działające w chmurze.

    Test właśnie trwa.

    #LocalLLM #LLM #AI #AppleSilicon #MacBookAir #M4 #LMStudio #Codex #GPTOSS #Qwen #Coding #OpenSourceAI

  10. Der nächste DeepSeek-Moment läuft lokal auf dem PC. Qwen 3.8 27B erreicht im Intelligence Index mit 52 Punkten das Niveau von GPT-5.6 Luna. Im Agentic Index schlägt es sogar GPT-5.4. Und für die Forschung gibt es eine komplett unzensierte MLX-Version.

    #Qwen #OpenSourceAI #LocalAI #LLM #AIGeneratedImage

    all-ai.de/news/news26top/top-k

  11. SpaceX Draws a Bullseye on ASML With Its $16.8 Billion Chip Factory — BigGo Finance

    Satellite imagery of SpaceX’s Texas site revealed a circular structure at the center of its new semiconductor complex.…
    #Netherlands #Nederland #NL #Europe #Europa #EU #ASML #Astra #ElonMusk #EmadMostaque #GoogleDeepMind #Nvidia #OpenAI #PeterDiamandis #Qwen #SpaceX #Starlink #Starmine #TERAFAB #Tesla #TSMC
    europesays.com/netherlands/366

  12. ИИ снова закрывается: почему нейросети оказались на грани блокировок

    ИИ снова закрывается. Пока мир следит за технологической войной чипов, Пекин и Вашингтон начали закрывать доступ к самому главному — готовым моделям. США уже убрали Claude Mythos из общего доступа, из-за рисков в кибербезопасности. Китай в свою очередь готовится заблокировать экспорт GLM, Qwen и DouBao. Добро пожаловать в эпоху «цифрового суверенитета», где нейросети официально признаны стратегическим оружием. Разбираемся, к чему приведет эта односторонняя прозрачность.

    habr.com/ru/companies/selectel

    #selectel #ai #llmмодели #alibaba #glm #qwen #DouBao #claude_mythos #claude #искусственный_интеллект

  13. Почему маленькие модели побеждают большие – и что это значит для вашего стека

    Есть такое устойчивое интеллектуальное заблуждение: если модель больше — значит, она лучше. Больше параметров, больше обучающих данных, больше денег в предобучении — и вот вам SOTA. Гонка за размером казалась единственной игрой в городе. Но в 2025–2026 годах что‑то сломалось в этой логике. И сломалось публично, с цифрами и бенчмарками. Я хочу рассказать три истории, которые произошли практически одновременно и складываются в одну картину. Первая — про то, как Microsoft заткнула за пояс «самую опасную» языковую модель Anthropic с помощью ста специализированных агентов. Вторая — про MIT‑трюк, позволяющий маленькой GPT-5-mini обогнать полноразмерный GPT-5 вдвое на сложных задачах. Третья — про китайскую модель Qwen, которую сделала небольшая команда с ограниченными ресурсами, и которая сейчас работает в 200 000 продуктах по всему миру. В каждой истории маленький (или менее очевидный) игрок побеждает «большого». И каждый раз причина примерно одна и та же.

    habr.com/ru/articles/1043590/

    #llm #gpt5mini #qwen #claude_mythos #rlm #архитектура_иимоделей #ииоркестрация #rag

  14. So, I just heard a lawyer that create huge legal documents to avoid other people to upload these to AI:

    - Deliverately make documents over 20MB
    - Having documents with "shadow text" to exceed a context window
    - Use PDF-as-image to avoid LLM reading text correctly.
    - Having "white text" for false afirmations.

    #AI #LLM #LargeLanguageModels #Grok #Gemini #ChatGPT #Copilot #Mistral #Perplexity #DeepSeek #Qwen #DuckAi #Kimi

  15. Какая LLM лучше распознает чертежи? Мы сравнили 6 LLM и узнали ответ

    Инженерные чертежи содержат десятки типов размеров и допусков: линейные и угловые, радиальные и диаметральные, справочные и базовые, а также геометрические характеристики вроде плоскостности или перпендикулярности. Для инженера это привычный язык, но для автоматической обработки такие документы представляют серьёзную задачу. С появлением мультимодальных LLM возник вопрос: способны ли они заменить классические OCR-решения и специализированные пайплайны постобработки? Насколько хорошо современные модели справляются с извлечением размеров и допусков из коробки, без дообучения? Какие модели дают максимальную точность, какие быстрее, а какие дешевле? И можно ли комбинировать разные подходы, чтобы повысить результат? Чтобы ответить на эти вопросы, мы протестировали шесть актуальных vision-LLM на одном наборе реальных механических чертежей и сравнили их точность, скорость и стоимость обработки.

    habr.com/ru/articles/946080/

    #llmмодели #chatgpt4 #chatgpt5 #claudeopus4 #gemini_flash #gemini_pro #qwen #языковые_модели #чертежи #обработка_изображений

  16. Negli ultimi giorni ho scritto un post lunghissimo, interessante (credo) e pallosissimo (immagino) sulla creatività, sulla finzione, su Pessoa e sui chatbot basati sulla cosiddetta intelligenza artificiale generativa.

    Vi consiglio di leggere almeno la prima parte e spulciare il resto.

    aitanblog.wordpress.com/2025/0

    #ai #ia #intelligenzaartificiale #aigen #poesia #poeti #fingitori #simulazione #linguaggionaturale #linguaggioartificiale #chatgpt #claude #deepseek #qwen #perplexity #grok #pessoa