home.social

#qwen3 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #qwen3, aggregated by home.social.

  1. RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀

    mehr auf Arint.info

    #AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info

    https://x.com/imnotchalk/status/2095637567979114654

  2. RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀

    mehr auf Arint.info

    #AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info

    https://x.com/imnotchalk/status/2095637567979114654

  3. RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀

    mehr auf Arint.info

    #AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info

    https://x.com/imnotchalk/status/2095637567979114654

  4. RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀

    mehr auf Arint.info

    #AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info

    https://x.com/imnotchalk/status/2095637567979114654

  5. RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀

    mehr auf Arint.info

    #AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info

    https://x.com/imnotchalk/status/2095637567979114654

  6. Krátce jsem zkoušel lokální #LLM modely na mém #frameworklaptop13 a docela zajímavě vypadá "přemýšlivý" qwen3.6:35b-a3b-q4_K_M, který na AMD Ryzen 5 AI 340 + 32GB RAM běží použitelně.

    Tento model má redukovaný počet aktivních parametrů pro zpracování jednoho tokenu. Na první pohled, tak méně zatěžuje CPU/GPU a celý notebook méně hučí a topí. Podobně funguje i starší qwen3-coder:30b-a3b-q4_K_M, který "nepřemýšlí" takže odpověď dorazí rychleji.

    Každopádně na tomto HW tyto modely generují výstup řádově v nižších desítkách (možná spíš jednotky) tokenů za sekundu. Měřeno pohledem oka. Použitelné to je, ale kdo to s lokálním LLM myslí opravdu vážně, brzy sáhne po něčem výkonnějším.

    #ollama #qwen3 #ryzen #localllm