#qwen3 — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #qwen3, aggregated by home.social.
-
RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀
mehr auf Arint.info
#AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info
-
RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀
mehr auf Arint.info
#AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info
-
RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀
mehr auf Arint.info
#AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info
-
RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀
mehr auf Arint.info
#AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info
-
RT @imnotchalk: Qwen3.8 27B ist jetzt im @cerebras Shared Tier verfügbar mit einer Geschwindigkeit von ~1500 Token pro Sekunde. 🚀
mehr auf Arint.info
#AI #Cerebras #LLM #MachineLearning #Qwen3 #TechNews #arint_info
-
🚀🎉 Big news, everyone! The latest and greatest Qwen 3.8 27B is out on #Cerebras, promising to process text faster than you can say "overhyped tech jargon." Just navigate through a labyrinth of buzzwords and obscure documentation to find out how to pay for it - because who doesn't love a treasure hunt through a digital maze? 💸🔍
https://inference-docs.cerebras.ai/models/overview #Qwen3.8 #TechBuzz #DigitalMaze #TreasureHunt #HackerNews #ngated -
Lokale KI erstmals auf Cloud-Niveau?
-
Qwen 3.8 27B Uncensored – Testing the Uncensored Qwen Model
https://imageat.com/models/qwen-3-8-27b-uncensored
Comments: https://news.ycombinator.com/item?id=49456134
#HackerNews #Qwen3.8 #Uncensored #AI #Model #Testing #MachineLearning #TechNews
-
Qwen3.8-27B at 256K on a 24GB RTX PRO 4000 SFF (432 GB/s): 50 tok/s with MTP
https://piszczek.pl/blog/qwen38-27b-256k-50-tps-24gb-gpu
Comments: https://news.ycombinator.com/item?id=49331607
#HackerNews #Qwen3.8 #256K #RTX4000 #MTP #AIperformance #MachineLearning
-
https://winbuzzer.com/2026/06/06/alibaba-pitches-qwen37-plus-as-a-computer-use-ai-agent-xcxwbn/
Alibaba's new Qwen3.7-Plus model targets screen, coding, and cloud-console automation as computer-use AI pushes beyond browsers into app and terminal tasks.
#AI #Qwen37Plus #Qwen3 #Alibaba #Qwen #AIAutomation #AIAgents #MultimodalAI #AICoding #AIModels
-
RT @jun_song: TRANSLASION: LLMs kommen diese Woche: Qwen3.7 max ✅ Qwen3.7 27b/35b Minimax M3.0 Gemini 3.5 Pro/Flash GPT-5.6 Sonnet-4.8❓ Kimi/GLM ❓ Es ist eine große Woche.
mehr auf Arint.info
-
Krátce jsem zkoušel lokální #LLM modely na mém #frameworklaptop13 a docela zajímavě vypadá "přemýšlivý" qwen3.6:35b-a3b-q4_K_M, který na AMD Ryzen 5 AI 340 + 32GB RAM běží použitelně.
Tento model má redukovaný počet aktivních parametrů pro zpracování jednoho tokenu. Na první pohled, tak méně zatěžuje CPU/GPU a celý notebook méně hučí a topí. Podobně funguje i starší qwen3-coder:30b-a3b-q4_K_M, který "nepřemýšlí" takže odpověď dorazí rychleji.
Každopádně na tomto HW tyto modely generují výstup řádově v nižších desítkách (možná spíš jednotky) tokenů za sekundu. Měřeno pohledem oka. Použitelné to je, ale kdo to s lokálním LLM myslí opravdu vážně, brzy sáhne po něčem výkonnějším.
-
We got 207 tok/s with Qwen3.5-27B on an RTX 3090
https://github.com/Luce-Org/lucebox-hub
#HackerNews #Qwen3.5 #RTX3090 #tok/s #machinelearning #AIperformance
-
Большой бенчмарк: ROCm vs Vulkan в LM Studio 0.4 и добавление параллельных запросов
27 января вышла LM Studio версии 0.4.0 и это обновление принесло долгожданную функцию параллельной обработки запросов через continuous batching. Это критически важное обновление для production-использования локальных LLM, которое обещает значительное увеличение пропускной способности. Теперь можно не просто "крутить модельку для себя", а разворачивать реальные multi-user сервисы. Но как это работает на практике? Я провел комплексное исследование на своем домашнем ПК, сравнив производительность ROCm и Vulkan, а также влияние количества потоков на пропускную способность (TPS). Спойлер: Разница между ROCm и Vulkan оказалась шокирующей — до 2 раз в пользу ROCm, а правильная настройка потоков дает +50% бесплатной производительности.
https://habr.com/ru/articles/991282/
#lmstudio #qwen #qwen3 #mistral #ministral_3 #gpt #llm #llmмодели #llmприложения #llmагент