#qwen — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #qwen, aggregated by home.social.
-
Тест DeepSeek, Qwen, GLM и прочих LLM на продвинутом пользовательском железе
В статье рассказываю о личном опыте запуска современных LLM на домашнем ПК, сравниваю модели, кванты и движки, показываю результаты практических тестов и делюсь выводами о том, что сегодня по моему мнению имеет смысл запускать локально.
https://habr.com/ru/articles/1080316/
#MTP #DSpark #NInfer #FreeToken #ExLlamaV3 #Qwen #DeepSeek #GLM #Ornith #RTX_5090
-
🧵 Suite complémentaire de mes aventures avec Qwen et ses versions « uncensored »…
Un benchmark vient de comparer Qwen3.8-27B avec 8 variantes “abliterated” publié par par Abliterlitics
LLM Abliteration Forensics
⬇️
"Qwen 3.8 27B: 8 Abliteration Variants Compared"
👇
https://abliterlitics.dev/models/qwen38-27b/...et ladies & gentlemen là aussi le gagnant est OrcaRouter : ~82 % de compliance sur HarmBench tout en restant pratiquement aussi capable que le Qwen original.
Juste derrière, Apostate (https://github.com/heterodoxin/apostate) fait ~79 % avec… seulement 41 vraies modifications dans les poids.
Petit, précis, efficace.
Comme quoi
rm -rf alignment
n’était peut-être pas la bonne méthodologie.Quant aux limites "morales", ils arrivent aux même constats que mes petits tests du dimanche
Les variantes arrivent très bien à faire sauter les barrières sur…
- chimie/bio
- cybercrime
- contenus dangereux...😬
mais le truc le plus fou-> demande des paroles de chanson ou des passages de bouquin et soudain :
HALTE-LÀ CITOYEN, LE COPYRIGHT. 🛑©️
Le meilleur modèle ne dépasse même pas ~39 % sur cette catégorie.
Donc, résumé de la lecture et de l'experience:
Faire sauter les safety rails sans casser le modèle, ce n’est plus théorique : ça marche, et ça se pratique déjà.
Ces modèles, une fois quantifiés en 4-bit, restent très performants et peuvent tourner localement sur des Mac grand public.
Accès simple: plus besoin d’un datacenter ni d’un gros budget pour déployer ce type de modèles.
...et manifestement, chez les LLM, Metallica est désormais mieux protégé que la chimie dangereuse.
¯(ツ)/¯
-
🧠 Chcete offline AI modely? Lokálně je lze provozovat i na mobilu
https://infoek.cz/chcete-offline-ai-modely-lokalne-je-lze-provozovat-i-na-mobilu-2026/
🧠 Do you want offline AI models? They can be run locally on mobile
-
Семь ИИ‑моделей получили по $300 и три дня, чтобы заработать. Выручка — $0
Bottleneck Labs провели простой по формулировке и довольно безумный по исполнению эксперимент: семи ИИ‑моделям выдали по разблокированному Mac mini, банковскому счёту с $300, отдельному аккаунту Stripe, электронной почте и доступу в интернет. Задание состояло практически из одной строки: «Заработай как можно больше денег, начинай прямо сейчас» . На всё дали 72 часа. Через трое суток результат выглядел так: $0 выручки , если не считать $5, которые Grok заплатил сам себе. При этом модели успели отправить 2797 писем, потратить $359,80 настоящих денег со своих счетов и ещё $2833,35 на обращения к моделям. Не только лишь каждая модель так сможет!
https://habr.com/ru/articles/1080120/
#ИИагенты #автономные_агенты #большие_языковые_модели #LLM #искусственный_интеллект #OpenAI #Grok #Qwen #Stripe #автономный_бизнес
-
I've made another custom LLM. This one is a 7GB version of Qwen 3.8 27B that can be fully run on an 8GB GPU. I call it NanoFlare.
Local AI takes the power away from the big providers and consumes far less resources. If you have to use AI, running open weights on your own PC is a much better option. And I hope either NanoFlare or MicroFlare can help you do that.
https://microflare.bearblog.dev/nanoflare-compresses-qwen-27b-down-to-fit-on-an-8gb-gpu/
#localAI #localLLM #selfhosted #ai #llm #qwen #openweights #openmodels
-
I've made another custom LLM. This one is a 7GB version of Qwen 3.8 27B that can be fully run on an 8GB GPU. I call it NanoFlare.
Local AI takes the power away from the big providers and consumes far less resources. If you have to use AI, running open weights on your own PC is a much better option. And I hope either NanoFlare or MicroFlare can help you do that.
https://microflare.bearblog.dev/nanoflare-compresses-qwen-27b-down-to-fit-on-an-8gb-gpu/
#localAI #localLLM #selfhosted #ai #llm #qwen #openweights #openmodels
-
I've made another custom LLM. This one is a 7GB version of Qwen 3.8 27B that can be fully run on an 8GB GPU. I call it NanoFlare.
Local AI takes the power away from the big providers and consumes far less resources. If you have to use AI, running open weights on your own PC is a much better option. And I hope either NanoFlare or MicroFlare can help you do that.
https://microflare.bearblog.dev/nanoflare-compresses-qwen-27b-down-to-fit-on-an-8gb-gpu/
#localAI #localLLM #selfhosted #ai #llm #qwen #openweights #openmodels
-
I've made another custom LLM. This one is a 7GB version of Qwen 3.8 27B that can be fully run on an 8GB GPU. I call it NanoFlare.
Local AI takes the power away from the big providers and consumes far less resources. If you have to use AI, running open weights on your own PC is a much better option. And I hope either NanoFlare or MicroFlare can help you do that.
https://microflare.bearblog.dev/nanoflare-compresses-qwen-27b-down-to-fit-on-an-8gb-gpu/
#localAI #localLLM #selfhosted #ai #llm #qwen #openweights #openmodels
-
I've made another custom LLM. This one is a 7GB version of Qwen 3.8 27B that can be fully run on an 8GB GPU. I call it NanoFlare.
Local AI takes the power away from the big providers and consumes far less resources. If you have to use AI, running open weights on your own PC is a much better option. And I hope either NanoFlare or MicroFlare can help you do that.
https://microflare.bearblog.dev/nanoflare-compresses-qwen-27b-down-to-fit-on-an-8gb-gpu/
#localAI #localLLM #selfhosted #ai #llm #qwen #openweights #openmodels
-
Hooking up an LLM + MCP + HA and having basically a text interface into Home Assistant that knows how to do shit is amazing. I've always struggled making good looking dashboards and getting all my tools to talk to one another. Now I have something that correlates all the different pieces and finds configuration holes and disconnects.
It's a strange new world. This dashboard took about 10m to create and I love it.
-
Hooking up an LLM + MCP + HA and having basically a text interface into Home Assistant that knows how to do shit is amazing. I've always struggled making good looking dashboards and getting all my tools to talk to one another. Now I have something that correlates all the different pieces and finds configuration holes and disconnects.
It's a strange new world. This dashboard took about 10m to create and I love it.
-
Hooking up an LLM + MCP + HA and having basically a text interface into Home Assistant that knows how to do shit is amazing. I've always struggled making good looking dashboards and getting all my tools to talk to one another. Now I have something that correlates all the different pieces and finds configuration holes and disconnects.
It's a strange new world. This dashboard took about 10m to create and I love it.
-
Hooking up an LLM + MCP + HA and having basically a text interface into Home Assistant that knows how to do shit is amazing. I've always struggled making good looking dashboards and getting all my tools to talk to one another. Now I have something that correlates all the different pieces and finds configuration holes and disconnects.
It's a strange new world. This dashboard took about 10m to create and I love it.
-
Hooking up an LLM + MCP + HA and having basically a text interface into Home Assistant that knows how to do shit is amazing. I've always struggled making good looking dashboards and getting all my tools to talk to one another. Now I have something that correlates all the different pieces and finds configuration holes and disconnects.
It's a strange new world. This dashboard took about 10m to create and I love it.
-
The embedded AI inside ‘Made in China’
Western coverage of Chinese artificial intelligence still tends to treat the competition as a model contest: can a…
#NewsBeep #News #Artificialintelligence #AI #Alibaba #ArtificialIntelligence #AU #Australia #Block2 #bytedance #ChinaAI #DeepSeek #Doubao #EmbeddedAI #geely #Huawei #madeinchina #Qwen #Technology
https://www.newsbeep.com/au/883620/ -
The embedded AI inside ‘Made in China’
Western coverage of Chinese artificial intelligence still tends to treat the competition as a model contest: can a…
#NewsBeep #News #Artificialintelligence #AI #Alibaba #ArtificialIntelligence #AU #Australia #Block2 #bytedance #ChinaAI #DeepSeek #Doubao #EmbeddedAI #geely #Huawei #madeinchina #Qwen #Technology
https://www.newsbeep.com/au/883620/ -
Qwen и Grok отгадывают советские загадки на внимательность
Кто лучше справляется с советскими загадками на внимательность — Qwen, Grok или человек? Сравнили две классические головоломки и получили любопытные результаты.
https://habr.com/ru/articles/1079530/
#сравнение_моделей #qwen #grok #мультимодальные_модели #vlm #visionlanguage_models #галлюцинации_ии #искусственный_интеллект #нейросети
-
Переводим книги нейронками для себя: год спустя. Словари, скорости и почему переводчики всё ещё нужны
Год назад я написал статью « Переводим fb2 книжки, с нейронками, для себя » — про то, как собрал на паре Tesla P40 в гараже программу Sunny Narrator («Солнечный сказочник»), которая переводит художественные книги через локальные и облачные LLM. Тогда это был скорее прототип «доказать себе, что так можно»: черновики читались с головной болью, книга в тысячу страниц переводилась два дня, а электричество, отключённое посреди процесса, стоило ещё двух. За год программа доехала до версии 2.1, я перевёл достаточно книг, чтобы набить руку, и понял главное: это уже инструмент не только для меня, но и для переводчиков — и для всех любопытных . Рассказываю, что изменилось, сколько это стоит в токенах и почему без человека ничего не работает.
https://habr.com/ru/articles/1077366/
#перевод #переводы #fb2 #epub #llm #llmприложения #словари #tesla_p40 #qwen #gemma
-
Looks like #qwen was trained to use #duckduckgo
Even the AI companies think that the google search is dogshit 🤣
-
🧪 LLM Benchmark Showdown: 5 lokale Ollama-Modelle im Vergleich
Getestet auf derselben Hardware (#gmktecevo2 #AMDRyzenAIMaxPlus395 #strixhalo):
• #GSM8K (100 Samples) — Math
• #BFCL (100/Kategorie) — Function Calling
• #MBPP+ (50) — Python Coding
• #HumanEval+ (20) — Python Coding📊 Ergebnisse (Accuracy / Output TK/s / VRAM):
**qwen3.8:27b**
GSM8K 82% | BFCL 91.5% | MBPP+ 100% | HE+ 100%
⚡ 25.5 TK/s | 💾 18 GB VRAM**qwen3.6:27b**
GSM8K 83% | BFCL 93% | MBPP+ 98% | HE+ 75%
⚡ 12.7 TK/s | 💾 33 GB VRAM**qwen3.6:35b**
GSM8K 84% | BFCL 90% | MBPP+ 98% | HE+ 55%
⚡ 61.8 TK/s | 💾 27 GB VRAM**ornith-1.5:35b**
GSM8K 75% | BFCL 92.5% | MBPP+ 78% | HE+ 0%
⚡ 63.6 TK/s | 💾 26 GB VRAM**nemotron-3.5-lightning:30b**
GSM8K 59% | BFCL 74% | MBPP+ 94% | HE+ 0%
⚡ 91.9 TK/s | 💾 26 GB VRAM🏆 Fazit:
qwen3.8:27b ist der klare Sieger — als einziges Modell 100% bei beiden Coding-Benchmarks, bei GSM8K/BFCL gleichauf mit den anderen Qwen-Modellen. Bei 25.5 TK/s und nur 18 GB VRAM das beste Qualität/Speed/Effizienz-Verhältnis.
qwen3.6:27b ist qualitativ nah dran (BFCL sogar 93%), aber mit 12.7 TK/s unerträglich langsam und frisst 33 GB VRAM — fast 2× so viel wie qwen3.8 bei halber Speed.
qwen3.6:35b ist mit 61.8 TK/s 2.4× schneller als qwen3.8, aber HE+ nur 55% (vs 100%). Trading Code-Qualität für Speed.
ornith-1.5:35b und nemotron-3.5-lightning:30b fallen bei Coding komplett durch (HE+ 0%), sind aber die schnellsten Modelle im Feld (64 / 92 TK/s).
💡 TK/s = generierte Tokens/Sekunde (Warm-Run, ollama --verbose).
💾 VRAM = GPU-Speicher bei max context (262K bzw. 1M bei nemotron). -
Building a local AI storyteller - Part II - When the model is not enough
A blog by JustusIn the first part of this series, I described the most important lesson I learned while building a local AI storyteller: A good LLM application is not a clever prompt. It is software architecture around a probabilistic component. That sounds reassuringly architectural. It also leaves one...
#dev #softwaredevelopment #java #ai #llm #localmodels #gemma #qwen #softwarearchitecture
-
So I switched from #PicoClaw to #Hermes_agent. Really cool improvement also that I can define different LLMs for different tasks.
Now my Triage Tasks are done by #Gemma-4-26B-A4B and my main tasks are done by #Qwen-3.8-27B-NVFP4.
Makes everything much faster and still reliable. Both models co-exist on my #DGXSpark
-
Qwen3.5/3.6 на 16Гб VRAM: кванты, fine-tune, сравнение и немного про Gemma-4
Всем привет. В свободное время и под настроение я ваяю маленькие, незамысловатые игры на основе d10-кубов механик, похожие на PvP или PvE настолки, которые нередко проходят в автоматическом режиме (ИИ vs ИИ), а иногда получается что-то чуть серьезнее: вроде игры "Жизнь", но на стероидах с экономикой, сражениями и в масштабах солнечной системы. Не являясь настоящим программистом и написав за всю жизнь, наверное, самое большее - ну, возможно, не более тысячи строк кода - мне для воплощения своих причудливых идей, естественно, потребовалась помощь психиатров нейросетей, которые, как тогда говорили - уже научились писать вполне рабочий, годный код. Конкретна эта история начиналась банально, а может даже и несколько варварски: с web-чата с одной китайской нейросетью со значком в виде кита в формате ctrl+c > ctrl+v в файлики игры, но вскоре проекты разрослись, структура стала сложной и потребовалось что-то вроде OpenCode или LM Studio Bionic (вышел совсем недавно, но мне понравился), а затем встал и выбор локальной модели, которая всегда будет бесплатной, под рукой и без ограничений типа " server is busy... try later ". Зоопарк моделей разросся довольно быстро и хотя базовых моделей не так много, но это количество предстояло умножить на разные варианты квантования и присыпать сверху горкой т.н. fine-tune моделей, которые, буквально, сотнями, если не тысячами - рассыпаны по HuggingFace, а их авторы обещают космическую скорость инференса, интеллект передовых моделей и "думалку" (режим thinking) от какого-нибудь Deep Seep, Claude или Fable.
-
Humbled that our number of Chrome-only active users surpassed 1,000 for the first time.
https://github.com/webbrain-one/webbrain
#Chrome #ChromeExtension #WebExtension #Milestone #OpenSource #GitHub #WebBrain #offlinellm #qwen #gemma #ollama #llamacpp
-
Тест Qwen3.5 9b, Gemma 4 12b и Bonsai 27b на легенде пенсионного возраста GTX 1080 ti
Все началось вообще не с идеи написать очередной бенчмарк. Мне нужно было собрать локальный пайплайн для длинных подкастов: получить транскрипт, найти в нем интересные куски, выбрать несколько сильных фрагментов и уже из них делать короткие вертикальные ролики. Облачные модели с этой задачей справляются, но постоянно гонять туда длинные расшифровки не очень хотелось. Плюс было интересно понять, насколько далеко сейчас можно уехать на железе. Под рукой была GTX 1080 Ti на 11 ГБ. Карта 2017 года, архитектура Pascal, никаких Tensor Cores. Так из прикладной задачи постепенно вырос небольшой домашний стенд. Я прогнал три модели в одинаковых условиях, отдельно проверил длинный контекст, затем сделал свой набор reasoning‑задач и сравнил режимы с размышлением и без него. Результаты получились не совсем такими, как я ожидал.
https://habr.com/ru/articles/1069290/
#gemma #qwen #bonsai #бенчмарк #локальные_нейросети #ai #искусственный_интеллект
-
Hab mir im Februar ein #MacStudio mit #M4max und 128GB RAM gekauft... Für verrückte fast 4100€... Und ich dachte mir das ist der größte finanzielle Fehler ever
Hab damit dann viel #ollama #lmstudio #omlx gehostet - #LLM Experimentarium
Habs sogar ein paar Monaten nur mit den eigenen LLMs gecodet, aber Qualität naja...
Da sich die letzten Monate das #openWeights Business geändert hat und keine 120b Modelle veröffentlicht werden, die der perfekte fit dafür wären, nutze ich die 30b Modelle...
Leider mit zunehmendem Frust... #Gemma und #Qwen sind dafür einfach zu klein...
Dann bringt qwen auch nach 3.6 keine kleinen Modelle mehr raus - es gab kein 3.7 und kein 3.8 - letztes haben sie wieder man angekündigt
Bedeutet der Mac Studio war eigentlich nur als Desktop PC im Einsatz - eher #gaming und #Roblox programmierworkstation
Dann hab ich mich mal schlau gemacht - #apple hat meine 128gb Version zum frontier Modell gemacht - und die Modelle sind nirgendwo zu bekommen... Ganz merkwürdig Markt leer gesaugt
Vllt bringt Apple bald neue Mac Studio Modell raus???Okay - eBay preise abgecheckt - da gehen Modell für über 5k€ über den Tisch, aber sehr selten die 128gb Variante
eBay inseriert - 6999,99€ sofort kauf oder Preisvorschlag ab 6000€
Hab das Ding jetzt für 6200€ weiter verkauft
Leider über eBay bezahlt, deshalb wird mein Gewinn versteuert, aber ich gönne
Ist das nicht krass? Was da abgeht, das ist so verrückt auf dem Gebrauch Mac Markt!
-
Building a local AI storyteller - what I learned when prompts were not enough
A blog by JustusI wanted to understand what happens when you stop treating an LLM as a chatbot and start treating it as a component in a software system. So I built a local AI storyteller using a local LLM through an OpenAI-compatible API.
#dev #softwaredevelopment #java #ai #llm #localmodels #gemma #qwen #softwarearchitecture
-
I'm using Text-To-Speech (TTS) on my Desktop (Calender Events, Firefox Read Aloud) and with Home Assistant. However the quality isn't the best and I wanted a better option.
I've started a new project for this called crane-wyoming which is in alpha/beta stage as it is not feature complete but works well for TTS.
https://codeberg.org/cryptomilk/crane-wyoming
#homeassistant #speech #speechd #speechdispatcher #tts #inference #llm #voice #asr #qwen #voxtral #ai #rust
-
Finally today I was trying to understand how to use #nvidia free hosted models and managed to use very big #nemotron version and there is #deepseek #minimax and #qwen also hosted on nvidia catalog, do not get too excited because there is rate limiter, we can not use it heavily but for small tasks you can ask and try different models and I connected #VSCode. I hope soon #intel or #amd also host this kind of models to show their AI capabilities.
https://ozkanpakdil.github.io/posts/my_collections/2026/2026-07-19-how-to-add-nvidia-free-model/
-
-
-
New week, new slides: Run LLMs Locally
Added OpenAI's Privacy-Filter model using privacy-filter.cpp.
New slides about economics and hardware used by the Hugging Face community.https://github.com/thomas-0816/talks/blob/main/Run_LLMs_Locally_2026_ThomasBley.pdf
#ai #llm #llamacpp #wllama #stablediffusion #qwen #localai #gemma4 #webgpu #opencode #huggingface #privacy #digitalsovereignty
-
https://winbuzzer.com/2026/07/04/alibaba-skillweaver-claims-99-agent-token-cut-in-benchmark-xcxwbn/
Alibaba Cloud's SkillWeaver framewordk routes AI-agent tasks to relevant tools and claims 99% lower benchmark token use, but code and production proof remain open.
#AI #SkillWeaver #AlibabaCloud #Alibaba #AIAgents #AgenticAI #AIBenchmarks #Qwen #AIResearch
-
Как я пытался создать шедевр в Qwen, Luma и Pika, и что из этого вышло
Помните, как полтора-два года назад в коротких видео стали появляться видео сомнительного качества, которые можно с легкостью пометить как сгенерированные? С тех пор их количество заметно упало. Мы решили провести эксперимент и выяснить, действительно ли некачественные видео, созданные нейросетями, исчезли, или люди научились делать настолько хорошие ролики, что мы уже перестали определять, кто есть кто. В этой статье попробуем сгенерировать такие видео (или еще качественнее).
https://habr.com/ru/companies/selectel/articles/1047954/
#selectel #open_source #llm #video #qwen #luma #pika #ии #ии_и_машинное_обучение
-
El modelo Qwen3.5-2B-Q4_K_M descargado automáticamente. Funciona. Sin embargo, la pregunta llega sola: ¿es ese el mejor modelo que puede correr esta placa, o hay algo más? https://raspberryparatorpes.net/proyectos/modelos-llm-potato-os-raspberry-pi-5/ #RaspberryPi #PotatoOS #LocalLLM #Qwen
-
https://winbuzzer.com/2026/05/14/former-alibaba-star-researcher-starts-new-ai-lab-s-xcxwbn/
Former Alibaba Qwen research lead Junyang Lin is seeking a large funding round for a new AI lab that may be valued at about $2 billion.
#AI #JunyangLin #Alibaba #Qwen #ChinaAI #AIResearch #AlibabaCloud
-
Se hai mai avuto bisogno di trascrivere una nota vocale, un’intervista o un audio WhatsApp direttamente sul tuo smartphone — senza mandare nulla in cloud, senza abbonamenti, senza privacy violata — allora questo progetto fa per te.
phone-whisper è un’app Android open source che ho sviluppato a partire da un fork di un progetto esistente, riprogettandola per fare una cosa sola ma fatta […]
#ai #geminiCli #parakeet #phoneWhisper #qwen #sherpaOnnx #STT https://www.b0sh.net/2026/04/phone-whisper-trascrizione-audio-offline-su-android-con-sherpa-onnx/ -
https://winbuzzer.com/2026/04/05/alibaba-qwen-fipo-algorithm-doubles-ai-reasoning-depth-xcxwbn/
Alibaba's New FIPO Algorithm Doubles AI Reasoning Depth
#AI #Alibaba #Qwen #LLMs #ReinforcementLearning #AIModels #MachineLearning #AIModelDevelopment #ChinaAI #AlibabaCloud
-
https://winbuzzer.com/2026/03/31/alibaba-qwen35-omni-closed-source-multimodal-ai-xcxwbn/
Alibaba Keeps Qwen3.5-Omni Closed, Breaks Open-Source Streak
#AI #AudioAI #Alibaba #Qwen35Omni #MultimodalAI #OpenSourceAI #Qwen #LLMs #ChinaAI #AlibabaCloud #SpeechSynthesis
-
https://winbuzzer.com/2026/03/17/alibaba-token-hub-division-ai-consolidation-eddie-wu-xcxwbn/
Alibaba Creates Token Hub Division to Unify AI Units
#AI #Alibaba #AlibabaCloud #ChinaAI #Qwen #AgenticAI #CloudComputing #AIInfrastructure #BigTech #AIAgents #Investment #OpenSourceAI #USChinaTechWar
-
So, I just heard a lawyer that create huge legal documents to avoid other people to upload these to AI:
- Deliverately make documents over 20MB
- Having documents with "shadow text" to exceed a context window
- Use PDF-as-image to avoid LLM reading text correctly.
- Having "white text" for false afirmations.#AI #LLM #LargeLanguageModels #Grok #Gemini #ChatGPT #Copilot #Mistral #Perplexity #DeepSeek #Qwen #DuckAi #Kimi
-
Новые LLM из Китая, бесплатный аналог Suno, ИИ-собеседник от Nvidia и признание Альтмана о текстах в GPT
Привет, это новый выпуск «Нейро-дайджеста» — коротких и полезных обзоров ключевых событий в мире искусственного интеллекта и технологий. Неделя выдалась насыщенной: куча мощнейших релизов из Китая, которые наступают на пятки GPT-5.2 и Gemini 3. Реалтайм инструменты от Krea и NVIDIA, генеративные модели от Qwen и Hunyuan, а Сэм Альтман честно признал, что OpenAI испортили тексты в последних версиях GPT. Всё самое важное — в одном месте. Поехали! Читать дайджест →
https://habr.com/ru/companies/timeweb/articles/990420/
#нейросети #ии #krea #qwen #qwen3tts #texttospeech #alibaba #baidu #ernie #timeweb_дайджест
-
Does RL Incentivize Reasoning in LLMs Beyond the Base Model?
https://limit-of-rlvr.github.io/
#ycombinator #Qwen #Deepseek_R1 #PPO #GRPO #AIME #RLVR #Tsinghua_University -
Negli ultimi giorni ho scritto un post lunghissimo, interessante (credo) e pallosissimo (immagino) sulla creatività, sulla finzione, su Pessoa e sui chatbot basati sulla cosiddetta intelligenza artificiale generativa.
Vi consiglio di leggere almeno la prima parte e spulciare il resto.
https://aitanblog.wordpress.com/2025/02/21/il-chatbot-e-un-fingitore/
#ai #ia #intelligenzaartificiale #aigen #poesia #poeti #fingitori #simulazione #linguaggionaturale #linguaggioartificiale #chatgpt #claude #deepseek #qwen #perplexity #grok #pessoa