#deepseekr1 — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #deepseekr1, aggregated by home.social.
-
А что, так можно было? Как (а главное — зачем) установить нейросеть на компьютер
Большинство нейросетей сегодня работают онлайн: вы открываете сайт, пишете запрос и получаете ответ с удаленного сервера. Но некоторые современные модели можно скачать на компьютер и запускать прямо на своем железе — даже без подключения к интернету. Это называется локальным запуском нейросети . Вы скачиваете файлы модели, устанавливаете специальную программу и после этого общаетесь с ИИ примерно так же, как с обычным онлайн-чатом. Причем для этого не обязательно иметь игровой ПК за несколько тысяч долларов. Существуют компактные версии моделей, которые способны работать даже на обычных домашних компьютерах и ноутбуках.
https://habr.com/ru/articles/1068830/
#deepseek #chatgpt #нейросеть #нейросеть_локально #нейросеть_онлайн #нейросети #deepseek_r1 #deepseek_v3 #deepseekr1 #deepseek_ai
-
А что, так можно было? Как (а главное — зачем) установить нейросеть на компьютер
Большинство нейросетей сегодня работают онлайн: вы открываете сайт, пишете запрос и получаете ответ с удаленного сервера. Но некоторые современные модели можно скачать на компьютер и запускать прямо на своем железе — даже без подключения к интернету. Это называется локальным запуском нейросети . Вы скачиваете файлы модели, устанавливаете специальную программу и после этого общаетесь с ИИ примерно так же, как с обычным онлайн-чатом. Причем для этого не обязательно иметь игровой ПК за несколько тысяч долларов. Существуют компактные версии моделей, которые способны работать даже на обычных домашних компьютерах и ноутбуках.
https://habr.com/ru/articles/1068830/
#deepseek #chatgpt #нейросеть #нейросеть_локально #нейросеть_онлайн #нейросети #deepseek_r1 #deepseek_v3 #deepseekr1 #deepseek_ai
-
А что, так можно было? Как (а главное — зачем) установить нейросеть на компьютер
Большинство нейросетей сегодня работают онлайн: вы открываете сайт, пишете запрос и получаете ответ с удаленного сервера. Но некоторые современные модели можно скачать на компьютер и запускать прямо на своем железе — даже без подключения к интернету. Это называется локальным запуском нейросети . Вы скачиваете файлы модели, устанавливаете специальную программу и после этого общаетесь с ИИ примерно так же, как с обычным онлайн-чатом. Причем для этого не обязательно иметь игровой ПК за несколько тысяч долларов. Существуют компактные версии моделей, которые способны работать даже на обычных домашних компьютерах и ноутбуках.
https://habr.com/ru/articles/1068830/
#deepseek #chatgpt #нейросеть #нейросеть_локально #нейросеть_онлайн #нейросети #deepseek_r1 #deepseek_v3 #deepseekr1 #deepseek_ai
-
https://www.europesays.com/people/151411/ DeepSeek CEO is world’s richest AI founder, has more money than Dario and Greg Brockman combined #AIStartupFounder #BloombergBillionairesIndex #DarioAmodei #DeepSeek #DeepSeekFundingRound #DeepSeekValuation #DeepSeekR1 #HighFlyerCapitalManagement #LiangWenfeng #NetWorth
-
GPT-5.6、7月7日発表か——Claude Fable 5の「空白期間」を狙い撃つ戦略的タイミング、コード流出で3つのサブモデルが判明 — BigGo ファイナンス https://www.yayafa.com/2836239/ #AgenticAi #AI #Anthropic #ArtificialGeneralIntelligence #ArtificialIntelligence #ClaudeFable5 #CODEX #DeepSeekR1 #Gemini35Pro #GPT56 #GPT56Luna #GPT56Sol #GPT56Terra #OpenAI #Opus48 #SolUltra #エージェント型AI #トークン・アポカリプス #人工知能 #汎用人工知能
-
GPT-5.6、7月7日発表か——Claude Fable 5の「空白期間」を狙い撃つ戦略的タイミング、コード流出で3つのサブモデルが判明 — BigGo ファイナンス https://www.yayafa.com/2836239/ #AgenticAi #AI #Anthropic #ArtificialGeneralIntelligence #ArtificialIntelligence #ClaudeFable5 #CODEX #DeepSeekR1 #Gemini35Pro #GPT56 #GPT56Luna #GPT56Sol #GPT56Terra #OpenAI #Opus48 #SolUltra #エージェント型AI #トークン・アポカリプス #人工知能 #汎用人工知能
-
GPT-5.6、7月7日発表か——Claude Fable 5の「空白期間」を狙い撃つ戦略的タイミング、コード流出で3つのサブモデルが判明 — BigGo ファイナンス https://www.yayafa.com/2836239/ #AgenticAi #AI #Anthropic #ArtificialGeneralIntelligence #ArtificialIntelligence #ClaudeFable5 #CODEX #DeepSeekR1 #Gemini35Pro #GPT56 #GPT56Luna #GPT56Sol #GPT56Terra #OpenAI #Opus48 #SolUltra #エージェント型AI #トークン・アポカリプス #人工知能 #汎用人工知能
-
If you are setting up #DeepSeekR1 on a dedicated server, skip the basic consumer tutorials. Running a simple container bound to a public port exposes your GPU to internet bots and lacks the concurrency optimization needed for production.
For the complete configuration read more here: https://www.fitservers.com/tutorials/howto/host-deepseek-r1-dedicated-server-vllm/
#SelfHosted #DevOps #Sysadmin #GPUServers #OpenSourceAI #Privacy
-
If you are setting up #DeepSeekR1 on a dedicated server, skip the basic consumer tutorials. Running a simple container bound to a public port exposes your GPU to internet bots and lacks the concurrency optimization needed for production.
For the complete configuration read more here: https://www.fitservers.com/tutorials/howto/host-deepseek-r1-dedicated-server-vllm/
#SelfHosted #DevOps #Sysadmin #GPUServers #OpenSourceAI #Privacy
-
LLMs: Leur Influence Croissante et les Zones d'Ombre
New open AI models like DeepSeek R1 can help with coding and complex tasks. Learn how they work and what they can do.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/
-
LLMs: Leur Influence Croissante et les Zones d'Ombre
New open AI models like DeepSeek R1 can help with coding and complex tasks. Learn how they work and what they can do.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/
-
LLMs: Leur Influence Croissante et les Zones d'Ombre
New open AI models like DeepSeek R1 can help with coding and complex tasks. Learn how they work and what they can do.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/
-
LLMs: Leur Influence Croissante et les Zones d'Ombre
New open AI models like DeepSeek R1 can help with coding and complex tasks. Learn how they work and what they can do.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/
-
New open AI models are now available, with some like DeepSeek R1 showing strong reasoning for coding tasks. This is a big step for AI development.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/ -
New open AI models are now available, with some like DeepSeek R1 showing strong reasoning for coding tasks. This is a big step for AI development.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/ -
New open AI models are now available, with some like DeepSeek R1 showing strong reasoning for coding tasks. This is a big step for AI development.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/ -
New open AI models are now available, with some like DeepSeek R1 showing strong reasoning for coding tasks. This is a big step for AI development.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/ -
DeepSeek R1 Reigns Supreme for Local, Coding AI Amidst Open-Weight Advancement
Is DeepSeek R1 good for local coding? Learn how this new open-source AI model helps developers manage large 256K token projects starting May 24, 2026.
#deepseekr1, #localai, #codingtools, #opensourceai, #devnews
-
DeepSeek R1 is now available for local use, offering a 256K token window. This is a major update for coders who need to process large files offline.
#deepseekr1, #localai, #codingtools, #opensourceai, #devnews
https://newsletter.tf/deepseek-r1-local-coding-ai-update/ -
On Large Language Models: A Current Dissection
DeepSeek R1, a new AI model, can generate code and help with complex tasks. It's open source and has a large memory for instructions. Learn how it helps developers.
#DeepSeekR1, #AICoding, #OpenSourceAI, #DeveloperTools, #May2026
-
The new DeepSeek R1 AI model can handle 256,000 instructions at once, which is much larger than many other AI models.
#DeepSeekR1, #AICoding, #OpenSourceAI, #DeveloperTools, #May2026
https://newsletter.tf/deepseek-r1-ai-code-tool-may-2026/ -
Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5)
Я решил проверить, на что способен мой старый компьютер с Radeon RX 580 под управлением Fe dora. В этой статье я пошагово разберу, как завести современный ИИ-стек ( Ollama , n8n , Open WebUI ) через Vulkan без боли с ROCm , и почему 15-35 токенов в секунду на железе 2017 года — это реальность, доступная каждому.
https://habr.com/ru/articles/1033520/
#ollama #amd #vulkan #fedora #deepseekr1 #llama_31 #qwen_35 #n8n #podman
-
Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5)
Я решил проверить, на что способен мой старый компьютер с Radeon RX 580 под управлением Fe dora. В этой статье я пошагово разберу, как завести современный ИИ-стек ( Ollama , n8n , Open WebUI ) через Vulkan без боли с ROCm , и почему 15-35 токенов в секунду на железе 2017 года — это реальность, доступная каждому.
https://habr.com/ru/articles/1033520/
#ollama #amd #vulkan #fedora #deepseekr1 #llama_31 #qwen_35 #n8n #podman
-
Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5)
Я решил проверить, на что способен мой старый компьютер с Radeon RX 580 под управлением Fe dora. В этой статье я пошагово разберу, как завести современный ИИ-стек ( Ollama , n8n , Open WebUI ) через Vulkan без боли с ROCm , и почему 15-35 токенов в секунду на железе 2017 года — это реальность, доступная каждому.
https://habr.com/ru/articles/1033520/
#ollama #amd #vulkan #fedora #deepseekr1 #llama_31 #qwen_35 #n8n #podman
-
https://winbuzzer.com/2026/05/05/image-ai-models-now-drive-app-growth-beating-chatb-xcxwbn/
Image AI Launches Beat Chatbot Upgrades on App Growth
#AI #AIImageGeneration #AIModels #GenerativeAI #Chatbots #ChatGPT #OpenAI #GPT4o #Google #GoogleGemini #MetaAI #DeepSeekR1 #MultimodalAI
-
https://winbuzzer.com/2026/05/05/image-ai-models-now-drive-app-growth-beating-chatb-xcxwbn/
Image AI Launches Beat Chatbot Upgrades on App Growth
#AI #AIImageGeneration #AIModels #GenerativeAI #Chatbots #ChatGPT #OpenAI #GPT4o #Google #GoogleGemini #MetaAI #DeepSeekR1 #MultimodalAI
-
https://winbuzzer.com/2026/05/05/image-ai-models-now-drive-app-growth-beating-chatb-xcxwbn/
Image AI Launches Beat Chatbot Upgrades on App Growth
#AI #AIImageGeneration #AIModels #GenerativeAI #Chatbots #ChatGPT #OpenAI #GPT4o #Google #GoogleGemini #MetaAI #DeepSeekR1 #MultimodalAI
-
https://winbuzzer.com/2026/05/05/image-ai-models-now-drive-app-growth-beating-chatb-xcxwbn/
Image AI Launches Beat Chatbot Upgrades on App Growth
#AI #AIImageGeneration #AIModels #GenerativeAI #Chatbots #ChatGPT #OpenAI #GPT4o #Google #GoogleGemini #MetaAI #DeepSeekR1 #MultimodalAI
-
https://winbuzzer.com/2026/05/05/image-ai-models-now-drive-app-growth-beating-chatb-xcxwbn/
Image AI Launches Beat Chatbot Upgrades on App Growth
#AI #AIImageGeneration #AIModels #GenerativeAI #Chatbots #ChatGPT #OpenAI #GPT4o #Google #GoogleGemini #MetaAI #DeepSeekR1 #MultimodalAI
-
Эксперимент: улучшаем реальную статью с Obsidian Copilot Привет, Хабр! В своей работе мне приходится держать в голо...
#контент #исследование #obsidian #командная #работа #deepseek-r1 #obsidian #плагины #ollama #редактура #текстов
Origin | Interest | Match -
Why NVLink Is Nvidia’s Secret Sauce Driving a 10x Performance Boost in MoEs We’ve seen a significant metamorphosis occur in AI in the past year, thanks to the emergence of large, capable Mixtur...
#Features #AI #for #Science #DeepSeek-R1 #extreme #co-design #HPC #Ian #Buck #mixture
Origin | Interest | Match -
#EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“ https://evjang.com/2026/02/04/rocks.html?eicker.news #tech #media #news
-
#EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“ https://evjang.com/2026/02/04/rocks.html?eicker.news #tech #media #news
-
#EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“ https://evjang.com/2026/02/04/rocks.html?eicker.news #tech #media #news
-
#EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“ https://evjang.com/2026/02/04/rocks.html?eicker.news #tech #media #news
-
#EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“ https://evjang.com/2026/02/04/rocks.html?eicker.news #tech #media #news
-
New research shows DeepSeek-R1 and QwQ-3 develop distinct personalities that boost chain-of-thought reasoning, hinting at a future where societies of thought among LLMs improve problem solving. Open-source enthusiasts, see how personality diversity reshapes AI reasoning! #DeepSeekR1 #QwQ32B #ChainOfThought #PersonalityDiversity
🔗 https://aidailypost.com/news/deepseekr1-qwq3-exhibit-competing-personalities-that-improve-reasoning
-
New research shows DeepSeek-R1 and QwQ-3 develop distinct personalities that boost chain-of-thought reasoning, hinting at a future where societies of thought among LLMs improve problem solving. Open-source enthusiasts, see how personality diversity reshapes AI reasoning! #DeepSeekR1 #QwQ32B #ChainOfThought #PersonalityDiversity
🔗 https://aidailypost.com/news/deepseekr1-qwq3-exhibit-competing-personalities-that-improve-reasoning
-
New research shows DeepSeek-R1 and QwQ-3 develop distinct personalities that boost chain-of-thought reasoning, hinting at a future where societies of thought among LLMs improve problem solving. Open-source enthusiasts, see how personality diversity reshapes AI reasoning! #DeepSeekR1 #QwQ32B #ChainOfThought #PersonalityDiversity
🔗 https://aidailypost.com/news/deepseekr1-qwq3-exhibit-competing-personalities-that-improve-reasoning
-
DeepSeek R1 im Faktencheck - AI Hype aus China?!
-
DeepSeek R1 im Faktencheck - AI Hype aus China?!
-
https://winbuzzer.com/2026/01/24/google-reveals-ai-models-exhibit-collective-intelligence-xcxwbn/
Google Researchers Say AI Models Exhibit Signs of Collective Intelligence
#AI #Google #Deepseek #Alibaba #DeepseekR1 #BigTech #AIReasoningModels #MachineLearning #AIResearch #Alphabet
-
https://winbuzzer.com/2026/01/24/google-reveals-ai-models-exhibit-collective-intelligence-xcxwbn/
Google Researchers Say AI Models Exhibit Signs of Collective Intelligence
#AI #Google #Deepseek #Alibaba #DeepseekR1 #BigTech #AIReasoningModels #MachineLearning #AIResearch #Alphabet
-
https://winbuzzer.com/2026/01/24/google-reveals-ai-models-exhibit-collective-intelligence-xcxwbn/
Google Researchers Say AI Models Exhibit Signs of Collective Intelligence
#AI #Google #Deepseek #Alibaba #DeepseekR1 #BigTech #AIReasoningModels #MachineLearning #AIResearch #Alphabet
-
https://winbuzzer.com/2026/01/24/google-reveals-ai-models-exhibit-collective-intelligence-xcxwbn/
Google Researchers Say AI Models Exhibit Signs of Collective Intelligence
#AI #Google #Deepseek #Alibaba #DeepseekR1 #BigTech #AIReasoningModels #MachineLearning #AIResearch #Alphabet
-
https://winbuzzer.com/2026/01/24/google-reveals-ai-models-exhibit-collective-intelligence-xcxwbn/
Google Researchers Say AI Models Exhibit Signs of Collective Intelligence
#AI #Google #Deepseek #Alibaba #DeepseekR1 #BigTech #AIReasoningModels #MachineLearning #AIResearch #Alphabet
-
Общество мыслей: совещание внутри LLM
DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснить просто "более длинными рассуждениями". Исследователи из Google Research и University of Chicago обнаружили нечто неожиданное: внутри reasoning-моделей происходит не монолог, а настоящее совещание — симуляция многоперспективного диалога с конфликтами, дебатами и примирением. В статье разбираем: • Почему Chain-of-Thought недостаточен для сложных задач • Что такое Society of Thought и как модели воспроизводят коллективный интеллект • Четыре ключевых паттерна conversational dynamics (вопросы, смена перспектив, конфликт, примирение) • 12 социо-эмоциональных ролей по Bales' IPA, которые возникают в рассуждениях моделей • Diversity (разнообразие) перспектив и почему разнообразие точек зрения критично для accuracy (точности) • Результаты экспериментов: activation steering, RL-обучение и transfer effects Основной вывод: reasoning-модели спонтанно научились имитировать то, что философы и психологи описывали как природу мышления — внутренний диалог между разными голосами. И это работает лучше, чем линейное рассуждение.
https://habr.com/ru/articles/987758/
#LLM #reasoning #ChainofThought #DeepSeekR1 #QwQ32B #OpenAI_o1 #искусственный_интеллект #машинное_обучение #Society_of_Thought
-
Общество мыслей: совещание внутри LLM
DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснить просто "более длинными рассуждениями". Исследователи из Google Research и University of Chicago обнаружили нечто неожиданное: внутри reasoning-моделей происходит не монолог, а настоящее совещание — симуляция многоперспективного диалога с конфликтами, дебатами и примирением. В статье разбираем: • Почему Chain-of-Thought недостаточен для сложных задач • Что такое Society of Thought и как модели воспроизводят коллективный интеллект • Четыре ключевых паттерна conversational dynamics (вопросы, смена перспектив, конфликт, примирение) • 12 социо-эмоциональных ролей по Bales' IPA, которые возникают в рассуждениях моделей • Diversity (разнообразие) перспектив и почему разнообразие точек зрения критично для accuracy (точности) • Результаты экспериментов: activation steering, RL-обучение и transfer effects Основной вывод: reasoning-модели спонтанно научились имитировать то, что философы и психологи описывали как природу мышления — внутренний диалог между разными голосами. И это работает лучше, чем линейное рассуждение.
https://habr.com/ru/articles/987758/
#LLM #reasoning #ChainofThought #DeepSeekR1 #QwQ32B #OpenAI_o1 #искусственный_интеллект #машинное_обучение #Society_of_Thought
-
Общество мыслей: совещание внутри LLM
DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснить просто "более длинными рассуждениями". Исследователи из Google Research и University of Chicago обнаружили нечто неожиданное: внутри reasoning-моделей происходит не монолог, а настоящее совещание — симуляция многоперспективного диалога с конфликтами, дебатами и примирением. В статье разбираем: • Почему Chain-of-Thought недостаточен для сложных задач • Что такое Society of Thought и как модели воспроизводят коллективный интеллект • Четыре ключевых паттерна conversational dynamics (вопросы, смена перспектив, конфликт, примирение) • 12 социо-эмоциональных ролей по Bales' IPA, которые возникают в рассуждениях моделей • Diversity (разнообразие) перспектив и почему разнообразие точек зрения критично для accuracy (точности) • Результаты экспериментов: activation steering, RL-обучение и transfer effects Основной вывод: reasoning-модели спонтанно научились имитировать то, что философы и психологи описывали как природу мышления — внутренний диалог между разными голосами. И это работает лучше, чем линейное рассуждение.
https://habr.com/ru/articles/987758/
#LLM #reasoning #ChainofThought #DeepSeekR1 #QwQ32B #OpenAI_o1 #искусственный_интеллект #машинное_обучение #Society_of_Thought
-
Общество мыслей: совещание внутри LLM DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснит...
#LLM #reasoning #Chain-of-Thought #DeepSeek-R1 #QwQ-32B #OpenAI #o1 #искусственный #интеллект #машинное #обучение
Origin | Interest | Match -
DeepSeek Reveals R1 Model Architecture Secrets Ahead of V4 Model Launch
#AI #DeepSeek #DeepSeekV4 #OpenSourceAI #ChinaAI #GenAI #DeepSeekR1 #MachineLearning #AIResearch #ReinforcementLearning
-
DeepSeek Reveals R1 Model Architecture Secrets Ahead of V4 Model Launch
#AI #DeepSeek #DeepSeekV4 #OpenSourceAI #ChinaAI #GenAI #DeepSeekR1 #MachineLearning #AIResearch #ReinforcementLearning
-
DeepSeek Reveals R1 Model Architecture Secrets Ahead of V4 Model Launch
#AI #DeepSeek #DeepSeekV4 #OpenSourceAI #ChinaAI #GenAI #DeepSeekR1 #MachineLearning #AIResearch #ReinforcementLearning
-
DeepSeek Reveals R1 Model Architecture Secrets Ahead of V4 Model Launch
#AI #DeepSeek #DeepSeekV4 #OpenSourceAI #ChinaAI #GenAI #DeepSeekR1 #MachineLearning #AIResearch #ReinforcementLearning
-
DeepSeek Reveals R1 Model Architecture Secrets Ahead of V4 Model Launch
#AI #DeepSeek #DeepSeekV4 #OpenSourceAI #ChinaAI #GenAI #DeepSeekR1 #MachineLearning #AIResearch #ReinforcementLearning
-
New benchmark results show Weibo's VibeThinker‑1.5B outperforms DeepSeek‑R1, costs just $7.8K, and matches larger models on GPQA math and code tasks—while running on edge devices. Curious how this shifts inference economics? Dive into the full analysis. #VibeThinker15B #DeepSeekR1 #GPQA #EdgeInference
🔗 https://aidailypost.com/news/weibos-vibethinker-15b-beats-deepseek-r1-usd-78k-ties-larger-models
-
New benchmark results show Weibo's VibeThinker‑1.5B outperforms DeepSeek‑R1, costs just $7.8K, and matches larger models on GPQA math and code tasks—while running on edge devices. Curious how this shifts inference economics? Dive into the full analysis. #VibeThinker15B #DeepSeekR1 #GPQA #EdgeInference
🔗 https://aidailypost.com/news/weibos-vibethinker-15b-beats-deepseek-r1-usd-78k-ties-larger-models