home.social

#deepseek-r1 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #deepseek-r1, aggregated by home.social.

fetched live
  1. А что, так можно было? Как (а главное — зачем) установить нейросеть на компьютер

    Большинство нейросетей сегодня работают онлайн: вы открываете сайт, пишете запрос и получаете ответ с удаленного сервера. Но некоторые современные модели можно скачать на компьютер и запускать прямо на своем железе — даже без подключения к интернету. Это называется локальным запуском нейросети . Вы скачиваете файлы модели, устанавливаете специальную программу и после этого общаетесь с ИИ примерно так же, как с обычным онлайн-чатом. Причем для этого не обязательно иметь игровой ПК за несколько тысяч долларов. Существуют компактные версии моделей, которые способны работать даже на обычных домашних компьютерах и ноутбуках.

    habr.com/ru/articles/1068830/

    #deepseek #chatgpt #нейросеть #нейросеть_локально #нейросеть_онлайн #нейросети #deepseek_r1 #deepseek_v3 #deepseekr1 #deepseek_ai

  2. А что, так можно было? Как (а главное — зачем) установить нейросеть на компьютер

    Большинство нейросетей сегодня работают онлайн: вы открываете сайт, пишете запрос и получаете ответ с удаленного сервера. Но некоторые современные модели можно скачать на компьютер и запускать прямо на своем железе — даже без подключения к интернету. Это называется локальным запуском нейросети . Вы скачиваете файлы модели, устанавливаете специальную программу и после этого общаетесь с ИИ примерно так же, как с обычным онлайн-чатом. Причем для этого не обязательно иметь игровой ПК за несколько тысяч долларов. Существуют компактные версии моделей, которые способны работать даже на обычных домашних компьютерах и ноутбуках.

    habr.com/ru/articles/1068830/

    #deepseek #chatgpt #нейросеть #нейросеть_локально #нейросеть_онлайн #нейросети #deepseek_r1 #deepseek_v3 #deepseekr1 #deepseek_ai

  3. А что, так можно было? Как (а главное — зачем) установить нейросеть на компьютер

    Большинство нейросетей сегодня работают онлайн: вы открываете сайт, пишете запрос и получаете ответ с удаленного сервера. Но некоторые современные модели можно скачать на компьютер и запускать прямо на своем железе — даже без подключения к интернету. Это называется локальным запуском нейросети . Вы скачиваете файлы модели, устанавливаете специальную программу и после этого общаетесь с ИИ примерно так же, как с обычным онлайн-чатом. Причем для этого не обязательно иметь игровой ПК за несколько тысяч долларов. Существуют компактные версии моделей, которые способны работать даже на обычных домашних компьютерах и ноутбуках.

    habr.com/ru/articles/1068830/

    #deepseek #chatgpt #нейросеть #нейросеть_локально #нейросеть_онлайн #нейросети #deepseek_r1 #deepseek_v3 #deepseekr1 #deepseek_ai

  4. If you are setting up #DeepSeekR1 on a dedicated server, skip the basic consumer tutorials. Running a simple container bound to a public port exposes your GPU to internet bots and lacks the concurrency optimization needed for production.

    For the complete configuration read more here: fitservers.com/tutorials/howto

    #SelfHosted #DevOps #Sysadmin #GPUServers #OpenSourceAI #Privacy

  5. LLMs: Leur Influence Croissante et les Zones d'Ombre

    New open AI models like DeepSeek R1 can help with coding and complex tasks. Learn how they work and what they can do.

    #AI, #LLM, #DeepSeekR1, #Coding, #Tech

    newsletter.tf/new-ai-models-de

  6. LLMs: Leur Influence Croissante et les Zones d'Ombre

    New open AI models like DeepSeek R1 can help with coding and complex tasks. Learn how they work and what they can do.

    #AI, #LLM, #DeepSeekR1, #Coding, #Tech

    newsletter.tf/new-ai-models-de

  7. New open AI models are now available, with some like DeepSeek R1 showing strong reasoning for coding tasks. This is a big step for AI development.

    #AI, #LLM, #DeepSeekR1, #Coding, #Tech
    newsletter.tf/new-ai-models-de

  8. New open AI models are now available, with some like DeepSeek R1 showing strong reasoning for coding tasks. This is a big step for AI development.

    #AI, #LLM, #DeepSeekR1, #Coding, #Tech
    newsletter.tf/new-ai-models-de

  9. Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5)

    Я решил проверить, на что способен мой старый компьютер с Radeon RX 580 под управлением Fe dora. В этой статье я пошагово разберу, как завести современный ИИ-стек ( Ollama , n8n , Open WebUI ) через Vulkan без боли с ROCm , и почему 15-35 токенов в секунду на железе 2017 года — это реальность, доступная каждому.

    habr.com/ru/articles/1033520/

    #ollama #amd #vulkan #fedora #deepseekr1 #llama_31 #qwen_35 #n8n #podman

  10. Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5)

    Я решил проверить, на что способен мой старый компьютер с Radeon RX 580 под управлением Fe dora. В этой статье я пошагово разберу, как завести современный ИИ-стек ( Ollama , n8n , Open WebUI ) через Vulkan без боли с ROCm , и почему 15-35 токенов в секунду на железе 2017 года — это реальность, доступная каждому.

    habr.com/ru/articles/1033520/

    #ollama #amd #vulkan #fedora #deepseekr1 #llama_31 #qwen_35 #n8n #podman

  11. Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5)

    Я решил проверить, на что способен мой старый компьютер с Radeon RX 580 под управлением Fe dora. В этой статье я пошагово разберу, как завести современный ИИ-стек ( Ollama , n8n , Open WebUI ) через Vulkan без боли с ROCm , и почему 15-35 токенов в секунду на железе 2017 года — это реальность, доступная каждому.

    habr.com/ru/articles/1033520/

    #ollama #amd #vulkan #fedora #deepseekr1 #llama_31 #qwen_35 #n8n #podman

  12. Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5) Я решил прове...

    #ollama #amd #vulkan #fedora #deepseek-r1 #llama #3.1 #qwen #3.5 #n8n #podman

    Origin | Interest | Match
  13. Эксперимент: улучшаем реальную статью с Obsidian Copilot Привет, Хабр! В своей работе мне приходится держать в голо...

    #контент #исследование #obsidian #командная #работа #deepseek-r1 #obsidian #плагины #ollama #редактура #текстов

    Origin | Interest | Match
  14. Why NVLink Is Nvidia’s Secret Sauce Driving a 10x Performance Boost in MoEs We’ve seen a significant metamorphosis occur in AI in the past year, thanks to the emergence of large, capable Mixtur...

    #Features #AI #for #Science #DeepSeek-R1 #extreme #co-design #HPC #Ian #Buck #mixture

    Origin | Interest | Match
  15. OpenAI 控 DeepSeek 利用蒸餾挑戰美國 AI 優勢,美中科技戰再升級 OpenAI 指控中國人工智慧公司 DeepSeek 利用不公平手法,以所謂「蒸餾」技術提取美國先...

    #AI #人工智慧 #中國觀察 #國際觀察 #DeepSeek #DeepSeek-R1 #OpenAI #QuitGPT #科技戰 #美中衝突 #蒸餾

    Origin | Interest | Match
  16. #EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“​​​​​​​​​​​​​​​​ evjang.com/2026/02/04/rocks.ht #tech #media #news

  17. #EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“​​​​​​​​​​​​​​​​ evjang.com/2026/02/04/rocks.ht #tech #media #news

  18. #EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“​​​​​​​​​​​​​​​​ evjang.com/2026/02/04/rocks.ht #tech #media #news

  19. New research shows DeepSeek-R1 and QwQ-3 develop distinct personalities that boost chain-of-thought reasoning, hinting at a future where societies of thought among LLMs improve problem solving. Open-source enthusiasts, see how personality diversity reshapes AI reasoning! #DeepSeekR1 #QwQ32B #ChainOfThought #PersonalityDiversity

    🔗 aidailypost.com/news/deepseekr

  20. New research shows DeepSeek-R1 and QwQ-3 develop distinct personalities that boost chain-of-thought reasoning, hinting at a future where societies of thought among LLMs improve problem solving. Open-source enthusiasts, see how personality diversity reshapes AI reasoning! #DeepSeekR1 #QwQ32B #ChainOfThought #PersonalityDiversity

    🔗 aidailypost.com/news/deepseekr

  21. Общество мыслей: совещание внутри LLM

    DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснить просто "более длинными рассуждениями". Исследователи из Google Research и University of Chicago обнаружили нечто неожиданное: внутри reasoning-моделей происходит не монолог, а настоящее совещание — симуляция многоперспективного диалога с конфликтами, дебатами и примирением. В статье разбираем: • Почему Chain-of-Thought недостаточен для сложных задач • Что такое Society of Thought и как модели воспроизводят коллективный интеллект • Четыре ключевых паттерна conversational dynamics (вопросы, смена перспектив, конфликт, примирение) • 12 социо-эмоциональных ролей по Bales' IPA, которые возникают в рассуждениях моделей • Diversity (разнообразие) перспектив и почему разнообразие точек зрения критично для accuracy (точности) • Результаты экспериментов: activation steering, RL-обучение и transfer effects Основной вывод: reasoning-модели спонтанно научились имитировать то, что философы и психологи описывали как природу мышления — внутренний диалог между разными голосами. И это работает лучше, чем линейное рассуждение.

    habr.com/ru/articles/987758/

    #LLM #reasoning #ChainofThought #DeepSeekR1 #QwQ32B #OpenAI_o1 #искусственный_интеллект #машинное_обучение #Society_of_Thought

  22. Общество мыслей: совещание внутри LLM

    DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснить просто "более длинными рассуждениями". Исследователи из Google Research и University of Chicago обнаружили нечто неожиданное: внутри reasoning-моделей происходит не монолог, а настоящее совещание — симуляция многоперспективного диалога с конфликтами, дебатами и примирением. В статье разбираем: • Почему Chain-of-Thought недостаточен для сложных задач • Что такое Society of Thought и как модели воспроизводят коллективный интеллект • Четыре ключевых паттерна conversational dynamics (вопросы, смена перспектив, конфликт, примирение) • 12 социо-эмоциональных ролей по Bales' IPA, которые возникают в рассуждениях моделей • Diversity (разнообразие) перспектив и почему разнообразие точек зрения критично для accuracy (точности) • Результаты экспериментов: activation steering, RL-обучение и transfer effects Основной вывод: reasoning-модели спонтанно научились имитировать то, что философы и психологи описывали как природу мышления — внутренний диалог между разными голосами. И это работает лучше, чем линейное рассуждение.

    habr.com/ru/articles/987758/

    #LLM #reasoning #ChainofThought #DeepSeekR1 #QwQ32B #OpenAI_o1 #искусственный_интеллект #машинное_обучение #Society_of_Thought

  23. Общество мыслей: совещание внутри LLM

    DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснить просто "более длинными рассуждениями". Исследователи из Google Research и University of Chicago обнаружили нечто неожиданное: внутри reasoning-моделей происходит не монолог, а настоящее совещание — симуляция многоперспективного диалога с конфликтами, дебатами и примирением. В статье разбираем: • Почему Chain-of-Thought недостаточен для сложных задач • Что такое Society of Thought и как модели воспроизводят коллективный интеллект • Четыре ключевых паттерна conversational dynamics (вопросы, смена перспектив, конфликт, примирение) • 12 социо-эмоциональных ролей по Bales' IPA, которые возникают в рассуждениях моделей • Diversity (разнообразие) перспектив и почему разнообразие точек зрения критично для accuracy (точности) • Результаты экспериментов: activation steering, RL-обучение и transfer effects Основной вывод: reasoning-модели спонтанно научились имитировать то, что философы и психологи описывали как природу мышления — внутренний диалог между разными голосами. И это работает лучше, чем линейное рассуждение.

    habr.com/ru/articles/987758/

    #LLM #reasoning #ChainofThought #DeepSeekR1 #QwQ32B #OpenAI_o1 #искусственный_интеллект #машинное_обучение #Society_of_Thought

  24. Общество мыслей: совещание внутри LLM DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснит...

    #LLM #reasoning #Chain-of-Thought #DeepSeek-R1 #QwQ-32B #OpenAI #o1 #искусственный #интеллект #машинное #обучение

    Origin | Interest | Match
  25. New benchmark results show Weibo's VibeThinker‑1.5B outperforms DeepSeek‑R1, costs just $7.8K, and matches larger models on GPQA math and code tasks—while running on edge devices. Curious how this shifts inference economics? Dive into the full analysis. #VibeThinker15B #DeepSeekR1 #GPQA #EdgeInference

    🔗 aidailypost.com/news/weibos-vi

  26. is there any way to obtain a useful and fast local llm for agentic coding on 8GB VRAM (RTX 3060 TI)?

    I tried #gemma3 4b, #deepseekr1 7b, #phi4mini and #qwen3 4b using #Ollama with #Cline but got poor results

    #localllm #agenticai

  27. is there any way to obtain a useful and fast local llm for agentic coding on 8GB VRAM (RTX 3060 TI)?

    I tried #gemma3 4b, #deepseekr1 7b, #phi4mini and #qwen3 4b using #Ollama with #Cline but got poor results

    #localllm #agenticai

  28. is there any way to obtain a useful and fast local llm for agentic coding on 8GB VRAM (RTX 3060 TI)?

    I tried #gemma3 4b, #deepseekr1 7b, #phi4mini and #qwen3 4b using #Ollama with #Cline but got poor results

    #localllm #agenticai

  29. Насколько зацензурен и опасен DeepSeek?

    Насколько предвзят искусственный интеллект? Принято ругать нейросети за трансляцию стереотипов человеческого мышления, которые были подсмотрены в датасетах предобучения. На деле ИИ куда более аккуратен, чем можно ожидать. Хороший пример — генерация фотографий бабочек. Как правило, дизайнеры-люди очень любят изображать бабочек в мёртвом виде. Дело в том, что энтомологи руководствуются строгими визуальными стандартами: вид сверху, расправленные на 180° крылья, чистый фон, симметрия.

    habr.com/ru/articles/949540/

    #DeepSeek #DeepSeekR1 #DeepSeekV3 #КНР #Китай #большие_языковые_модели #БЯМ #искусственный_интеллект #предвзятость #цензура

  30. Насколько зацензурен и опасен DeepSeek?

    Насколько предвзят искусственный интеллект? Принято ругать нейросети за трансляцию стереотипов человеческого мышления, которые были подсмотрены в датасетах предобучения. На деле ИИ куда более аккуратен, чем можно ожидать. Хороший пример — генерация фотографий бабочек. Как правило, дизайнеры-люди очень любят изображать бабочек в мёртвом виде. Дело в том, что энтомологи руководствуются строгими визуальными стандартами: вид сверху, расправленные на 180° крылья, чистый фон, симметрия.

    habr.com/ru/articles/949540/

    #DeepSeek #DeepSeekR1 #DeepSeekV3 #КНР #Китай #большие_языковые_модели #БЯМ #искусственный_интеллект #предвзятость #цензура

  31. Насколько зацензурен и опасен DeepSeek?

    Насколько предвзят искусственный интеллект? Принято ругать нейросети за трансляцию стереотипов человеческого мышления, которые были подсмотрены в датасетах предобучения. На деле ИИ куда более аккуратен, чем можно ожидать. Хороший пример — генерация фотографий бабочек. Как правило, дизайнеры-люди очень любят изображать бабочек в мёртвом виде. Дело в том, что энтомологи руководствуются строгими визуальными стандартами: вид сверху, расправленные на 180° крылья, чистый фон, симметрия.

    habr.com/ru/articles/949540/

    #DeepSeek #DeepSeekR1 #DeepSeekV3 #КНР #Китай #большие_языковые_модели #БЯМ #искусственный_интеллект #предвзятость #цензура

  32. Какого китайца выбрать? DeepSeek vs Qwen vs Baidu

    Китайские нейросети вышли на арену: DeepSeek , Qwen и Baidu ERNIE стремительно догоняют западные аналоги. Я протестировал их лично — на коде, логике и креативе. Где тупят? Кто реально выдаёт GPT‑4‑уровень? В статье — примеры, таблицы, фейлы и вывод: что выбрать в 2025 году , если тебе важны мощность, стабильность и интерфейс без иероглифов.

    habr.com/ru/articles/933656/

    #Искусственный_интеллект #искусственный_интеллект_чатбот #большие_языковые_модели #llm #qwen #deepseek #baidu #deepseekr1 #qwen3

  33. Какого китайца выбрать? DeepSeek vs Qwen vs Baidu

    Китайские нейросети вышли на арену: DeepSeek , Qwen и Baidu ERNIE стремительно догоняют западные аналоги. Я протестировал их лично — на коде, логике и креативе. Где тупят? Кто реально выдаёт GPT‑4‑уровень? В статье — примеры, таблицы, фейлы и вывод: что выбрать в 2025 году , если тебе важны мощность, стабильность и интерфейс без иероглифов.

    habr.com/ru/articles/933656/

    #Искусственный_интеллект #искусственный_интеллект_чатбот #большие_языковые_модели #llm #qwen #deepseek #baidu #deepseekr1 #qwen3

  34. Какого китайца выбрать? DeepSeek vs Qwen vs Baidu

    Китайские нейросети вышли на арену: DeepSeek , Qwen и Baidu ERNIE стремительно догоняют западные аналоги. Я протестировал их лично — на коде, логике и креативе. Где тупят? Кто реально выдаёт GPT‑4‑уровень? В статье — примеры, таблицы, фейлы и вывод: что выбрать в 2025 году , если тебе важны мощность, стабильность и интерфейс без иероглифов.

    habr.com/ru/articles/933656/

    #Искусственный_интеллект #искусственный_интеллект_чатбот #большие_языковые_модели #llm #qwen #deepseek #baidu #deepseekr1 #qwen3

  35. 劍星打完三個結局,仍在白金路上,代碼同步繼續。今次換了 #DeepSeekR1 智能直線上升,2025年手敲代碼已經沒有意義了

    github.com/cosmoswafer/advent-

    #AdventOfCode #AdventOfCode2024