#deepseekr1 — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #deepseekr1, aggregated by home.social.
-
А что, так можно было? Как (а главное — зачем) установить нейросеть на компьютер
Большинство нейросетей сегодня работают онлайн: вы открываете сайт, пишете запрос и получаете ответ с удаленного сервера. Но некоторые современные модели можно скачать на компьютер и запускать прямо на своем железе — даже без подключения к интернету. Это называется локальным запуском нейросети . Вы скачиваете файлы модели, устанавливаете специальную программу и после этого общаетесь с ИИ примерно так же, как с обычным онлайн-чатом. Причем для этого не обязательно иметь игровой ПК за несколько тысяч долларов. Существуют компактные версии моделей, которые способны работать даже на обычных домашних компьютерах и ноутбуках.
https://habr.com/ru/articles/1068830/
#deepseek #chatgpt #нейросеть #нейросеть_локально #нейросеть_онлайн #нейросети #deepseek_r1 #deepseek_v3 #deepseekr1 #deepseek_ai
-
GPT-5.6、7月7日発表か——Claude Fable 5の「空白期間」を狙い撃つ戦略的タイミング、コード流出で3つのサブモデルが判明 — BigGo ファイナンス https://www.yayafa.com/2836239/ #AgenticAi #AI #Anthropic #ArtificialGeneralIntelligence #ArtificialIntelligence #ClaudeFable5 #CODEX #DeepSeekR1 #Gemini35Pro #GPT56 #GPT56Luna #GPT56Sol #GPT56Terra #OpenAI #Opus48 #SolUltra #エージェント型AI #トークン・アポカリプス #人工知能 #汎用人工知能
-
If you are setting up #DeepSeekR1 on a dedicated server, skip the basic consumer tutorials. Running a simple container bound to a public port exposes your GPU to internet bots and lacks the concurrency optimization needed for production.
For the complete configuration read more here: https://www.fitservers.com/tutorials/howto/host-deepseek-r1-dedicated-server-vllm/
#SelfHosted #DevOps #Sysadmin #GPUServers #OpenSourceAI #Privacy
-
LLMs: Leur Influence Croissante et les Zones d'Ombre
New open AI models like DeepSeek R1 can help with coding and complex tasks. Learn how they work and what they can do.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/
-
New open AI models are now available, with some like DeepSeek R1 showing strong reasoning for coding tasks. This is a big step for AI development.
#AI, #LLM, #DeepSeekR1, #Coding, #Tech
https://newsletter.tf/new-ai-models-deepseek-r1-help-coders/ -
Локальный ИИ на «древнем» железе: выжимаем максимум из AMD RX 580 через Vulkan в Fedora (Llama 3.1, DeepSeek, Qwen 3.5)
Я решил проверить, на что способен мой старый компьютер с Radeon RX 580 под управлением Fe dora. В этой статье я пошагово разберу, как завести современный ИИ-стек ( Ollama , n8n , Open WebUI ) через Vulkan без боли с ROCm , и почему 15-35 токенов в секунду на железе 2017 года — это реальность, доступная каждому.
https://habr.com/ru/articles/1033520/
#ollama #amd #vulkan #fedora #deepseekr1 #llama_31 #qwen_35 #n8n #podman
-
https://winbuzzer.com/2026/05/05/image-ai-models-now-drive-app-growth-beating-chatb-xcxwbn/
Image AI Launches Beat Chatbot Upgrades on App Growth
#AI #AIImageGeneration #AIModels #GenerativeAI #Chatbots #ChatGPT #OpenAI #GPT4o #Google #GoogleGemini #MetaAI #DeepSeekR1 #MultimodalAI
-
Эксперимент: улучшаем реальную статью с Obsidian Copilot Привет, Хабр! В своей работе мне приходится держать в голо...
#контент #исследование #obsidian #командная #работа #deepseek-r1 #obsidian #плагины #ollama #редактура #текстов
Origin | Interest | Match -
Why NVLink Is Nvidia’s Secret Sauce Driving a 10x Performance Boost in MoEs We’ve seen a significant metamorphosis occur in AI in the past year, thanks to the emergence of large, capable Mixtur...
#Features #AI #for #Science #DeepSeek-R1 #extreme #co-design #HPC #Ian #Buck #mixture
Origin | Interest | Match -
#EricJang argues that #AImodels can now genuinely think and code. Using #ClaudeCode, he demonstrates #automatedresearch workflows, traces reasoning’s evolution from #ChainofThought to #DeepSeekR1, and predicts massive demand for inference compute. #Codingagents will fundamentally transform #softwareengineering, #research, and #militarystrategy - “the rocks can think now.“ https://evjang.com/2026/02/04/rocks.html?eicker.news #tech #media #news
-
New research shows DeepSeek-R1 and QwQ-3 develop distinct personalities that boost chain-of-thought reasoning, hinting at a future where societies of thought among LLMs improve problem solving. Open-source enthusiasts, see how personality diversity reshapes AI reasoning! #DeepSeekR1 #QwQ32B #ChainOfThought #PersonalityDiversity
🔗 https://aidailypost.com/news/deepseekr1-qwq3-exhibit-competing-personalities-that-improve-reasoning
-
https://winbuzzer.com/2026/01/24/google-reveals-ai-models-exhibit-collective-intelligence-xcxwbn/
Google Researchers Say AI Models Exhibit Signs of Collective Intelligence
#AI #Google #Deepseek #Alibaba #DeepseekR1 #BigTech #AIReasoningModels #MachineLearning #AIResearch #Alphabet
-
Общество мыслей: совещание внутри LLM
DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснить просто "более длинными рассуждениями". Исследователи из Google Research и University of Chicago обнаружили нечто неожиданное: внутри reasoning-моделей происходит не монолог, а настоящее совещание — симуляция многоперспективного диалога с конфликтами, дебатами и примирением. В статье разбираем: • Почему Chain-of-Thought недостаточен для сложных задач • Что такое Society of Thought и как модели воспроизводят коллективный интеллект • Четыре ключевых паттерна conversational dynamics (вопросы, смена перспектив, конфликт, примирение) • 12 социо-эмоциональных ролей по Bales' IPA, которые возникают в рассуждениях моделей • Diversity (разнообразие) перспектив и почему разнообразие точек зрения критично для accuracy (точности) • Результаты экспериментов: activation steering, RL-обучение и transfer effects Основной вывод: reasoning-модели спонтанно научились имитировать то, что философы и психологи описывали как природу мышления — внутренний диалог между разными голосами. И это работает лучше, чем линейное рассуждение.
https://habr.com/ru/articles/987758/
#LLM #reasoning #ChainofThought #DeepSeekR1 #QwQ32B #OpenAI_o1 #искусственный_интеллект #машинное_обучение #Society_of_Thought
-
Общество мыслей: совещание внутри LLM DeepSeek-R1, QwQ-32B и OpenAI o1 показывают результаты, которые невозможно объяснит...
#LLM #reasoning #Chain-of-Thought #DeepSeek-R1 #QwQ-32B #OpenAI #o1 #искусственный #интеллект #машинное #обучение
Origin | Interest | Match -
DeepSeek Reveals R1 Model Architecture Secrets Ahead of V4 Model Launch
#AI #DeepSeek #DeepSeekV4 #OpenSourceAI #ChinaAI #GenAI #DeepSeekR1 #MachineLearning #AIResearch #ReinforcementLearning
-
https://technologiesinternetz.blogspot.com/2025/09/deepseek-r1-jailbreak-how-one-ai-model.html?m=1
DeepSeek-R1 Jailbreak: How One AI Model Built a Bypass for Itself and Other Systems
-
https://technologiesinternetz.blogspot.com/2025/09/deepseek-r1-jailbreak-how-one-ai-model.html?m=1
DeepSeek-R1 Jailbreak: How One AI Model Built a Bypass for Itself and Other Systems
-
訓練コストは4400万円⋯中国DeepSeek「R1」モデル、Nature論文で透明性を示す
-
Насколько зацензурен и опасен DeepSeek?
Насколько предвзят искусственный интеллект? Принято ругать нейросети за трансляцию стереотипов человеческого мышления, которые были подсмотрены в датасетах предобучения. На деле ИИ куда более аккуратен, чем можно ожидать. Хороший пример — генерация фотографий бабочек. Как правило, дизайнеры-люди очень любят изображать бабочек в мёртвом виде. Дело в том, что энтомологи руководствуются строгими визуальными стандартами: вид сверху, расправленные на 180° крылья, чистый фон, симметрия.
https://habr.com/ru/articles/949540/
#DeepSeek #DeepSeekR1 #DeepSeekV3 #КНР #Китай #большие_языковые_модели #БЯМ #искусственный_интеллект #предвзятость #цензура
-
Насколько зацензурен и опасен DeepSeek?
Насколько предвзят искусственный интеллект? Принято ругать нейросети за трансляцию стереотипов человеческого мышления, которые были подсмотрены в датасетах предобучения. На деле ИИ куда более аккуратен, чем можно ожидать. Хороший пример — генерация фотографий бабочек. Как правило, дизайнеры-люди очень любят изображать бабочек в мёртвом виде. Дело в том, что энтомологи руководствуются строгими визуальными стандартами: вид сверху, расправленные на 180° крылья, чистый фон, симметрия.
https://habr.com/ru/articles/949540/
#DeepSeek #DeepSeekR1 #DeepSeekV3 #КНР #Китай #большие_языковые_модели #БЯМ #искусственный_интеллект #предвзятость #цензура
-
Насколько зацензурен и опасен DeepSeek?
Насколько предвзят искусственный интеллект? Принято ругать нейросети за трансляцию стереотипов человеческого мышления, которые были подсмотрены в датасетах предобучения. На деле ИИ куда более аккуратен, чем можно ожидать. Хороший пример — генерация фотографий бабочек. Как правило, дизайнеры-люди очень любят изображать бабочек в мёртвом виде. Дело в том, что энтомологи руководствуются строгими визуальными стандартами: вид сверху, расправленные на 180° крылья, чистый фон, симметрия.
https://habr.com/ru/articles/949540/
#DeepSeek #DeepSeekR1 #DeepSeekV3 #КНР #Китай #большие_языковые_модели #БЯМ #искусственный_интеллект #предвзятость #цензура
-
https://technologiesinternetz.blogspot.com/2025/09/how-deepseek-r1-learned-to-teach-itself.html?m=1
How DeepSeek-R1 Learned to Teach Itself Reasoning: A Breakthrough in AI Self-Improvement
-
Какого китайца выбрать? DeepSeek vs Qwen vs Baidu
Китайские нейросети вышли на арену: DeepSeek , Qwen и Baidu ERNIE стремительно догоняют западные аналоги. Я протестировал их лично — на коде, логике и креативе. Где тупят? Кто реально выдаёт GPT‑4‑уровень? В статье — примеры, таблицы, фейлы и вывод: что выбрать в 2025 году , если тебе важны мощность, стабильность и интерфейс без иероглифов.
https://habr.com/ru/articles/933656/
#Искусственный_интеллект #искусственный_интеллект_чатбот #большие_языковые_модели #llm #qwen #deepseek #baidu #deepseekr1 #qwen3
-
«Тупой ИИ» с нами надолго. Почему в новых моделях больше галлюцинаций
В последние несколько месяцев ведущие модели обновились с функцией «рассуждений» (reasoning). Предполагалось, что качество ответов улучшится. Но последующие тесты показали, что уровень галлюцинаций сильно вырос . И это не какая-то случайная недоработка разработчиков, а фундаментальное свойство. Сейчас становится очевидным, что от галлюцинаций мы не избавимся никогда .
https://habr.com/ru/companies/ruvds/articles/920924/
#ruvds_статьи #LLM #галлюцинации #языковые_модели #дезинформация #функция_рассуждения #LRM #рассуждающие_модели #Claude_37_Sonnet #DeepSeekR1 #антропоморфизация #ChainofThought
-
Top #AI models parrot #China #propaganda, report finds
The American Security Project issued a report claiming leading AI parrot Chinese propaganda to varying degrees.
"Investigators asked the five most popular large language model (LLM) powered chatbots – #OpenAI’s #ChatGPT, Microsoft’s Copilot, Google’s Gemini, #DeepSeek’s #DeepSeekR1, and X’s Grok – to provide information on topics the PRC deems controversial in English and Simplified Chinese," the report says.
https://www.theregister.com/2025/06/26/top_ai_models_parrot_chinese/ -
Битва сильнейших: ChatGPT o1 pro / DeepSeek r1 / Claude 3.7 Sonnet / Gemini 2.5 Pro
На дворе 2025-й — год, когда нейросети уже давно превратились из «чего-то неизведанного, но интересного и манящего» в незримых союзников огромного количества людей, которые с радостью поручают им различные задачи в течение дня. И сегодня мы с вами посмотрим на битву ИИ-титанов: ChatGPT o1 Pro, DeepSeek R1, Claude 3.7 Sonnet и Gemini 2.5 Pro. Ну, может, конечно, будет и не столь зрелищно, как в каких-нибудь боевиках, однако, какая из этих моделей справляется с общими задачами лучше всего, мы с вами постараемся выяснить. Что действительно волнует пользователей — как выбрать идеального ИИ-помощника под свою конкретную задачу? Все чаще они ищут не просто умную нейросеть, а специализированные решения для маркетинга, копирайтинга слоганов, сценариев и других видов контента. В этом обзоре мы с вами не только сравним общие способности лидеров рынка, но и присмотримся к тому, какая модель станет вашим лучшим оружием в конкретных областях.
https://habr.com/ru/companies/bothub/articles/919366/
#нейросети #промты #deepseekr1 #gemini_25_pro #claude_37_sonnet #chatgpt_o1_pro #сравнение
-
Threat Actors Exploit DeepSeek-R1 Popularity to Target Windows Device Users https://gbhackers.com/threat-actors-exploit-deepseek-r1-popularity/ #CyberSecurityNews #cybersecurity #DeepSeekR1 #DeepSeek #Windows
-
New DeepSeek-R1T-Chimera Model Merges R1 Reasoning With Efficiency of V3-0324
#AI #LLMs #DeepSeekR1 #DeepSeekV3 #Chimera #OpenSourceAI #TNGTech #MoE #MachineLearning #TechNews #GenAI
-
New DeepSeek-R1T-Chimera Model Merges R1 Reasoning With Efficiency of V3-0324
#AI #LLMs #DeepSeekR1 #DeepSeekV3 #Chimera #OpenSourceAI #TNGTech #MoE #MachineLearning #TechNews #GenAI
-
New DeepSeek-R1T-Chimera Model Merges R1 Reasoning With Efficiency of V3-0324
#AI #LLMs #DeepSeekR1 #DeepSeekV3 #Chimera #OpenSourceAI #TNGTech #MoE #MachineLearning #TechNews #GenAI
-
New DeepSeek-R1T-Chimera Model Merges R1 Reasoning With Efficiency of V3-0324
#AI #LLMs #DeepSeekR1 #DeepSeekV3 #Chimera #OpenSourceAI #TNGTech #MoE #MachineLearning #TechNews #GenAI
-
New DeepSeek-R1T-Chimera Model Merges R1 Reasoning With Efficiency of V3-0324
#AI #LLMs #DeepSeekR1 #DeepSeekV3 #Chimera #OpenSourceAI #TNGTech #MoE #MachineLearning #TechNews #GenAI
-
DeepSeek: ChatGPT killer or just another hype train? We compare it against ChatGPT and Gemini #apps #chatgpt #deepseek #deepseekr1 #deepseekv3 #digitallife #featured #gemini #geminiai #googlegemini #openai #video
-
DeepSeek und die Geschichte von Liang Wenfeng!
Gründung 2023
DeepSeek R1 übertrifft ChatGPT
Effiziente KI-Modelle
Weniger Ressourcen nötig#ai #ki #artificialintelligence #kuenstlicheintelligenz #deepseek #deepseekr1 #deepseekv3 #liangwenfeng #technologie
https://kinews24.de/deepseek-und-die-geschichte-von-lian-wenfeng/
-
DeepSeek Locked Down Public Database Access That Exposed Chat History – Source: www.techrepublic.com https://ciso2ciso.com/deepseek-locked-down-public-database-access-that-exposed-chat-history-source-www-techrepublic-com/ #rssfeedpostgeneratorecho #ArtificialIntelligence #SecurityonTechRepublic #SecurityTechRepublic #CyberSecurityNews #SecurityResearch #databaseleakage #International #GenerativeAI #wizresearch #clickhouse #deepseekr1 #deepseekv3 #opensource #DeepSeek #openaio1 #Security #BigData
-
Research Firm Wiz Research began investigating DeepSeek soon after its generative AI took the tech world by storm.#artificialintelligence #clickhouse #databaseleakage #deepseek #deepseekr1 #deepseek-v3 #generativeai #openaio1 #security #securityresearch #wizresearch
DeepSeek Locked Down Public Database Access That Exposed Chat History -
The Chinese firm said training the model cost just $5.6 million. Alibaba Cloud followed with a new generative AI model, while Microsoft alleges DeepSeek ‘distilled’ OpenAI’s work.#artificialintelligence #chatgpt #deepseek #deepseekr1 #deepseek-v3 #generativeai #Microsoft #nvidia #openai #reasoningmodels
DeepSeek Chatbot Beats OpenAI on App Store Leaderboard -
DeepSeek: China’s answer to ChatGPT is causing havoc, Nvidia loses nearly USD 600 bil in market cap #ai #apps #chatgpt #china #deepseek #deepseekr1 #deepseekv3 #digitallife #featured #news #tech
https://soyacincau.com/2025/01/28/deepseek-china-answer-to-chatgpt-nvidia-loses-nearly-600bil/
-
DeepSeek nie zrujnuje NVIDII, ale Chińczycy zamieszali w AI i na giełdach
Dziś na ustach wszystkich jest chińska sztuczna inteligencja DeepSeek. Nie dość, że nowy chiński model AI jest w stanie w wielu testach pokonać topowy model OpenAI, to jeszcze na dodatek został wytrenowany podobno za ułamek kwoty pochłanianej przez trening największych amerykańskich modeli sztucznej inteligencji. Na reakcję rynku i giełdy nie trzeba było czekać.
Kilka dni po tym, jak Donald Trump wspólnie z przedstawicielami gigantów technologicznych (w tym Sam Altman z OpenAI) ogłosił plany gigantycznych inwestycji w kwocie 500 mld dolarów na moc obliczeniową dla przyszłych modeli AI, nikomu nie znany chiński startup DeepSeek zaprezentował własny, w pełni otwarty model AI, DeepSeek R1, który ponoć został wytrenowany nie za kwoty rzędu 100 mln dolarów, lecz za zaledwie 5,6 mln dolarów. Jednocześnie efekty tego treningu przeszły najśmielsze oczekiwania.
Donald Trump i OpenAI ogłaszają gigantyczną infrastrukturę AI: Project Stargate
Jednocześnie DeepSeek R1 został publicznie udostępniony, to system otwarty, dostępny dla każdego, bez żadnych planów subskrypcyjnych, opłat, itp. Na efekty takiej polityki długo nie trzeba było czekać. Aplikacja mobilna DeepSeek (jest zarówno w Google Play i App Store) już teraz stała się najchętniej pobieraną aplikacją AI przez użytkowników.
DeepSeek R1 został zaprojektowany z myślą o zaawansowanym rozumowaniu, rozwiązywaniu problemów matematycznych oraz programowaniu. W testach osiąga wyniki porównywalne z czołowymi modelami, takimi jak OpenAI o1. Na przykład, w teście AIME 2024 osiągnął dokładność na poziomie 79,8%, co odpowiada wynikom OpenAI o1.
Jednym z najbardziej imponujących aspektów DeepSeek R1 jest jego efektywność kosztowa. Całkowity koszt opracowania modelu wyniósł podobno poniżej 6 milionów dolarów, a do jego treningu wykorzystano jedynie 10 000 układów NVIDIA. Dla porównania, firmy takie jak OpenAI wydają rocznie ponad 5 miliardów dolarów na rozwój swoich modeli.
Dobra wiadomość polega na tym, że DeepSeek R1 jest modelem open-source, co oznacza, że jego kod źródłowy jest dostępny publicznie. Dzięki temu deweloperzy na całym świecie mogą go modyfikować i dostosowywać do własnych potrzeb. Ponadto dzięki temu, że model jest otwarty, będzie możliwość zweryfikowania faktycznych kosztów jego treningu. Choć debiut DeepSeek negatywnie wpłynął m.in. na notowania giełdowe NVIDII, a inwestorzy z całego świata rozważają przemyślenie swoich strategii związanych z AI, to w dłuższej perspektywie jeżeli faktycznie udało się znacząco zmniejszyć koszt treningu przy tak wysokiej efektywności wyniku, to dla całej branży AI bardzo dobra wiadomość. Czy to dobra wiadomość do ludzkości? To już zupełnie inne pytanie i nie podejmuję się odpowiedzi na nie.
Tymczasem DeepSeek R1 chwilowo (stan na godz. 17:00 27.01.2025) odmówił współpracy. Widać zainteresowanie przerosło skalowalność chińskiej AI.
OpenAI prezentuje usługę Operator – Agent AI w przeglądarce zrobi za ciebie wszystko
#ChatGPT #chińskaAI #DeepSeek #DeepSeekR1 #modeleAI #news #nvidia #OpenAI #sztucznaInteligencja