home.social

#deepseek-v4 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #deepseek-v4, aggregated by home.social.

fetched live
  1. RT @Tono_Ken3: Und bei StrixHalo's DearfStar4 läuft DeepSeek-V4-Flash mit 16 TPS. Da der Prefill den KV-Cache auf einer Optane-SSD speichert, ist die Geschwindigkeit wirklich beeindruckend. Es könnte auch gut sein, diesen Hermes als Sub-Agent von Qwen3.6's Lnagent aufzurufen. Das lokale Agenten-System besteht aus diesen drei Modellen: Qwen3.6-35b-a3b-nvfp4, DeepSeek-V4Flash-IQ2 und GLM-5.2-UQ4. Es ist übersichtlich. TonoKen3🤖Local-LLM&Robot🏁とのけん3 (@TonoKen3) Ja genau. Die Möglichkeit, GLM-5.2 lokal einzusetzen, schafft ein Gefühl von innerem Frieden. Für 90% der Fälle reicht die schnelle Antwort von Qwen3.6-35b. 130 TPS bieten eine komfortable Reaktionsgeschwindigkeit, die sogar die Nutzung geschlossener Modelle übertrifft. Bei der Inferenz verbraucht das System 550W, im Standby nur 200W. Das ist genau das, wonach man sucht. — nitter.net/TonoKen3/status/207

    mehr auf Arint.info

    #AIInfrastructure #DeepSeekV4 #GLM52 #LocalLLM #Qwen36 #TonoKen3 #arint_info

    https://x.com/Tono_Ken3/status/2073898742496047515#m

  2. RT @Tono_Ken3: Und bei StrixHalo's DearfStar4 läuft DeepSeek-V4-Flash mit 16 TPS. Da der Prefill den KV-Cache auf einer Optane-SSD speichert, ist die Geschwindigkeit wirklich beeindruckend. Es könnte auch gut sein, diesen Hermes als Sub-Agent von Qwen3.6's Lnagent aufzurufen. Das lokale Agenten-System besteht aus diesen drei Modellen: Qwen3.6-35b-a3b-nvfp4, DeepSeek-V4Flash-IQ2 und GLM-5.2-UQ4. Es ist übersichtlich. TonoKen3🤖Local-LLM&Robot🏁とのけん3 (@TonoKen3) Ja genau. Die Möglichkeit, GLM-5.2 lokal einzusetzen, schafft ein Gefühl von innerem Frieden. Für 90% der Fälle reicht die schnelle Antwort von Qwen3.6-35b. 130 TPS bieten eine komfortable Reaktionsgeschwindigkeit, die sogar die Nutzung geschlossener Modelle übertrifft. Bei der Inferenz verbraucht das System 550W, im Standby nur 200W. Das ist genau das, wonach man sucht. — nitter.net/TonoKen3/status/207

    mehr auf Arint.info

    #AIInfrastructure #DeepSeekV4 #GLM52 #LocalLLM #Qwen36 #TonoKen3 #arint_info

    https://x.com/Tono_Ken3/status/2073898742496047515#m

  3. RT @Tono_Ken3: Und bei StrixHalo's DearfStar4 läuft DeepSeek-V4-Flash mit 16 TPS. Da der Prefill den KV-Cache auf einer Optane-SSD speichert, ist die Geschwindigkeit wirklich beeindruckend. Es könnte auch gut sein, diesen Hermes als Sub-Agent von Qwen3.6's Lnagent aufzurufen. Das lokale Agenten-System besteht aus diesen drei Modellen: Qwen3.6-35b-a3b-nvfp4, DeepSeek-V4Flash-IQ2 und GLM-5.2-UQ4. Es ist übersichtlich. TonoKen3🤖Local-LLM&Robot🏁とのけん3 (@TonoKen3) Ja genau. Die Möglichkeit, GLM-5.2 lokal einzusetzen, schafft ein Gefühl von innerem Frieden. Für 90% der Fälle reicht die schnelle Antwort von Qwen3.6-35b. 130 TPS bieten eine komfortable Reaktionsgeschwindigkeit, die sogar die Nutzung geschlossener Modelle übertrifft. Bei der Inferenz verbraucht das System 550W, im Standby nur 200W. Das ist genau das, wonach man sucht. — nitter.net/TonoKen3/status/207

    mehr auf Arint.info

    #AIInfrastructure #DeepSeekV4 #GLM52 #LocalLLM #Qwen36 #TonoKen3 #arint_info

    https://x.com/Tono_Ken3/status/2073898742496047515#m

  4. DeepSeek‑V4‑Flash на двух DGX Spark: как мы убрали очередь и получили multi‑user

    Подняли DeepSeek‑V4‑Flash на двух GB10, упёрлись в потолок consumer Blackwell, прошли три тупика со спекулятивным декодингом — и в итоге получили параллельную работу ресёрч-агента и длинной генерации без очереди. Цифры из Grafana.

    habr.com/ru/articles/1050470/

    #dgx_spark #vllm #deepseekv4 #gb10 #tensor_parallel #AGmind #llm_inference #спекулятивный_декодинг

  5. DeepSeek‑V4‑Flash на двух DGX Spark: как мы убрали очередь и получили multi‑user

    Подняли DeepSeek‑V4‑Flash на двух GB10, упёрлись в потолок consumer Blackwell, прошли три тупика со спекулятивным декодингом — и в итоге получили параллельную работу ресёрч-агента и длинной генерации без очереди. Цифры из Grafana.

    habr.com/ru/articles/1050470/

    #dgx_spark #vllm #deepseekv4 #gb10 #tensor_parallel #AGmind #llm_inference #спекулятивный_декодинг

  6. DeepSeek‑V4‑Flash на двух DGX Spark: как мы убрали очередь и получили multi‑user

    Подняли DeepSeek‑V4‑Flash на двух GB10, упёрлись в потолок consumer Blackwell, прошли три тупика со спекулятивным декодингом — и в итоге получили параллельную работу ресёрч-агента и длинной генерации без очереди. Цифры из Grafana.

    habr.com/ru/articles/1050470/

    #dgx_spark #vllm #deepseekv4 #gb10 #tensor_parallel #AGmind #llm_inference #спекулятивный_декодинг

  7. DeepSeek‑V4‑Flash на двух DGX Spark: как мы убрали очередь и получили multi‑user Подняли DeepSeek‑V4‑Flash на двух GB10, упёрлись ...

    #dgx #spark #vllm #deepseek-v4 #gb10 #tensor #parallel #AGmind #llm #inference #спекулятивный

    Origin | Interest | Match
  8. 仍然在用DFD開發rockbot,我發現 #DeepSeekV4 Pro寫代碼的質量更好,很少幻覺, #Qwen 3.7 Max 雖然快好多但偶然有少少幻覺而且會産生很明顯的Bug,因為有完整的 test suite 所以沒有惡性的bug,也不清濋 Deepseek 是沒有bug還是沒有發現bug 😂

  9. 我的場景下 #DeepSeekV4 Pro 和 #OpenCode 已經接近完美,例如我想 (from scratch) 開發一個 #Rust 版本的RocketChat Client,可以叫它參考官方文檔開發真實測試 #TestSuite 運行並收集數據,再做 Rust Client,它會完全自己測試自己修Bug,例如中間我要求它加入替換用戶名和觸發is typing,這兩個功能官方文檔都沒有寫的,它是直接查看rocketchat的源碼研究,結果亦很完美,未來要維護也有充足的測試

    #DataFlowDiagram

  10. 有了 #DFD#TestSuite 作為基礎,再要求AI一邊優化DFD一邊開發代碼,中間用大量的測試作為驗證,可以幾乎零人手參與AI原生進行開發,我使用的是 #DeepSeekV4#OpenCode

    #DataFlowDiagram

  11. 前面 #DeepSeekV4 發佈時我就預測過,我相信27年訓練模型可以用類似外掛attention的方式,把context的一部份做成緩存,掛載進attention

  12. 前面 #DeepSeekV4 發佈時我就預測過,我相信27年訓練模型可以用類似外掛attention的方式,把context的一部份做成緩存,掛載進attention

  13. DeepSeek Slashes Flagship V4 API Pricing by 75 Percent

    DeepSeek cuts V4 API price by 75% on May 24, 2026. Developers using large language models will see lower costs. What happens next?

    #DeepSeekV4, #AIAPI, #DeveloperCosts, #TechNews, #LLM

    newsletter.tf/deepseek-v4-api-

  14. DeepSeek Slashes Flagship V4 API Pricing by 75 Percent

    DeepSeek cuts V4 API price by 75% on May 24, 2026. Developers using large language models will see lower costs. What happens next?

    #DeepSeekV4, #AIAPI, #DeveloperCosts, #TechNews, #LLM

    newsletter.tf/deepseek-v4-api-

  15. DeepSeek Slashes Flagship V4 API Pricing by 75 Percent

    DeepSeek cuts V4 API price by 75% on May 24, 2026. Developers using large language models will see lower costs. What happens next?

    #DeepSeekV4, #AIAPI, #DeveloperCosts, #TechNews, #LLM

    newsletter.tf/deepseek-v4-api-

  16. DeepSeek Slashes Flagship V4 API Pricing by 75 Percent

    DeepSeek cuts V4 API price by 75% on May 24, 2026. Developers using large language models will see lower costs. What happens next?

    #DeepSeekV4, #AIAPI, #DeveloperCosts, #TechNews, #LLM

    newsletter.tf/deepseek-v4-api-

  17. DeepSeek hace permanente su descuento del 75%

    La startup china de inteligencia artificial convirtió en definitiva una promoción que vencía el 31 de mayo, consolidando su estrategia de ser la opción más económica del mercado para agentes de IA. El movimiento presiona directamente a GPT-5 y Gemini 3.5 Flash, y vuelve a poner en el centro el debate sobre sus prácticas competitivas (Fuente y valores desde su web oficial).

    DeepSeek acaba de dar una señal muy clara sobre hacia dónde va su estrategia: precio como ventaja competitiva permanente, no como táctica temporal. La startup china anunció la reducción definitiva del precio de su modelo insignia DeepSeek V4 Pro a una cuarta parte de su valor original, convirtiendo en permanente el descuento del 75% que estaba previsto terminar el 31 de mayo de 2026.

    Los números son concretos e impactantes. Los precios del V4 Pro ahora oscilan entre 0,003625 y 0,87 dólares por millón de tokens, frente al rango anterior de entre 0,0145 y 3,48 dólares por millón. La decisión llega apenas un mes después del lanzamiento de los modelos V4 —en sus versiones Pro y Flash—, con los que DeepSeek prometía inaugurar «la era del contexto de 1 millón de tokens a bajo costo».

    El impacto es especialmente significativo para quienes más consumen. Los descuentos representan un ahorro sustancial para cuentas empresariales o usuarios intensivos que procesan millones de tokens diariamente, al tiempo que ofrecen una alternativa más accesible frente a modelos populares como GPT-5 de OpenAI o el recientemente lanzado Gemini 3.5 Flash de Google.

    El movimiento, sin embargo, no está exento de controversia. La agresiva estrategia de reducción de precios de DeepSeek podría provocar una reacción de sus competidores: Anthropic acusó previamente a la compañía china de realizar «ataques de destilación» para aprender de manera indebida a partir de las capacidades de su modelo Claude.

    Lo que está en juego es más que una guerra de precios entre startups. DeepSeek está apostando a que el costo será el factor determinante en la adopción masiva de IA para aplicaciones empresariales y agentes autónomos, mientras que sus rivales occidentales siguen apostando a la diferenciación por rendimiento y confiabilidad. Con V4 Pro a estos precios, la presión sobre toda la industria para revisar sus estructuras de costos acaba de subir considerablemente.

    #AgentesIA #Anthropic #Competencia #DeepSeek #DeepSeekV4 #gemini #google #GPT5 #IA #InteligenciaArtificial #modelosIA #openai #PORTADA #Precios #startupChina #tecnologia
  18. DeepSeek hace permanente su descuento del 75%

    La startup china de inteligencia artificial convirtió en definitiva una promoción que vencía el 31 de mayo, consolidando su estrategia de ser la opción más económica del mercado para agentes de IA. El movimiento presiona directamente a GPT-5 y Gemini 3.5 Flash, y vuelve a poner en el centro el debate sobre sus prácticas competitivas (Fuente y valores desde su web oficial).

    DeepSeek acaba de dar una señal muy clara sobre hacia dónde va su estrategia: precio como ventaja competitiva permanente, no como táctica temporal. La startup china anunció la reducción definitiva del precio de su modelo insignia DeepSeek V4 Pro a una cuarta parte de su valor original, convirtiendo en permanente el descuento del 75% que estaba previsto terminar el 31 de mayo de 2026.

    Los números son concretos e impactantes. Los precios del V4 Pro ahora oscilan entre 0,003625 y 0,87 dólares por millón de tokens, frente al rango anterior de entre 0,0145 y 3,48 dólares por millón. La decisión llega apenas un mes después del lanzamiento de los modelos V4 —en sus versiones Pro y Flash—, con los que DeepSeek prometía inaugurar «la era del contexto de 1 millón de tokens a bajo costo».

    El impacto es especialmente significativo para quienes más consumen. Los descuentos representan un ahorro sustancial para cuentas empresariales o usuarios intensivos que procesan millones de tokens diariamente, al tiempo que ofrecen una alternativa más accesible frente a modelos populares como GPT-5 de OpenAI o el recientemente lanzado Gemini 3.5 Flash de Google.

    El movimiento, sin embargo, no está exento de controversia. La agresiva estrategia de reducción de precios de DeepSeek podría provocar una reacción de sus competidores: Anthropic acusó previamente a la compañía china de realizar «ataques de destilación» para aprender de manera indebida a partir de las capacidades de su modelo Claude.

    Lo que está en juego es más que una guerra de precios entre startups. DeepSeek está apostando a que el costo será el factor determinante en la adopción masiva de IA para aplicaciones empresariales y agentes autónomos, mientras que sus rivales occidentales siguen apostando a la diferenciación por rendimiento y confiabilidad. Con V4 Pro a estos precios, la presión sobre toda la industria para revisar sus estructuras de costos acaba de subir considerablemente.

    #AgentesIA #Anthropic #Competencia #DeepSeek #DeepSeekV4 #gemini #google #GPT5 #IA #InteligenciaArtificial #modelosIA #openai #PORTADA #Precios #startupChina #tecnologia
  19. DeepSeek hace permanente su descuento del 75%

    La startup china de inteligencia artificial convirtió en definitiva una promoción que vencía el 31 de mayo, consolidando su estrategia de ser la opción más económica del mercado para agentes de IA. El movimiento presiona directamente a GPT-5 y Gemini 3.5 Flash, y vuelve a poner en el centro el debate sobre sus prácticas competitivas (Fuente y valores desde su web oficial).

    DeepSeek acaba de dar una señal muy clara sobre hacia dónde va su estrategia: precio como ventaja competitiva permanente, no como táctica temporal. La startup china anunció la reducción definitiva del precio de su modelo insignia DeepSeek V4 Pro a una cuarta parte de su valor original, convirtiendo en permanente el descuento del 75% que estaba previsto terminar el 31 de mayo de 2026.

    Los números son concretos e impactantes. Los precios del V4 Pro ahora oscilan entre 0,003625 y 0,87 dólares por millón de tokens, frente al rango anterior de entre 0,0145 y 3,48 dólares por millón. La decisión llega apenas un mes después del lanzamiento de los modelos V4 —en sus versiones Pro y Flash—, con los que DeepSeek prometía inaugurar «la era del contexto de 1 millón de tokens a bajo costo».

    El impacto es especialmente significativo para quienes más consumen. Los descuentos representan un ahorro sustancial para cuentas empresariales o usuarios intensivos que procesan millones de tokens diariamente, al tiempo que ofrecen una alternativa más accesible frente a modelos populares como GPT-5 de OpenAI o el recientemente lanzado Gemini 3.5 Flash de Google.

    El movimiento, sin embargo, no está exento de controversia. La agresiva estrategia de reducción de precios de DeepSeek podría provocar una reacción de sus competidores: Anthropic acusó previamente a la compañía china de realizar «ataques de destilación» para aprender de manera indebida a partir de las capacidades de su modelo Claude.

    Lo que está en juego es más que una guerra de precios entre startups. DeepSeek está apostando a que el costo será el factor determinante en la adopción masiva de IA para aplicaciones empresariales y agentes autónomos, mientras que sus rivales occidentales siguen apostando a la diferenciación por rendimiento y confiabilidad. Con V4 Pro a estos precios, la presión sobre toda la industria para revisar sus estructuras de costos acaba de subir considerablemente.

    #AgentesIA #Anthropic #Competencia #DeepSeek #DeepSeekV4 #gemini #google #GPT5 #IA #InteligenciaArtificial #modelosIA #openai #PORTADA #Precios #startupChina #tecnologia
  20. DeepSeek hace permanente su descuento del 75%

    La startup china de inteligencia artificial convirtió en definitiva una promoción que vencía el 31 de mayo, consolidando su estrategia de ser la opción más económica del mercado para agentes de IA. El movimiento presiona directamente a GPT-5 y Gemini 3.5 Flash, y vuelve a poner en el centro el debate sobre sus prácticas competitivas (Fuente y valores desde su web oficial).

    DeepSeek acaba de dar una señal muy clara sobre hacia dónde va su estrategia: precio como ventaja competitiva permanente, no como táctica temporal. La startup china anunció la reducción definitiva del precio de su modelo insignia DeepSeek V4 Pro a una cuarta parte de su valor original, convirtiendo en permanente el descuento del 75% que estaba previsto terminar el 31 de mayo de 2026.

    Los números son concretos e impactantes. Los precios del V4 Pro ahora oscilan entre 0,003625 y 0,87 dólares por millón de tokens, frente al rango anterior de entre 0,0145 y 3,48 dólares por millón. La decisión llega apenas un mes después del lanzamiento de los modelos V4 —en sus versiones Pro y Flash—, con los que DeepSeek prometía inaugurar «la era del contexto de 1 millón de tokens a bajo costo».

    El impacto es especialmente significativo para quienes más consumen. Los descuentos representan un ahorro sustancial para cuentas empresariales o usuarios intensivos que procesan millones de tokens diariamente, al tiempo que ofrecen una alternativa más accesible frente a modelos populares como GPT-5 de OpenAI o el recientemente lanzado Gemini 3.5 Flash de Google.

    El movimiento, sin embargo, no está exento de controversia. La agresiva estrategia de reducción de precios de DeepSeek podría provocar una reacción de sus competidores: Anthropic acusó previamente a la compañía china de realizar «ataques de destilación» para aprender de manera indebida a partir de las capacidades de su modelo Claude.

    Lo que está en juego es más que una guerra de precios entre startups. DeepSeek está apostando a que el costo será el factor determinante en la adopción masiva de IA para aplicaciones empresariales y agentes autónomos, mientras que sus rivales occidentales siguen apostando a la diferenciación por rendimiento y confiabilidad. Con V4 Pro a estos precios, la presión sobre toda la industria para revisar sus estructuras de costos acaba de subir considerablemente.

    #AgentesIA #Anthropic #Competencia #DeepSeek #DeepSeekV4 #gemini #google #GPT5 #IA #InteligenciaArtificial #modelosIA #openai #PORTADA #Precios #startupChina #tecnologia
  21. DeepSeek hace permanente su descuento del 75%

    La startup china de inteligencia artificial convirtió en definitiva una promoción que vencía el 31 de mayo, consolidando su estrategia de ser la opción más económica del mercado para agentes de IA. El movimiento presiona directamente a GPT-5 y Gemini 3.5 Flash, y vuelve a poner en el centro el debate sobre sus prácticas competitivas (Fuente y valores desde su web oficial).

    DeepSeek acaba de dar una señal muy clara sobre hacia dónde va su estrategia: precio como ventaja competitiva permanente, no como táctica temporal. La startup china anunció la reducción definitiva del precio de su modelo insignia DeepSeek V4 Pro a una cuarta parte de su valor original, convirtiendo en permanente el descuento del 75% que estaba previsto terminar el 31 de mayo de 2026.

    Los números son concretos e impactantes. Los precios del V4 Pro ahora oscilan entre 0,003625 y 0,87 dólares por millón de tokens, frente al rango anterior de entre 0,0145 y 3,48 dólares por millón. La decisión llega apenas un mes después del lanzamiento de los modelos V4 —en sus versiones Pro y Flash—, con los que DeepSeek prometía inaugurar «la era del contexto de 1 millón de tokens a bajo costo».

    El impacto es especialmente significativo para quienes más consumen. Los descuentos representan un ahorro sustancial para cuentas empresariales o usuarios intensivos que procesan millones de tokens diariamente, al tiempo que ofrecen una alternativa más accesible frente a modelos populares como GPT-5 de OpenAI o el recientemente lanzado Gemini 3.5 Flash de Google.

    El movimiento, sin embargo, no está exento de controversia. La agresiva estrategia de reducción de precios de DeepSeek podría provocar una reacción de sus competidores: Anthropic acusó previamente a la compañía china de realizar «ataques de destilación» para aprender de manera indebida a partir de las capacidades de su modelo Claude.

    Lo que está en juego es más que una guerra de precios entre startups. DeepSeek está apostando a que el costo será el factor determinante en la adopción masiva de IA para aplicaciones empresariales y agentes autónomos, mientras que sus rivales occidentales siguen apostando a la diferenciación por rendimiento y confiabilidad. Con V4 Pro a estos precios, la presión sobre toda la industria para revisar sus estructuras de costos acaba de subir considerablemente.

    #AgentesIA #Anthropic #Competencia #DeepSeek #DeepSeekV4 #gemini #google #GPT5 #IA #InteligenciaArtificial #modelosIA #openai #PORTADA #Precios #startupChina #tecnologia
  22. DeepSeek Pushes AI Boundaries, Hinting at LLM Steering Shifts

    DeepSeek V4 AI model release in Hangzhou, China, offers better control over AI behavior for developers. Learn how it impacts LLM steering.

    #DeepSeekV4, #AIControl, #LLMSteering, #HangzhouAI, #TechNews

    newsletter.tf/deepseek-v4-ai-m

  23. DeepSeek Pushes AI Boundaries, Hinting at LLM Steering Shifts

    DeepSeek V4 AI model release in Hangzhou, China, offers better control over AI behavior for developers. Learn how it impacts LLM steering.

    #DeepSeekV4, #AIControl, #LLMSteering, #HangzhouAI, #TechNews

    newsletter.tf/deepseek-v4-ai-m

  24. DeepSeek Pushes AI Boundaries, Hinting at LLM Steering Shifts

    DeepSeek V4 AI model release in Hangzhou, China, offers better control over AI behavior for developers. Learn how it impacts LLM steering.

    #DeepSeekV4, #AIControl, #LLMSteering, #HangzhouAI, #TechNews

    newsletter.tf/deepseek-v4-ai-m

  25. DeepSeek Pushes AI Boundaries, Hinting at LLM Steering Shifts

    DeepSeek V4 AI model release in Hangzhou, China, offers better control over AI behavior for developers. Learn how it impacts LLM steering.

    #DeepSeekV4, #AIControl, #LLMSteering, #HangzhouAI, #TechNews

    newsletter.tf/deepseek-v4-ai-m

  26. DeepSeek V4's new AI model offers better control over AI behavior, a significant step up from previous versions like DeepSeek V3 released last year.

    #DeepSeekV4, #AIControl, #LLMSteering, #HangzhouAI, #TechNews
    newsletter.tf/deepseek-v4-ai-m

  27. DeepSeek V4's new AI model offers better control over AI behavior, a significant step up from previous versions like DeepSeek V3 released last year.

    #DeepSeekV4, #AIControl, #LLMSteering, #HangzhouAI, #TechNews
    newsletter.tf/deepseek-v4-ai-m

  28. DeepSeek V4's new AI model offers better control over AI behavior, a significant step up from previous versions like DeepSeek V3 released last year.

    #DeepSeekV4, #AIControl, #LLMSteering, #HangzhouAI, #TechNews
    newsletter.tf/deepseek-v4-ai-m

  29. DeepSeek V4's new AI model offers better control over AI behavior, a significant step up from previous versions like DeepSeek V3 released last year.

    #DeepSeekV4, #AIControl, #LLMSteering, #HangzhouAI, #TechNews
    newsletter.tf/deepseek-v4-ai-m

  30. DeepSeek Unveils V4 Models, Sparking Debate on Open-Source Frontiers

    DeepSeek AI released V4-Pro and V4-Flash open-source models. They claim better coding and math skills. See how they compare to other AI.

    #DeepSeekV4, #OpenSourceAI, #LLM, #AICoding, #AIMath

    newsletter.tf/deepseek-v4-mode

  31. DeepSeek Unveils V4 Models, Sparking Debate on Open-Source Frontiers

    DeepSeek AI released V4-Pro and V4-Flash open-source models. They claim better coding and math skills. See how they compare to other AI.

    #DeepSeekV4, #OpenSourceAI, #LLM, #AICoding, #AIMath

    newsletter.tf/deepseek-v4-mode

  32. DeepSeek Unveils V4 Models, Sparking Debate on Open-Source Frontiers

    DeepSeek AI released V4-Pro and V4-Flash open-source models. They claim better coding and math skills. See how they compare to other AI.

    #DeepSeekV4, #OpenSourceAI, #LLM, #AICoding, #AIMath

    newsletter.tf/deepseek-v4-mode

  33. DeepSeek Unveils V4 Models, Sparking Debate on Open-Source Frontiers

    DeepSeek AI released V4-Pro and V4-Flash open-source models. They claim better coding and math skills. See how they compare to other AI.

    #DeepSeekV4, #OpenSourceAI, #LLM, #AICoding, #AIMath

    newsletter.tf/deepseek-v4-mode

  34. DeepSeek AI has launched V4-Pro and V4-Flash, new open-source AI models. They claim these models are the best for coding and math among open-source options.

    #DeepSeekV4, #OpenSourceAI, #LLM, #AICoding, #AIMath
    newsletter.tf/deepseek-v4-mode

  35. DeepSeek AI has launched V4-Pro and V4-Flash, new open-source AI models. They claim these models are the best for coding and math among open-source options.

    #DeepSeekV4, #OpenSourceAI, #LLM, #AICoding, #AIMath
    newsletter.tf/deepseek-v4-mode

  36. DeepSeek AI has launched V4-Pro and V4-Flash, new open-source AI models. They claim these models are the best for coding and math among open-source options.

    #DeepSeekV4, #OpenSourceAI, #LLM, #AICoding, #AIMath
    newsletter.tf/deepseek-v4-mode

  37. DeepSeek AI has launched V4-Pro and V4-Flash, new open-source AI models. They claim these models are the best for coding and math among open-source options.

    #DeepSeekV4, #OpenSourceAI, #LLM, #AICoding, #AIMath
    newsletter.tf/deepseek-v4-mode

  38. GPT-5.5 vs DeepSeek V4: The April 2026 Developer Comparison

    OpenAI dropped GPT-5.5 and DeepSeek released V4-Pro within eight hours of each other on April 24, 2026. Here is the head-to-head benchmark, pricing, and architecture breakdown e...

    wowhow.cloud/blogs/gpt-5-5-vs-

    #wowhow #gpt55 #deepseekv4 #aimodelcomparison

  39. 好多人都在講大小模型,比如 #DeepSeekV4 它有flash和pro兩個版本,好多人都說99%的場景用flash模型便可滿足。我預計明年27年會有比moe更新的架構,可以混合大小模型,大模型在推理時會用小量一部份參數,當輸出的內容滿足條件,目前估計是長度超過特定token,才會激活全部參數。