home.social

#sm121 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #sm121, aggregated by home.social.

fetched live
  1. RT @mr_r0b0t: vLLM v0.27.0 ist gerade veröffentlicht worden, und diese Version ist wirklich umfangreich! 🚀 Highlights umfassen: • Vollständiges Full-Stack-Kimi-K3-Unterstützung • Qwen3.5-dichte und MoE-Unterstützung • Wesentliche DeepSeek-V4-Kernel-, TTFT- und Speicheroptimierungen • Fehlertoleranz für große DP + EP-Bereitstellungen • Erweiterte Präfill/Decode-Disaggregation • Rubin SM107 und ROCm gfx1250-Enabling • Model Runner V2 erweitert sich über die Generierung hinaus • Inkling NVFP4-Checkpoint-Unterstützung Es gibt auch einen wichtigen SM121-Fix für die CUDA-Architekturerkennung, der zuvor kernellose Builds produzieren konnte 👀👀 Eine Warnung vor dem Upgrade: v0.27.0 wechselt zu PyTorch 2.13 und Triton 3.7.1, was eine umwälzende Umgebungsänderung darstellt ⚠️ Release Notes: github.com/vllm-project/vllm/r

    mehr auf Arint.info

    #CUDA #DeepSeekV4 #PyTorch213 #SM121 #Triton371 #vLLM #arint_info

    https://x.com/mr_r0b0t/status/2087177620769120343#m

  2. RT @mr_r0b0t: vLLM v0.27.0 ist gerade veröffentlicht worden, und diese Version ist wirklich umfangreich! 🚀 Highlights umfassen: • Vollständiges Full-Stack-Kimi-K3-Unterstützung • Qwen3.5-dichte und MoE-Unterstützung • Wesentliche DeepSeek-V4-Kernel-, TTFT- und Speicheroptimierungen • Fehlertoleranz für große DP + EP-Bereitstellungen • Erweiterte Präfill/Decode-Disaggregation • Rubin SM107 und ROCm gfx1250-Enabling • Model Runner V2 erweitert sich über die Generierung hinaus • Inkling NVFP4-Checkpoint-Unterstützung Es gibt auch einen wichtigen SM121-Fix für die CUDA-Architekturerkennung, der zuvor kernellose Builds produzieren konnte 👀👀 Eine Warnung vor dem Upgrade: v0.27.0 wechselt zu PyTorch 2.13 und Triton 3.7.1, was eine umwälzende Umgebungsänderung darstellt ⚠️ Release Notes: github.com/vllm-project/vllm/r

    mehr auf Arint.info

    #CUDA #DeepSeekV4 #PyTorch213 #SM121 #Triton371 #vLLM #arint_info

    https://x.com/mr_r0b0t/status/2087177620769120343#m

  3. RT @mr_r0b0t: vLLM v0.27.0 ist gerade veröffentlicht worden, und diese Version ist wirklich umfangreich! 🚀 Highlights umfassen: • Vollständiges Full-Stack-Kimi-K3-Unterstützung • Qwen3.5-dichte und MoE-Unterstützung • Wesentliche DeepSeek-V4-Kernel-, TTFT- und Speicheroptimierungen • Fehlertoleranz für große DP + EP-Bereitstellungen • Erweiterte Präfill/Decode-Disaggregation • Rubin SM107 und ROCm gfx1250-Enabling • Model Runner V2 erweitert sich über die Generierung hinaus • Inkling NVFP4-Checkpoint-Unterstützung Es gibt auch einen wichtigen SM121-Fix für die CUDA-Architekturerkennung, der zuvor kernellose Builds produzieren konnte 👀👀 Eine Warnung vor dem Upgrade: v0.27.0 wechselt zu PyTorch 2.13 und Triton 3.7.1, was eine umwälzende Umgebungsänderung darstellt ⚠️ Release Notes: github.com/vllm-project/vllm/r

    mehr auf Arint.info

    #CUDA #DeepSeekV4 #PyTorch213 #SM121 #Triton371 #vLLM #arint_info

    https://x.com/mr_r0b0t/status/2087177620769120343#m