home.social

#gptoss120b — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #gptoss120b, aggregated by home.social.

fetched live
  1. OpenAI just opened the doors to its massive Mixture‑of‑Experts models: gpt‑oss‑120B and gpt‑oss‑20B, both released under an Apache‑2.0‑style license. This means the weights are publicly available for anyone to fine‑tune, audit, or build on. A big step for open‑weight AI research—read more to see what this could mean for the community. #OpenAI #gptoss120B #gptoss20B #Apache2.0

    🔗 aidailypost.com/news/openai-re

  2. OpenAI just opened the doors to its massive Mixture‑of‑Experts models: gpt‑oss‑120B and gpt‑oss‑20B, both released under an Apache‑2.0‑style license. This means the weights are publicly available for anyone to fine‑tune, audit, or build on. A big step for open‑weight AI research—read more to see what this could mean for the community. #OpenAI #gptoss120B #gptoss20B #Apache2.0

    🔗 aidailypost.com/news/openai-re

  3. OpenAI just opened the doors to its massive Mixture‑of‑Experts models: gpt‑oss‑120B and gpt‑oss‑20B, both released under an Apache‑2.0‑style license. This means the weights are publicly available for anyone to fine‑tune, audit, or build on. A big step for open‑weight AI research—read more to see what this could mean for the community. #OpenAI #gptoss120B #gptoss20B #Apache2.0

    🔗 aidailypost.com/news/openai-re

  4. OpenAI just opened the doors to its massive Mixture‑of‑Experts models: gpt‑oss‑120B and gpt‑oss‑20B, both released under an Apache‑2.0‑style license. This means the weights are publicly available for anyone to fine‑tune, audit, or build on. A big step for open‑weight AI research—read more to see what this could mean for the community. #OpenAI #gptoss120B #gptoss20B #Apache2.0

    🔗 aidailypost.com/news/openai-re

  5. Вам нужна RAM, а не VRAM. Параметр -cmoe для запуска больших и огромных моделей LLM локально. Ускоряем GPT-OSS-120B

    Всё больше выходит больших MoE моделей с малым числом активных параметров. У MoE совсем другой сценарий нагрузки и использования ресурсов нежели у Dense моделей, достаточно немного VRAM. Большие MoE модели устроит 1 GPU и много обычной RAM. О том, как устроены MoE и как ускорить работу одним параметром не меняя железо.

    habr.com/ru/articles/961478/

    #llamacpp #cmoe #локальные_нейросети #gptoss120b #gptoss #cpumoe #qwen3 #deepseek #llm

  6. Вам нужна RAM, а не VRAM. Параметр -cmoe для запуска больших и огромных моделей LLM локально. Ускоряем GPT-OSS-120B

    Всё больше выходит больших MoE моделей с малым числом активных параметров. У MoE совсем другой сценарий нагрузки и использования ресурсов нежели у Dense моделей, достаточно немного VRAM. Большие MoE модели устроит 1 GPU и много обычной RAM. О том, как устроены MoE и как ускорить работу одним параметром не меняя железо.

    habr.com/ru/articles/961478/

    #llamacpp #cmoe #локальные_нейросети #gptoss120b #gptoss #cpumoe #qwen3 #deepseek #llm

  7. Вам нужна RAM, а не VRAM. Параметр -cmoe для запуска больших и огромных моделей LLM локально. Ускоряем GPT-OSS-120B

    Всё больше выходит больших MoE моделей с малым числом активных параметров. У MoE совсем другой сценарий нагрузки и использования ресурсов нежели у Dense моделей, достаточно немного VRAM. Большие MoE модели устроит 1 GPU и много обычной RAM. О том, как устроены MoE и как ускорить работу одним параметром не меняя железо.

    habr.com/ru/articles/961478/

    #llamacpp #cmoe #локальные_нейросети #gptoss120b #gptoss #cpumoe #qwen3 #deepseek #llm

  8. "Bạn đang chạy mô hình GPT-oss-120b trên MacBook Pro M4 128GB không? Thông qua cho biết nhé! 😊 Đang cân nhắc mua, muốn kiểm tra performance. #GPToss120b #MacBookProM4 #MôHìnhỐcT mẫu #MacBookProM4"

    reddit.com/r/LocalLLaMA/commen

  9. When modern meet history, I have written for my work linux terminal chat terminal with support (yep they were introduced in 1979). is hosted with and client is written with python and Microsoft Autogen. For graphics output I am using libsixel-tools and all that is wrapped with Rich library. Python code is executed in container. Btw all that is running on HP ZBook Ultra G1a 14 laptop. Yep I know it is just 500 lines of glue code.

  10. When modern meet history, I have written for my work linux terminal #AI chat terminal with #sixel support (yep they were introduced in 1979). #gptoss120b is hosted with #llamacpp and client is written with python and Microsoft Autogen. For graphics output I am using libsixel-tools and all that is wrapped with Rich library. Python code is executed in #podman container. Btw all that is running on HP ZBook Ultra G1a 14 laptop. Yep I know it is just 500 lines of glue code.

  11. When modern meet history, I have written for my work linux terminal #AI chat terminal with #sixel support (yep they were introduced in 1979). #gptoss120b is hosted with #llamacpp and client is written with python and Microsoft Autogen. For graphics output I am using libsixel-tools and all that is wrapped with Rich library. Python code is executed in #podman container. Btw all that is running on HP ZBook Ultra G1a 14 laptop. Yep I know it is just 500 lines of glue code.

  12. When modern meet history, I have written for my work linux terminal #AI chat terminal with #sixel support (yep they were introduced in 1979). #gptoss120b is hosted with #llamacpp and client is written with python and Microsoft Autogen. For graphics output I am using libsixel-tools and all that is wrapped with Rich library. Python code is executed in #podman container. Btw all that is running on HP ZBook Ultra G1a 14 laptop. Yep I know it is just 500 lines of glue code.

  13. GPT-OSS-20B / 120B: Сухие цифры после реальных тестов

    GPT-OSS - тесты на реальном железе: производительность моделей 20B и 120B на RTX 4090, RTX 5090 и H100. Реальные метрики TPS, сравнение скорости генерации и практические выводы о том, какую модель выбрать для локального использования.

    habr.com/ru/articles/938960/

    #GPTOSS20B #GPTOSS120B #TPS_токены_в_секунду #RTX_4090_vs_RTX_5090 #Ollama #H100_PCIe #llm #локальная_LLM #VRAM_использование #vllm

  14. GPT-OSS-20B / 120B: Сухие цифры после реальных тестов

    GPT-OSS - тесты на реальном железе: производительность моделей 20B и 120B на RTX 4090, RTX 5090 и H100. Реальные метрики TPS, сравнение скорости генерации и практические выводы о том, какую модель выбрать для локального использования.

    habr.com/ru/articles/938960/

    #GPTOSS20B #GPTOSS120B #TPS_токены_в_секунду #RTX_4090_vs_RTX_5090 #Ollama #H100_PCIe #llm #локальная_LLM #VRAM_использование #vllm

  15. GPT-OSS-20B / 120B: Сухие цифры после реальных тестов

    GPT-OSS - тесты на реальном железе: производительность моделей 20B и 120B на RTX 4090, RTX 5090 и H100. Реальные метрики TPS, сравнение скорости генерации и практические выводы о том, какую модель выбрать для локального использования.

    habr.com/ru/articles/938960/

    #GPTOSS20B #GPTOSS120B #TPS_токены_в_секунду #RTX_4090_vs_RTX_5090 #Ollama #H100_PCIe #llm #локальная_LLM #VRAM_использование #vllm

  16. IONOS AI Model Hub bietet GPT-OSS-120B von OpenAI – DSGVO-konform, in Deutschland gehostet, mit OpenAI-API-Kompatibilität.

    ionos.blog/ionos-ai-model-hub/

    #KI #OpenAI #DSGVO #digitalesouveranitat #ionos #gptoss #gptoss120b

  17. IONOS AI Model Hub bietet GPT-OSS-120B von OpenAI – DSGVO-konform, in Deutschland gehostet, mit OpenAI-API-Kompatibilität.

    ionos.blog/ionos-ai-model-hub/

    #KI #OpenAI #DSGVO #digitalesouveranitat #ionos #gptoss #gptoss120b

  18. IONOS AI Model Hub bietet GPT-OSS-120B von OpenAI – DSGVO-konform, in Deutschland gehostet, mit OpenAI-API-Kompatibilität.

    ionos.blog/ionos-ai-model-hub/

    #KI #OpenAI #DSGVO #digitalesouveranitat #ionos #gptoss #gptoss120b

  19. IONOS AI Model Hub bietet GPT-OSS-120B von OpenAI – DSGVO-konform, in Deutschland gehostet, mit OpenAI-API-Kompatibilität.

    ionos.blog/ionos-ai-model-hub/

    #KI #OpenAI #DSGVO #digitalesouveranitat #ionos #gptoss #gptoss120b

  20. IONOS AI Model Hub bietet GPT-OSS-120B von OpenAI – DSGVO-konform, in Deutschland gehostet, mit OpenAI-API-Kompatibilität.

    ionos.blog/ionos-ai-model-hub/

    #KI #OpenAI #DSGVO #digitalesouveranitat #ionos #gptoss #gptoss120b

  21. ChatGPT-ähnliche KI lokal am Mac nutzen: OpenAI bringt neue Offline-Modelle
    OpenAI veröffentlicht erstmals seit Jahren neue Modelle mit offenen Gewichten. Ihr könnt jetzt ChatGPT-ähnliche KI direkt auf eurem Mac nutzen – ganz oh
    apfeltalk.de/magazin/news/chat
    #KI #News #ApacheLizenz #Apple #AppleSilicon #Entwicklerinnen #gptoss120b #gptoss20b #KI #KIModelle #Mac #Offline #OnDeviceKI #OpenAI #Sprachmodell

  22. ChatGPT-ähnliche KI lokal am Mac nutzen: OpenAI bringt neue Offline-Modelle
    OpenAI veröffentlicht erstmals seit Jahren neue Modelle mit offenen Gewichten. Ihr könnt jetzt ChatGPT-ähnliche KI direkt auf eurem Mac nutzen – ganz oh
    apfeltalk.de/magazin/news/chat
    #KI #News #ApacheLizenz #Apple #AppleSilicon #Entwicklerinnen #gptoss120b #gptoss20b #KI #KIModelle #Mac #Offline #OnDeviceKI #OpenAI #Sprachmodell

  23. ChatGPT-ähnliche KI lokal am Mac nutzen: OpenAI bringt neue Offline-Modelle
    OpenAI veröffentlicht erstmals seit Jahren neue Modelle mit offenen Gewichten. Ihr könnt jetzt ChatGPT-ähnliche KI direkt auf eurem Mac nutzen – ganz oh
    apfeltalk.de/magazin/news/chat
    #KI #News #ApacheLizenz #Apple #AppleSilicon #Entwicklerinnen #gptoss120b #gptoss20b #KI #KIModelle #Mac #Offline #OnDeviceKI #OpenAI #Sprachmodell

  24. ChatGPT-ähnliche KI lokal am Mac nutzen: OpenAI bringt neue Offline-Modelle
    OpenAI veröffentlicht erstmals seit Jahren neue Modelle mit offenen Gewichten. Ihr könnt jetzt ChatGPT-ähnliche KI direkt auf eurem Mac nutzen – ganz oh
    apfeltalk.de/magazin/news/chat
    #KI #News #ApacheLizenz #Apple #AppleSilicon #Entwicklerinnen #gptoss120b #gptoss20b #KI #KIModelle #Mac #Offline #OnDeviceKI #OpenAI #Sprachmodell

  25. ChatGPT-ähnliche KI lokal am Mac nutzen: OpenAI bringt neue Offline-Modelle
    OpenAI veröffentlicht erstmals seit Jahren neue Modelle mit offenen Gewichten. Ihr könnt jetzt ChatGPT-ähnliche KI direkt auf eurem Mac nutzen – ganz oh
    apfeltalk.de/magazin/news/chat
    #KI #News #ApacheLizenz #Apple #AppleSilicon #Entwicklerinnen #gptoss120b #gptoss20b #KI #KIModelle #Mac #Offline #OnDeviceKI #OpenAI #Sprachmodell