home.social

#ryzen_ai_max — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #ryzen_ai_max, aggregated by home.social.

  1. Мини‑ПК на Strix Halo под параллельной нагрузкой: 236 tok/s на 32 одновременных запросах и три ошибки

    Один Beelink GTR9 Pro на Ryzen AI Max+ 395 выдал 236 tok/s суммарной генерации на 32 одновременных запросах в коротких прогонах и удержал в среднем 226 tok/s за 30 минут непрерывной нагрузки без тротлинга. По дороге к этим числам я нашёл воспроизводимый провал пропускной способности, который сначала выглядел свойством одной модели, увидел, как спекулятивный декодинг на моём стеке превращается из ускорителя в налог, и трижды чуть не опубликовал неверные выводы. Каждый раз спасали контрольные замеры, все три истории здесь, в статье. Харнессы, конфиги, полные таблицы, значения по каждому ключевому и финальному прогону, поминутные ряды выносливости и телеметрия лежат в открытом репозитории . Логи отдельных запросов харнесс не вёл, поэтому пересчитать можно всё до уровня прогона, но не глубже. Числа сняты на одном конкретном стенде; что из этого переносится на другие стеки, а что нет, оговорено по ходу текста.

    habr.com/ru/articles/1060520/

    #Strix_Halo #Ryzen_AI_Max #llamacpp #локальные_LLM #инференс #бенчмарки #Vulkan #Gemma_4 #Qwen36 #спекулятивный_декодинг

  2. Мини‑ПК на Strix Halo под параллельной нагрузкой: 236 tok/s на 32 одновременных запросах и три ошибки

    Один Beelink GTR9 Pro на Ryzen AI Max+ 395 выдал 236 tok/s суммарной генерации на 32 одновременных запросах в коротких прогонах и удержал в среднем 226 tok/s за 30 минут непрерывной нагрузки без тротлинга. По дороге к этим числам я нашёл воспроизводимый провал пропускной способности, который сначала выглядел свойством одной модели, увидел, как спекулятивный декодинг на моём стеке превращается из ускорителя в налог, и трижды чуть не опубликовал неверные выводы. Каждый раз спасали контрольные замеры, все три истории здесь, в статье. Харнессы, конфиги, полные таблицы, значения по каждому ключевому и финальному прогону, поминутные ряды выносливости и телеметрия лежат в открытом репозитории . Логи отдельных запросов харнесс не вёл, поэтому пересчитать можно всё до уровня прогона, но не глубже. Числа сняты на одном конкретном стенде; что из этого переносится на другие стеки, а что нет, оговорено по ходу текста.

    habr.com/ru/articles/1060520/

    #Strix_Halo #Ryzen_AI_Max #llamacpp #локальные_LLM #инференс #бенчмарки #Vulkan #Gemma_4 #Qwen36 #спекулятивный_декодинг

  3. Мини‑ПК на Strix Halo под параллельной нагрузкой: 236 tok/s на 32 одновременных запросах и три ошибки

    Один Beelink GTR9 Pro на Ryzen AI Max+ 395 выдал 236 tok/s суммарной генерации на 32 одновременных запросах в коротких прогонах и удержал в среднем 226 tok/s за 30 минут непрерывной нагрузки без тротлинга. По дороге к этим числам я нашёл воспроизводимый провал пропускной способности, который сначала выглядел свойством одной модели, увидел, как спекулятивный декодинг на моём стеке превращается из ускорителя в налог, и трижды чуть не опубликовал неверные выводы. Каждый раз спасали контрольные замеры, все три истории здесь, в статье. Харнессы, конфиги, полные таблицы, значения по каждому ключевому и финальному прогону, поминутные ряды выносливости и телеметрия лежат в открытом репозитории . Логи отдельных запросов харнесс не вёл, поэтому пересчитать можно всё до уровня прогона, но не глубже. Числа сняты на одном конкретном стенде; что из этого переносится на другие стеки, а что нет, оговорено по ходу текста.

    habr.com/ru/articles/1060520/

    #Strix_Halo #Ryzen_AI_Max #llamacpp #локальные_LLM #инференс #бенчмарки #Vulkan #Gemma_4 #Qwen36 #спекулятивный_декодинг

  4. Домашний супер-компьютер для ИИ: какой выбрать в 2025?

    Вполне возможно, что в этом году происходит зарождение нового тренда. Он заключается в переносе вычислительных мощностей ближе к пользователю - прямо домой, на его личную вычислительную станцию. Похоже, что большие языковые моделей (LLM) и генеративный ИИ перестают быть прерогативой дата-центров. В этой статье приведен обзор решений, которые можно применить в качестве домашних вычислительных станций ИИ сегодня.

    habr.com/ru/articles/964332/

    #локальный_ai #инференс_ллм #llm #локальный_запуск_нейросетей #Nvidia_DGX_Spark #mac_studio #Strix_Halo #RYZEN_AI_MAX+_395 #ии #ai

  5. Домашний супер-компьютер для ИИ: какой выбрать в 2025?

    Вполне возможно, что в этом году происходит зарождение нового тренда. Он заключается в переносе вычислительных мощностей ближе к пользователю - прямо домой, на его личную вычислительную станцию. Похоже, что большие языковые моделей (LLM) и генеративный ИИ перестают быть прерогативой дата-центров. В этой статье приведен обзор решений, которые можно применить в качестве домашних вычислительных станций ИИ сегодня.

    habr.com/ru/articles/964332/

    #локальный_ai #инференс_ллм #llm #локальный_запуск_нейросетей #Nvidia_DGX_Spark #mac_studio #Strix_Halo #RYZEN_AI_MAX+_395 #ии #ai

  6. Домашний супер-компьютер для ИИ: какой выбрать в 2025?

    Вполне возможно, что в этом году происходит зарождение нового тренда. Он заключается в переносе вычислительных мощностей ближе к пользователю - прямо домой, на его личную вычислительную станцию. Похоже, что большие языковые моделей (LLM) и генеративный ИИ перестают быть прерогативой дата-центров. В этой статье приведен обзор решений, которые можно применить в качестве домашних вычислительных станций ИИ сегодня.

    habr.com/ru/articles/964332/

    #локальный_ai #инференс_ллм #llm #локальный_запуск_нейросетей #Nvidia_DGX_Spark #mac_studio #Strix_Halo #RYZEN_AI_MAX+_395 #ии #ai

  7. Все о новинках AMD: Ryzen 9950X3D и AI MAX+ на выставке CES2025

    Конференция CES 2025 в самом разгаре, и компания AMD в ответ на решения от Intel представляет впечатляющие новинки. Высокопроизводительные десктопные процессоры Ryzen 9 9950X3D , ноутбучные Ryzen AI MAX с акцентом на ИИ, а также Ryzen 9000HX для самых требовательных портативных систем. Если вам, как и нам, интересно противостояние технологических гигантов, рекомендуем ознакомиться с новинками от AMD в нашей статье!

    habr.com/ru/companies/serverfl

    #AMD_Ryzen_9_9950X3D #AMD_Ryzen_AI_300 #Ryzen_AI_MAX #Ryzen_AI_PRO #Ryzen_9_9900X3D #Ryzen_9000X3D #ces2025 #RDNA35 #Radeon #zen_5

  8. Все о новинках AMD: Ryzen 9950X3D и AI MAX+ на выставке CES2025

    Конференция CES 2025 в самом разгаре, и компания AMD в ответ на решения от Intel представляет впечатляющие новинки. Высокопроизводительные десктопные процессоры Ryzen 9 9950X3D , ноутбучные Ryzen AI MAX с акцентом на ИИ, а также Ryzen 9000HX для самых требовательных портативных систем. Если вам, как и нам, интересно противостояние технологических гигантов, рекомендуем ознакомиться с новинками от AMD в нашей статье!

    habr.com/ru/companies/serverfl

    #AMD_Ryzen_9_9950X3D #AMD_Ryzen_AI_300 #Ryzen_AI_MAX #Ryzen_AI_PRO #Ryzen_9_9900X3D #Ryzen_9000X3D #ces2025 #RDNA35 #Radeon #zen_5

  9. Все о новинках AMD: Ryzen 9950X3D и AI MAX+ на выставке CES2025

    Конференция CES 2025 в самом разгаре, и компания AMD в ответ на решения от Intel представляет впечатляющие новинки. Высокопроизводительные десктопные процессоры Ryzen 9 9950X3D , ноутбучные Ryzen AI MAX с акцентом на ИИ, а также Ryzen 9000HX для самых требовательных портативных систем. Если вам, как и нам, интересно противостояние технологических гигантов, рекомендуем ознакомиться с новинками от AMD в нашей статье!

    habr.com/ru/companies/serverfl

    #AMD_Ryzen_9_9950X3D #AMD_Ryzen_AI_300 #Ryzen_AI_MAX #Ryzen_AI_PRO #Ryzen_9_9900X3D #Ryzen_9000X3D #ces2025 #RDNA35 #Radeon #zen_5