#gigachat — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #gigachat, aggregated by home.social.
-
New my article is about benchmarking AI models and the lies of major companies marketing https://dev.to/toxy4ny/how-to-read-benchmark-tables-a-case-study-of-gigachat-35-ultra-reasoning-vs-deepseek-v4-flash-1i3h #redteam #AI #LLM #benchmark #AIops #deeplearning #ML #deepseek #gigachat
-
New my article is about benchmarking AI models and the lies of major companies marketing https://dev.to/toxy4ny/how-to-read-benchmark-tables-a-case-study-of-gigachat-35-ultra-reasoning-vs-deepseek-v4-flash-1i3h #redteam #AI #LLM #benchmark #AIops #deeplearning #ML #deepseek #gigachat
-
New my article is about benchmarking AI models and the lies of major companies marketing https://dev.to/toxy4ny/how-to-read-benchmark-tables-a-case-study-of-gigachat-35-ultra-reasoning-vs-deepseek-v4-flash-1i3h #redteam #AI #LLM #benchmark #AIops #deeplearning #ML #deepseek #gigachat
-
New my article is about benchmarking AI models and the lies of major companies marketing https://dev.to/toxy4ny/how-to-read-benchmark-tables-a-case-study-of-gigachat-35-ultra-reasoning-vs-deepseek-v4-flash-1i3h #redteam #AI #LLM #benchmark #AIops #deeplearning #ML #deepseek #gigachat
-
New my article is about benchmarking AI models and the lies of major companies marketing https://dev.to/toxy4ny/how-to-read-benchmark-tables-a-case-study-of-gigachat-35-ultra-reasoning-vs-deepseek-v4-flash-1i3h #redteam #AI #LLM #benchmark #AIops #deeplearning #ML #deepseek #gigachat
-
Наш бенчмарк ИИ-агентов: собачьи бега моделей LLM, в которых Алиса выигрывает
Всем привет. На связи Сергей Игнатенко, основатель ИИ-платформы VibePilot. Мы сделали свой бенчмарк моделей ИИ на реальных задачах: сметы, договоры, многостраничный Excel. 1 198 задач, 22 сбоя, 1,8%. Считается, что суверенные модели слишком слабы для агентов. Внутри жёсткого конвейера Алиса делает смету с разделами за 19 секунд и обгоняет Qwen3-235B в четыре раза. Смотреть результаты забегов
https://habr.com/ru/articles/1080744/
#бенчмарк_LLM #ИИагенты #YandexGPT #GigaChat #Alice_AI_LLM #DeepSeek #Qwen #суверенные_модели #генерация_документов #Yandex_Cloud
-
Наш бенчмарк ИИ-агентов: собачьи бега моделей LLM, в которых Алиса выигрывает
Всем привет. На связи Сергей Игнатенко, основатель ИИ-платформы VibePilot. Мы сделали свой бенчмарк моделей ИИ на реальных задачах: сметы, договоры, многостраничный Excel. 1 198 задач, 22 сбоя, 1,8%. Считается, что суверенные модели слишком слабы для агентов. Внутри жёсткого конвейера Алиса делает смету с разделами за 19 секунд и обгоняет Qwen3-235B в четыре раза. Смотреть результаты забегов
https://habr.com/ru/articles/1080744/
#бенчмарк_LLM #ИИагенты #YandexGPT #GigaChat #Alice_AI_LLM #DeepSeek #Qwen #суверенные_модели #генерация_документов #Yandex_Cloud
-
Наш бенчмарк ИИ-агентов: собачьи бега моделей LLM, в которых Алиса выигрывает
Всем привет. На связи Сергей Игнатенко, основатель ИИ-платформы VibePilot. Мы сделали свой бенчмарк моделей ИИ на реальных задачах: сметы, договоры, многостраничный Excel. 1 198 задач, 22 сбоя, 1,8%. Считается, что суверенные модели слишком слабы для агентов. Внутри жёсткого конвейера Алиса делает смету с разделами за 19 секунд и обгоняет Qwen3-235B в четыре раза. Смотреть результаты забегов
https://habr.com/ru/articles/1080744/
#бенчмарк_LLM #ИИагенты #YandexGPT #GigaChat #Alice_AI_LLM #DeepSeek #Qwen #суверенные_модели #генерация_документов #Yandex_Cloud