home.social

#kimik25 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #kimik25, aggregated by home.social.

fetched live
  1. Геометрия превосходства: Почему DeepSeek-V4 и Moonshot AI убили AdamW, и как оптимизатор Muon меняет физику обучения Долги...

    #оптимизатор #adam #muon #оптимизатор #нейронные #сети #deepseek #kimi-k2.5

    Origin | Interest | Match
  2. NVIDIA’s Nemotron 3 Super Tops The Open-Source AI Model Chart, Beating DeepSeek & GPT-OSS NVIDIA's Open-Source "Nemotron 3 Super" AI model has topped the EnterpriseOps-Gym leaderb...

    #Featured #News #Sticky #EnterpriseOps-Gym #Kimi-K2.5 #Mamba-Transformer #MoE #Neomotron #3 #Super #NVFP4

    Origin | Interest | Match
  3. Как использовать Claude Code в 8 раз дешевле: подключаем китайские модели

    Всем привет! Сегодня разберём, можно ли использовать Claude Code с китайскими моделями вместо Opus и сколько на этом реально сэкономить. Взял две китайские модели Kimi K2.6 от Moonshot AI и GLM-5.1 от Z AI и прогнал их на привычных задачах и сравнил с Opus. Не в написании кода, а на повседневных задачах: создать лендинг, сделать карусель для соцсетей, анализ данных, что-то в интернете поискать сравнить, написать какой-нибудь не сложный Telegram-бот и т.д. Забегая вперёд: результаты оказались неожиданными. Где-то китайские модели выиграли у Opus, где-то проиграли, а где-то разница оказалась чисто вкусовой. В конце статьи будет пошаговая инструкция, как подключить любую из этих моделей к Claude Code за пять минут. Работает и в терминале, и в десктоп-приложении, и в VS Code, везде где вы привыкли запускать Claude Code

    habr.com/ru/articles/1026760/

    #claude #claude_code #kimik2 #kimik25 #openai #ai #ии_агенты

  4. Из коробки не работает: запускаем свежие большие LLM

    В последнее время открытых моделей сверхбольшого размера развелось неимоверное количество, даже не просто моделей, а производителей. Вариации GLM, Kimi, DeepSeek занимают по нескольку строк в топ 5-10-20. Понадобилось перебрать основные LLM для тестов и выбора "рабочей лошадки", для чего пришлось немного пошуршать в интернетах. Оставлю в качестве памятки, вдруг кому-то окажется полезным. Всё делалось на базе образов vllm-openai, платформ B200/H200 и дров 590.48.01. На момент начала экспериментов - примерно пару недель тому назад - версии vllm 0.16 ещё не было, но, как выяснилось в итоге, это не сильно повлияло на ситуацию. Основные костыли остались теми же самыми. Разве что кастомизация образа не для каждой модели нужна теперь. В целом там, понятное дело, никакого RocketScience нету (особенно после того, как почитаешь китайские форумы в поисках нюансов). Но если бы кто-то посидел заранее и собрал советы в одном месте - жизнь была бы немного проще )) поэтому делюсь. Итак, поехали.

    habr.com/ru/articles/1006202/

    #KimiK25 #DeepSeekv32 #GLM5 #Qwen35 #vllm #B200 #H200

  5. Из коробки не работает: запускаем свежие большие LLM В последнее время открытых моделей сверхбольшого разме...

    #Kimi-K2.5 #DeepSeek-v3.2 #GLM-5 #Qwen3.5 #vllm #B200

    Origin | Interest | Match
  6. Using well-chosen public sources, i let NotebookLM and Kimi K2.5 generate a presentation on a subject, amazing quality and very few errors. Good inspiration for the real presentation i will make myself. AI is not only creating "slop", we have to really start more research about how we incorporate AI in our work-processes in a responsible way, how we don't become "dumber", maintain skills, learning and human creativity 🤔
    #AI #slop #learning #skills #creativity #NotebookLM #KimiK25

  7. Explore how the new Kimi K2.5 multimodal VLM leverages NVIDIA GPU‑accelerated endpoints, vLLM and the NeMo framework to deliver faster, open‑source vision‑language inference. The article walks through CUDA optimizations and practical deployment tips for AI researchers and developers. #KimiK25 #MultimodalVLM #NVIDIAGPU #NeMoFramework

    🔗 aidailypost.com/news/build-kim

  8. Only just recently had some time to read the Kimi K2.5 technical report , an impressive open weights model (it's not fully opensource), the distance towards large paid proprietary foundation models is becoming very small.
    github.com/MoonshotAI/Kimi-K2.
    It also feels that way in use:
    kimi.com/chat
    #AI #openweights #models #KimiK25 #China

  9. 🎁 #KimiK25 Launch Top-Up Bonus: Get up to 50% in Vouchers! #MoonshotAI #AI #Promotion
    💰 Tiered bonus on top-ups:
    $100-$1,999 → 30%
    $2,000-$9,999 → 40%
    $10,000+ → 50% (max $10,000 voucher)
    ⏰ Until February 2, 2026 - voucher credited within 1 business day, valid for 30 days
    🚀 Celebrating the launch of #KimiK25: Native multimodal agentic model with 1T parameters, 256K context & Agent Swarm with up to 100 parallel sub-agents

    platform.moonshot.ai/docs/prom

  10. New open weights model Kimi K2.5
    "self-directed agent swarm paradigm" ,
    "For complex tasks, Kimi K2.5 can self-direct an agent swarm with up to 100 sub-agents, executing parallel workflows across up to 1,500 tool calls. Compared with a single-agent setup, this reduces execution time by up to 4.5x. The agent swarm is automatically created and orchestrated by Kimi K2.5 without any predefined subagents or workflow."
    simonwillison.net/2026/Jan/27/
    #KimiK25 #openweights #AI