home.social

#z-ai — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #z-ai, aggregated by home.social.

fetched live
  1. #CISA: #China based #AIcompanies are conducting industrial-scale #knowledgedistillation campaigns to extract proprietary functionalities from U.S. #AImodels, including those from #DeepSeek, #MoonshotAI, #Alibaba, #MiniMax, #StepFun, and #ZAI. These activities, likely with Chinese government awareness, target reasoning capabilities, specialised optimisations, and domain-specific functions. cisa.gov/news-events/cybersecu #tech #news #ainew

  2. Z.ai が GLM-5.3-Flash 使い放題キャンペーンをやってる。

    時間 0:00 ~ 10:00 am JST
    期間 9/4 ~ 9/21

    👉Join now: z.ai/subscribe?ic=CVGESYR2ZF

    #ZCode #Zai #AI

  3. 【Z.ai / ZCode / GLM の割引コード】
    月々 $16.2 (2,600円前後)から!!

    👉Join now: z.ai/subscribe?ic=CVGESYR2ZF

    #ZCode #Zai #GLM #AI #LLM

  4. Ox Alpha (GLM-5.3-Flash). Что это было?.

    20 августа на OpenRouter появилась строчка stealth/ox-alpha . Без карточки модели и даже намёка, кто её выложил. Провайдер значился как «Anonymous». Цена – ноль. Контекст – мильон. Площадка предупреждала: мы не владелец этой модели, а просто маршрутизируем запросы. Через шесть дней у анона было имя, десятки триллионов обработанных токенов и полмиллиона разработчиков, которые за это время успели залить в него рабочий код. Спойлер, который уже не спойлер: это оказалась GLM-5.3-Flash от китайской Z.ai. Но путь от «непонятно что» до «фронтир-модели» получился драматичным и заслуживает разбора. Ну а поскольку я лично пялился в этот тред почти неделю, обновляя ленту как одержимый – расскажу вам что там произошло, по порядку.

    habr.com/ru/companies/gptunnel

    #Zai #GLM53Flash #Ox_Alpha #Qwen38FlashNext

  5. Конец жирной маржинальности ИИ: всё о ценообразовании и дешёвых стоимостях моделей

    В последнее время ИИ-сфера не просто падает, а даже входит в активную стадию конкурентности между несколькими фронтами — корпоративные ИИ (OpenAI и Anthropic, которые тоже между собой соревнуются) против открытых моделей (Qwen, GLM, DeepSeek). Цены за токен иногда падают, а когда не могут уменьшить цену — создают лёгкие модели с низкой стоимостью. Снижение стоимости вывода (инференс) перестало быть просто побочным эффектом оптимизации и превратилось в главную ось конкуренции. Решение OpenAI снизить цены на GPT 5.6 Sol минимум до ноября 2026 года — это попытка восстановить свою долю на рынке через демпинг. Открытые модели больше не догоняют закрытые по качеству, а даже иногда опережают их в экономике использования, делая доступ к ИИ коммунальной услугой. В этой статье мы разберём влияние Qwen, GLM и прочих опенсорсных моделей, конкуренцию на рынке ИИ и наконец разберём, куда свернула ИИ-гонка на этот раз.

    habr.com/ru/companies/bothub/a

    #qwen #zai #glm #ox_alpha #chatgpt #nvidia #deepseek #npu #hugging_face

  6. Powerful AI can strengthen cybersecurity, but open access also raises new risks. “GLM-5.3 has already found more than 2,000 vulnerabilities in different applications,” says Bart Preneel. #AI #Cybersecurity #ZAI
    standaard.be/economie/chinees-

  7. Z.ai 26. srpna 2026 oficiálně vypustil model GLM-5.3-Flash, jde o první nativně multimodální model v řadě GLM-5 a zároveň nejlevnější schopný kódovací model, jaký firma dosud vydala. Jde o model typu mixture-of-experts s 320 miliardami parametrů celkem, z nichž je aktivních 18 miliard na token, s kontextovým oknem přes milion tokenů a se schopností zpracovat i obrázky a […]

    https://zdrojak.cz/zpravicky/glm-5-3-flash-z-ai-predstavil-prvni-nativne-multimodalni-model-rady-glm-5/
  8. "Mit der Enthüllung ist nun auch klar, dass die Eingaben der Nutzer und die Antworten des Modells an ein chinesisches Unternehmen übermittelt wurden. Der Fall zeigt exemplarisch, dass Entwickler und Unternehmen bei kostenlosen Stealth-Modellen vorsichtig sein sollten: Solange nicht klar ist, wer ein Modell betreibt und wie übermittelte Daten gespeichert oder weiterverwendet werden, gehören sensible Informationen nicht in solche Dienste." heise.de/hintergrund/Ox-Alpha- /via @heiseonline #zai #china

  9. Если у вас было жгучее и непреодолимое желание попробовать GLM-5.3 - лучше не торопитесь или пробуйте не по подписке от самих Z.ai.

    Оно сейчас еле шевелится, а API регулярно вываливает ошибки. И под "сейчас" я имею в виду не "сегодня", а в целом какой-то период в последнее время.

    Кстати, сейчас ещё и лимиты на параллельную работу с моделью GLM-5.3 - 1 (один) параллельный запрос.

    Железо у провайдеров, похоже, кончается быстрее, чем они его закупают и выпускают модели.

    #LLM #GLM #ZAI #log #FAIL #pic

  10. #Zai #GLM 5.3, an #openweightAI, achieves state-of-the-art performance in #coding and #cyber capabilities through #posttraining #scaling. It outperforms GLM-5.2 on various benchmarks, including Terminal Bench 3.0 and Agents’ Last Exam, and demonstrates significant improvements in vulnerability discovery and exploitation on CyberGym and ExploitBench. z.ai/blog/glm-5.3?eicker.news #tech #news #ainews

  11. In today's thrilling episode of "Security Theater 101," Z.ai bombards us with an eye-watering jumble of numbers and acronyms that would confuse even the most seasoned conspiracy theorist. 🤯 Amongst the chaos, we're told something about Apple's Safari and FreeBSD's #vulnerabilities, but you'll need a decoder ring and a PhD in #cryptography to figure out the rest. 🔍💾
    cvd.z.ai #SecurityTheater #Zai #AppleSafari #FreeBSD #HackerNews #ngated

  12. GLM-5.3: Z.ai выпустил новую модель

    14 августа 2026 года компания Z.ai (бывшая Zhipu AI, Пекин) официально представила GLM-5.3 - новую версию своей флагманской линейки языковых моделей GLM-5. Анонс сопровождается слоганом "Built to Code. Ready for Cyber Defense" ("Создана для кода. Готова к киберзащите") и техническим блогом на z.ai/blog/glm-5.3. Это не рутинный точечный релиз: Z.ai впервые за всю серию GLM-5 явно позиционирует модель как инструмент не только агентной разработки, но и информационной безопасности область, которую индустрия ИИ традиционно считает зоной повышенного риска. Ниже разбор того, что подтверждено официально, что известно из контекста предыдущих релизов, и что пока остаётся открытым вопросом.

    habr.com/ru/articles/1070366/

    #glm #GLM53 #zai #искуственный_интеллект #ai #ml #zcode

  13. Just found this on someone console:

    - «Your daily tokens usage is depleted»
    - Get more tokens and continue the task
    - «Your daily tokens usage is depleted»
    - You already told me that. Find more tokens.
    - «Your daily tokens usage is depleted»
    - I want to speak with your supervisor NOW.

    🤣 I can't make up this shit 😂

    #AI #Funny #Gemini #Antigravity #Claude #ClaudeCode #Codex #ChatGPT #Kimi #ZAi #Perplexity #ArtificialIntelligence #LLM #Joke #jokes

  14. Z.ai(ZCode / GLM 5.2)に課金したので招待コードを置いておきます。

    Lite プランが 10% OFF の $16.2 (2,600円前後)で利用できます。

    👉Join now: z.ai/subscribe?ic=CVGESYR2ZF

    #ZCode #Zai #GLM #AI #LLM

  15. Z.ai activates 1-gigawatt AI data center built entirely on Chinese-made chips

    Stay curious — follow @1ban_news.

    1ban.news/zai-1gw-chinese-chip

    #1ban #zai #1gw #chinese #chip #tech

  16. Энтузиаст запустил GLM-5.2 на ноутбуке с 25 ГБ RAM: без дистилляции, но на скорости от 0,05 токена в секунду

    Разработчик-одиночка под ником JustVugg представил Colibri — движок, который запускает открытую модель GLM-5.2 с 744 миллиардами параметров на обычном компьютере с 25 ГБ оперативной памяти. Для сравнения, даже 2-битный квант моделей этого семейства требует порядка 220 ГБ памяти. На момент написания текста проект собрал более двух тысяч звезд на GitHub. GLM-5.2 — флагманская открытая модель китайской Z.ai, веса опубликованы под лицензией MIT: 744 миллиарда параметров всего, из них около 40 миллиардов активных на токен, контекст до миллиона токенов. На кодинг-бенчмарках она считается сильнейшей открытой моделью, которая "дышит" в спину закрытым конкурентам вроде Opus 4.8 и GPT-5.5. Проблема в том, что при классическом подходе все веса модели должны находиться в памяти одновременно — отсюда минимум для запуска в сотни гигабайт. Ключевое наблюдение автора Colibri: в MoE-архитектуре от токена к токену реально меняется лишь малая часть задействованных весов. Плотная часть модели — внимание, эмбеддинги и общие эксперты, около 17 миллиардов параметров — постоянно находится в памяти в int4-кванте и занимает 9,9 ГБ. А 21 504 маршрутизируемых эксперта, каждый примерно по 19 МБ, лежат на NVMe-накопителе (около 370 ГБ) и подгружаются по требованию. Важная оговорка: модель не урезана и не дистиллирована, все 744 миллиарда параметров на месте, но веса сжаты до 4 бит — это тот же компромисс, что и у привычных квантов GGUF. На каждый новый токен модель опрашивает 8 экспертов в каждом из 75 MoE-слоев, так что без прогретого кэша один токен обходится примерно в 11 ГБ прочитанных с диска данных (о том, как это влияет на износ — дальше по тексту).

    habr.com/ru/articles/1058050/

    #GLM52 #Zai #GLM

  17. #ChineseAImodels are gaining traction among US companies due to their competitive #performance and significantly #lowercosts compared to leading American rivals like #OpenAI and #Anthropic. The rise of #opensource and #openweight #AI from Chinese companies, such as #DeepSeek and #Zai, is particularly appealing as US #AIcosts soar. While still slightly behind top US models, Chinese options are closing the gap and offer a #costeffective alternative. cnbc.com/2026/07/07/chinese-ai #tech #media #news