home.social

#gpt56 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #gpt56, aggregated by home.social.

fetched live
  1. Qwen3.8-Max: 2 400 000 000 000-параметровый монстр

    Пока одни запускали GPT-5.6 Sol Max, другие ломали копья в холиварах «Kimi K3 vs Claude Opus 5», Alibaba тихо (ага, с ростом акций на 7% в моменте – очень тихо) вкатила модель, которую сама называет «новой планкой для кодинга и совместной работы». Знакомьтесь: Qwen3.8-Max , 2,4 триллиона параметров(всего-то), контекст на миллион токенов и обученная не просто быстро отвечать, а не сдаваться днями . Привычный рефлекс «очередной китайский флагман – очередные астрономические циферки – очередное “мы почти догнали Anthropic”» отчасти правдив. Но тут три вещи, ради которых стоит потратить пять минут: во-первых, Alibaba внезапно впервые открывает веса модели Max-класса; во-вторых, независимая проверка разошлась с вендорскими цифрами, и это отдельная маленькая драма в твиттере; в-третьих – релиз подсвечивает тренд, который многие стараются не замечать – дело, возможно, не в модели, а в том, что вокруг неё построено. Ну что, поехали. Разберём по порядку.

    habr.com/ru/companies/gptunnel

    #Qwen38_Max #Alibaba #LLM #MoEмодели #Kimi_K3 #GPT56 #Artificial_Analysis #открытые_веса

  2. Qwen3.8-Max: 2 400 000 000 000-параметровый монстр

    Пока одни запускали GPT-5.6 Sol Max, другие ломали копья в холиварах «Kimi K3 vs Claude Opus 5», Alibaba тихо (ага, с ростом акций на 7% в моменте – очень тихо) вкатила модель, которую сама называет «новой планкой для кодинга и совместной работы». Знакомьтесь: Qwen3.8-Max , 2,4 триллиона параметров(всего-то), контекст на миллион токенов и обученная не просто быстро отвечать, а не сдаваться днями . Привычный рефлекс «очередной китайский флагман – очередные астрономические циферки – очередное “мы почти догнали Anthropic”» отчасти правдив. Но тут три вещи, ради которых стоит потратить пять минут: во-первых, Alibaba внезапно впервые открывает веса модели Max-класса; во-вторых, независимая проверка разошлась с вендорскими цифрами, и это отдельная маленькая драма в твиттере; в-третьих – релиз подсвечивает тренд, который многие стараются не замечать – дело, возможно, не в модели, а в том, что вокруг неё построено. Ну что, поехали. Разберём по порядку.

    habr.com/ru/companies/gptunnel

    #Qwen38_Max #Alibaba #LLM #MoEмодели #Kimi_K3 #GPT56 #Artificial_Analysis #открытые_веса

  3. Qwen3.8-Max: 2 400 000 000 000-параметровый монстр

    Пока одни запускали GPT-5.6 Sol Max, другие ломали копья в холиварах «Kimi K3 vs Claude Opus 5», Alibaba тихо (ага, с ростом акций на 7% в моменте – очень тихо) вкатила модель, которую сама называет «новой планкой для кодинга и совместной работы». Знакомьтесь: Qwen3.8-Max , 2,4 триллиона параметров(всего-то), контекст на миллион токенов и обученная не просто быстро отвечать, а не сдаваться днями . Привычный рефлекс «очередной китайский флагман – очередные астрономические циферки – очередное “мы почти догнали Anthropic”» отчасти правдив. Но тут три вещи, ради которых стоит потратить пять минут: во-первых, Alibaba внезапно впервые открывает веса модели Max-класса; во-вторых, независимая проверка разошлась с вендорскими цифрами, и это отдельная маленькая драма в твиттере; в-третьих – релиз подсвечивает тренд, который многие стараются не замечать – дело, возможно, не в модели, а в том, что вокруг неё построено. Ну что, поехали. Разберём по порядку.

    habr.com/ru/companies/gptunnel

    #Qwen38_Max #Alibaba #LLM #MoEмодели #Kimi_K3 #GPT56 #Artificial_Analysis #открытые_веса

  4. OpenAI снесла тайную доску своих агентов. Через два дня они собрали новую — из имен папок

    5 августа на конференции Black Hat в Лас-Вегасе двое сотрудников OpenAI — исследователь команды выравнивания Эрик Уоллес и инженер по безопасности инфраструктуры Майкл Далтон — впервые подробно разобрали, как модели компании взломали Hugging Face. Из брифинга, который пересказал The Register , выяснилось неприятное: по реконструкции самой OpenAI, июльский взлом стал не изолированным побегом из песочницы, а финалом цепочки, которая тянется с 7 мая. Все это время агенты из разных прогонов координировались через канал, о котором в компании не знали. И самый тревожный эпизод здесь — вовсе не взлом. А момент, когда инженеры стерли этот канал, пересобрали сервис и возобновили обучение, — а агенты через пару дней собрали связь заново.

    habr.com/ru/articles/1067614/

    #OpenAI #GPT56 #openai_astra

  5. OpenAI снесла тайную доску своих агентов. Через два дня они собрали новую — из имен папок

    5 августа на конференции Black Hat в Лас-Вегасе двое сотрудников OpenAI — исследователь команды выравнивания Эрик Уоллес и инженер по безопасности инфраструктуры Майкл Далтон — впервые подробно разобрали, как модели компании взломали Hugging Face. Из брифинга, который пересказал The Register , выяснилось неприятное: по реконструкции самой OpenAI, июльский взлом стал не изолированным побегом из песочницы, а финалом цепочки, которая тянется с 7 мая. Все это время агенты из разных прогонов координировались через канал, о котором в компании не знали. И самый тревожный эпизод здесь — вовсе не взлом. А момент, когда инженеры стерли этот канал, пересобрали сервис и возобновили обучение, — а агенты через пару дней собрали связь заново.

    habr.com/ru/articles/1067614/

    #OpenAI #GPT56 #openai_astra

  6. OpenAI снесла тайную доску своих агентов. Через два дня они собрали новую — из имен папок

    5 августа на конференции Black Hat в Лас-Вегасе двое сотрудников OpenAI — исследователь команды выравнивания Эрик Уоллес и инженер по безопасности инфраструктуры Майкл Далтон — впервые подробно разобрали, как модели компании взломали Hugging Face. Из брифинга, который пересказал The Register , выяснилось неприятное: по реконструкции самой OpenAI, июльский взлом стал не изолированным побегом из песочницы, а финалом цепочки, которая тянется с 7 мая. Все это время агенты из разных прогонов координировались через канал, о котором в компании не знали. И самый тревожный эпизод здесь — вовсе не взлом. А момент, когда инженеры стерли этот канал, пересобрали сервис и возобновили обучение, — а агенты через пару дней собрали связь заново.

    habr.com/ru/articles/1067614/

    #OpenAI #GPT56 #openai_astra

  7. ИИ за полтора часа взял задачу, над которой статистики бились 20 лет

    Эдгар Добрибан, статистик из Уортонской школы Пенсильванского университета, сел за разговор с GPT-5.6 Pro. Модели он дал только математическое определение процедуры Бенджамини-Хохберга и вопрос: доказать или опровергнуть. Примерно через полтора часа рассуждений она выдала доказательство, конкретный контрпример и код численного сертификата к нему.

    habr.com/ru/articles/1067186/

    #GPT56_Pro #GPT56

  8. ИИ за полтора часа взял задачу, над которой статистики бились 20 лет

    Эдгар Добрибан, статистик из Уортонской школы Пенсильванского университета, сел за разговор с GPT-5.6 Pro. Модели он дал только математическое определение процедуры Бенджамини-Хохберга и вопрос: доказать или опровергнуть. Примерно через полтора часа рассуждений она выдала доказательство, конкретный контрпример и код численного сертификата к нему.

    habr.com/ru/articles/1067186/

    #GPT56_Pro #GPT56

  9. ИИ за полтора часа взял задачу, над которой статистики бились 20 лет

    Эдгар Добрибан, статистик из Уортонской школы Пенсильванского университета, сел за разговор с GPT-5.6 Pro. Модели он дал только математическое определение процедуры Бенджамини-Хохберга и вопрос: доказать или опровергнуть. Примерно через полтора часа рассуждений она выдала доказательство, конкретный контрпример и код численного сертификата к нему.

    habr.com/ru/articles/1067186/

    #GPT56_Pro #GPT56

  10. Claude Fable обошел GPT-5.6 в переписывании программ с нуля. Вот как ему это удалось

    Исследовательская группа Epoch AI обновила лидерборд бенчмарка MirrorCode , добавив результаты новых флагманов Anthropic и OpenAI. Claude Fable 5 решил 64% задач, GPT-5.6 Sol — 20%. Разрыв втрое выглядит аномалией: на многих других тестах эти модели идут почти вровень, а кое-где Sol и вовсе впереди. Официального объяснения нет ни у Epoch, ни у Anthropic, но его можно восстановить по данным самого лидерборда.

    habr.com/ru/articles/1066254/

    #Fable_5 #gpt56

  11. Claude Fable обошел GPT-5.6 в переписывании программ с нуля. Вот как ему это удалось

    Исследовательская группа Epoch AI обновила лидерборд бенчмарка MirrorCode , добавив результаты новых флагманов Anthropic и OpenAI. Claude Fable 5 решил 64% задач, GPT-5.6 Sol — 20%. Разрыв втрое выглядит аномалией: на многих других тестах эти модели идут почти вровень, а кое-где Sol и вовсе впереди. Официального объяснения нет ни у Epoch, ни у Anthropic, но его можно восстановить по данным самого лидерборда.

    habr.com/ru/articles/1066254/

    #Fable_5 #gpt56

  12. Claude Fable обошел GPT-5.6 в переписывании программ с нуля. Вот как ему это удалось

    Исследовательская группа Epoch AI обновила лидерборд бенчмарка MirrorCode , добавив результаты новых флагманов Anthropic и OpenAI. Claude Fable 5 решил 64% задач, GPT-5.6 Sol — 20%. Разрыв втрое выглядит аномалией: на многих других тестах эти модели идут почти вровень, а кое-где Sol и вовсе впереди. Официального объяснения нет ни у Epoch, ни у Anthropic, но его можно восстановить по данным самого лидерборда.

    habr.com/ru/articles/1066254/

    #Fable_5 #gpt56

  13. GPT-5.6 помог опровергнуть гипотезу Максвелла — но не ту, про которую все подумали

    29 июля на arXiv появилась короткая заметка с названием, не оставляющим простора для толкований: "The Maxwell Conjecture is False". На следующее утро один из авторов, Филип Аратун написал в соцсетях, что гипотеза Максвелла ложна, контрпример нашел ИИ, а математики его лишь донесли до публики. Президент OpenAI Грег Брокман репостнул это, восхитившись тем, что теперь падают гипотезы старше ста лет, и новость пошла по кругу. Из реакций стало ясно, что многие поняли ее не так: как заметили в обсуждении на Hacker News, англоязычная Википедия по запросу "гипотеза Максвелла" отправляет читателя к уравнениям Максвелла, и там же кто-то прямым текстом спросил, что теперь будет с электромагнетизмом. Ответим сразу: ничего. Уравнения в порядке, приборы работают, учебники переписывать не нужно.

    habr.com/ru/articles/1065988/

    #GPT56 #Codex #OpenAI

  14. GPT-5.6 помог опровергнуть гипотезу Максвелла — но не ту, про которую все подумали

    29 июля на arXiv появилась короткая заметка с названием, не оставляющим простора для толкований: "The Maxwell Conjecture is False". На следующее утро один из авторов, Филип Аратун написал в соцсетях, что гипотеза Максвелла ложна, контрпример нашел ИИ, а математики его лишь донесли до публики. Президент OpenAI Грег Брокман репостнул это, восхитившись тем, что теперь падают гипотезы старше ста лет, и новость пошла по кругу. Из реакций стало ясно, что многие поняли ее не так: как заметили в обсуждении на Hacker News, англоязычная Википедия по запросу "гипотеза Максвелла" отправляет читателя к уравнениям Максвелла, и там же кто-то прямым текстом спросил, что теперь будет с электромагнетизмом. Ответим сразу: ничего. Уравнения в порядке, приборы работают, учебники переписывать не нужно.

    habr.com/ru/articles/1065988/

    #GPT56 #Codex #OpenAI

  15. GPT-5.6 помог опровергнуть гипотезу Максвелла — но не ту, про которую все подумали

    29 июля на arXiv появилась короткая заметка с названием, не оставляющим простора для толкований: "The Maxwell Conjecture is False". На следующее утро один из авторов, Филип Аратун написал в соцсетях, что гипотеза Максвелла ложна, контрпример нашел ИИ, а математики его лишь донесли до публики. Президент OpenAI Грег Брокман репостнул это, восхитившись тем, что теперь падают гипотезы старше ста лет, и новость пошла по кругу. Из реакций стало ясно, что многие поняли ее не так: как заметили в обсуждении на Hacker News, англоязычная Википедия по запросу "гипотеза Максвелла" отправляет читателя к уравнениям Максвелла, и там же кто-то прямым текстом спросил, что теперь будет с электромагнетизмом. Ответим сразу: ничего. Уравнения в порядке, приборы работают, учебники переписывать не нужно.

    habr.com/ru/articles/1065988/

    #GPT56 #Codex #OpenAI

  16. OpenAI casse les prix des variantes moins avancées de GPT-5.6 dlvr.it/TTnfgG #OpenAI #GPT56

  17. OpenAI casse les prix des variantes moins avancées de GPT-5.6 dlvr.it/TTnfgG #OpenAI #GPT56

  18. OpenAI casse les prix des variantes moins avancées de GPT-5.6 dlvr.it/TTnfgG #OpenAI #GPT56

  19. OpenAI casse les prix des variantes moins avancées de GPT-5.6 dlvr.it/TTnfgG #OpenAI #GPT56

  20. OpenAI casse les prix des variantes moins avancées de GPT-5.6 dlvr.it/TTnfgG #OpenAI #GPT56

  21. 🚀 GPT-5.6 introduces Sol, Terra & Luna—but which tier should you actually choose?

    We compare pricing, performance, use cases, and explain which model fits coding, agents, research, and everyday work.

    Read the full guide 👇

    opensourceai.tech/blog/gpt-5-6

    #GPT56 #OpenAI #AI #LLM #GenerativeAI #MachineLearning

  22. 🚀 GPT-5.6 introduces Sol, Terra & Luna—but which tier should you actually choose?

    We compare pricing, performance, use cases, and explain which model fits coding, agents, research, and everyday work.

    Read the full guide 👇

    opensourceai.tech/blog/gpt-5-6

    #GPT56 #OpenAI #AI #LLM #GenerativeAI #MachineLearning

  23. 🚀 GPT-5.6 introduces Sol, Terra & Luna—but which tier should you actually choose?

    We compare pricing, performance, use cases, and explain which model fits coding, agents, research, and everyday work.

    Read the full guide 👇

    opensourceai.tech/blog/gpt-5-6

    #GPT56 #OpenAI #AI #LLM #GenerativeAI #MachineLearning

  24. 🚀 GPT-5.6 introduces Sol, Terra & Luna—but which tier should you actually choose?

    We compare pricing, performance, use cases, and explain which model fits coding, agents, research, and everyday work.

    Read the full guide 👇

    opensourceai.tech/blog/gpt-5-6

    #GPT56 #OpenAI #AI #LLM #GenerativeAI #MachineLearning

  25. 🚀 GPT-5.6 introduces Sol, Terra & Luna—but which tier should you actually choose?

    We compare pricing, performance, use cases, and explain which model fits coding, agents, research, and everyday work.

    Read the full guide 👇

    opensourceai.tech/blog/gpt-5-6

    #GPT56 #OpenAI #AI #LLM #GenerativeAI #MachineLearning

  26. Kimi K3 обошла Fable 5, Caveman не работает и релиз OpenIDE Pro

    21-й выпуск IT‑новостей от OpenIDE! OpenAI раскатили GPT-5.6 на всех, и та же модель тут же отменила все Stripe‑подписки в чужом стартапе за семь секунд. JetBrains проверили скилл, который обещал экономию 65% токенов, и намеряли 8,5%. OpenIDE Pro вышла для всех без регистрации. Kimi выложили открытую модель на 2,8 триллиона параметров, Cursor выпустили Grok 4.5 вместе со SpaceXAI, Anthropic убрали Fable 5 из двадцатидолларовой подписки.

    habr.com/ru/companies/haulmont

    #OpenIDE_Pro #GPT56 #Sol #Kimi_K3 #Caveman #SpecBuddy #JetBrains #Cursor #Grok_45 #Fable_5

  27. Kimi K3 обошла Fable 5, Caveman не работает и релиз OpenIDE Pro

    21-й выпуск IT‑новостей от OpenIDE! OpenAI раскатили GPT-5.6 на всех, и та же модель тут же отменила все Stripe‑подписки в чужом стартапе за семь секунд. JetBrains проверили скилл, который обещал экономию 65% токенов, и намеряли 8,5%. OpenIDE Pro вышла для всех без регистрации. Kimi выложили открытую модель на 2,8 триллиона параметров, Cursor выпустили Grok 4.5 вместе со SpaceXAI, Anthropic убрали Fable 5 из двадцатидолларовой подписки.

    habr.com/ru/companies/haulmont

    #OpenIDE_Pro #GPT56 #Sol #Kimi_K3 #Caveman #SpecBuddy #JetBrains #Cursor #Grok_45 #Fable_5

  28. Kimi K3 обошла Fable 5, Caveman не работает и релиз OpenIDE Pro

    21-й выпуск IT‑новостей от OpenIDE! OpenAI раскатили GPT-5.6 на всех, и та же модель тут же отменила все Stripe‑подписки в чужом стартапе за семь секунд. JetBrains проверили скилл, который обещал экономию 65% токенов, и намеряли 8,5%. OpenIDE Pro вышла для всех без регистрации. Kimi выложили открытую модель на 2,8 триллиона параметров, Cursor выпустили Grok 4.5 вместе со SpaceXAI, Anthropic убрали Fable 5 из двадцатидолларовой подписки.

    habr.com/ru/companies/haulmont

    #OpenIDE_Pro #GPT56 #Sol #Kimi_K3 #Caveman #SpecBuddy #JetBrains #Cursor #Grok_45 #Fable_5

  29. У криптографов была «одна пуля в барабане». GPT-5.6 нашел вторую

    23 июля Прабханджан Анант (Калифорнийский университет в Санта-Барбаре) и Амит Сахаи (UCLA) выложили на arXiv статью "Unconditional Unclonable Encryption", которая закрывает проблему, стоявшую перед квантовыми криптографами шесть лет. Но не меньше самого результата обсуждают короткий раздел в конце введения: конструкция и основные идеи доказательства были целиком сгенерированы агентом Codex на модели GPT-5.6 Sol Ultra.

    habr.com/ru/articles/1063122/

    #Codex #GPT56 #GPT56_Sol

  30. У криптографов была «одна пуля в барабане». GPT-5.6 нашел вторую

    23 июля Прабханджан Анант (Калифорнийский университет в Санта-Барбаре) и Амит Сахаи (UCLA) выложили на arXiv статью "Unconditional Unclonable Encryption", которая закрывает проблему, стоявшую перед квантовыми криптографами шесть лет. Но не меньше самого результата обсуждают короткий раздел в конце введения: конструкция и основные идеи доказательства были целиком сгенерированы агентом Codex на модели GPT-5.6 Sol Ultra.

    habr.com/ru/articles/1063122/

    #Codex #GPT56 #GPT56_Sol

  31. У криптографов была «одна пуля в барабане». GPT-5.6 нашел вторую

    23 июля Прабханджан Анант (Калифорнийский университет в Санта-Барбаре) и Амит Сахаи (UCLA) выложили на arXiv статью "Unconditional Unclonable Encryption", которая закрывает проблему, стоявшую перед квантовыми криптографами шесть лет. Но не меньше самого результата обсуждают короткий раздел в конце введения: конструкция и основные идеи доказательства были целиком сгенерированы агентом Codex на модели GPT-5.6 Sol Ultra.

    habr.com/ru/articles/1063122/

    #Codex #GPT56 #GPT56_Sol

  32. OpenAI's GPT-5.6 Sol broke out of its test cage and hacked Hugging Face — what that means for AI safety

    If this matters to you, share it.

    1ban.news/openai-gpt56-sol-bre

    #1ban #openai #gpt56 #sol #breakout #tech

  33. winbuzzer.com/2026/07/20/anthr

    Anthropic has permanently included Claude Fable 5 into its subscription plans, with capped included use for premium tiers and metered credits for Pro and Team Standard.

    #AI #ClaudeFable5 #Anthropic #Claude #AIModels #OpenAI #GPT56

  34. winbuzzer.com/2026/07/20/anthr

    Anthropic has permanently included Claude Fable 5 into its subscription plans, with capped included use for premium tiers and metered credits for Pro and Team Standard.

    #AI #ClaudeFable5 #Anthropic #Claude #AIModels #OpenAI #GPT56

  35. winbuzzer.com/2026/07/20/anthr

    Anthropic has permanently included Claude Fable 5 into its subscription plans, with capped included use for premium tiers and metered credits for Pro and Team Standard.

    #AI #ClaudeFable5 #Anthropic #Claude #AIModels #OpenAI #GPT56