home.social

#claude_opus_46 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #claude_opus_46, aggregated by home.social.

  1. [Перевод] Как научить кодинг-модели не переписывать код заново

    Не надо переписывать то, что не поломано Код к этому посту доступен на Github . Кодинг при помощи ИИ стал нормой; мы всё больше позволяем моделям наподобие Cursor, GitHub Copilot, Claude Code и Codex вмешиваться в наш код. Если вы в прошлом пользовались каким-то из этих инструментов, то, вероятно, сталкивались с чем-то подобным: вы просите модель устранить простой баг (допустим, ошибку смещения на единицу или не тот оператор). Модель устраняет баг, но половина функции оказывается переписанной. Появляется новая вспомогательная функция. Совершенно логичное имя переменной меняется на другое. Добавляется новая валидация ввода. И diff из-за этого становится огромным. Я называю это проблемой избыточной редактуры : модели склонны переписывать код, не нуждающийся в переписывании. На самом деле, это важнее, чем может показаться. При разработке узким местом всегда становится ревью кода: ревьюерам нужно понять, что и почему поменялось, а также безопасно ли изменение. Модель, переписывающая целые функции, пусть даже корректно, существенно усложняет эту работу, потому что код теперь выглядит совершенно иначе. В своём посте я исследую эту проблему: имеют ли современные LLM склонность к избыточной редактуре и можем ли мы обучить модели редактировать код в должной мере?

    habr.com/ru/articles/1027096/

    #кодингагенты #иипомощники #qwen #gpt_5 #claude_opus_46 #gemini #glm #kimi #deepseek

  2. Сравнение ИИ-гигантов: ChatGPT 5.2 vs Gemini 3 Pro vs Claude Opus 4.6

    Stop. Хватит читать обзоры бенчмарков. Они не расскажут, почему ChatGPT увидел 127 точек , а Gemini – только 57. Не объяснят, зачем Claude добавил рекламу в игру , которая должна была быть “просто раздражающей”. И уж точно не покажут, кто из них думает, а кто просто генерирует текст . Мы провели стресс-тест в пяти раундах. Раунд 1: Вопрос, который меняет мышление. Раунд 2: Мультимодальный подсчёт – где ИИ должен видеть. Раунд 3: Печеньки на чёрной поверхности – где должен догадываться . Раунд 4: Экстремальное судоку – логически рассуждать . Раунд 5: Игра одним HTML-файлом – творить . Время гадать закончилось. Пока одни спорят, кто круче – ChatGPT, Gemini или Claude, – мы просто взяли и проверили . Не на бумажке. Не по цифрам из пресс-релизов. На реальных задачах. За пять испытаний каждая модель показала своё истинное лицо. Кто-то споткнулся на простом подсчёте точек. Кто-то удивил философской глубиной. А кто-то создал игру , которую не стыдно выложить в аппстор. И да, победитель есть. Смотрите, кто из гигантов действильно тянет .

    habr.com/ru/companies/bothub/a

    #chatgpt_52 #claude_opus_46 #gemini_3_pro #сравнение_иимоделей