home.social

#metr — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #metr, aggregated by home.social.

  1. Как широкий доступ к ИИ‑кодогенерации тихо разъедает инженерную команду

    Представьте свою команду через пару лет после того, как все в ней дружно подсели на ИИ. CI зелёный. Покрытие почти сто процентов. Фичи выкатываются быстрее, чем раньше. А теперь подойдите к любому и попросите у доски объяснить, как вообще устроена система: где границы модулей, почему контракты именно такие, что рванёт, если потянуть вот за этот сервис. И окажется, что целиком этого не знает никто. Код есть, он работает, и его никто не понимает. Самое удобное объяснение звучит так: значит, набрали слабых инженеров. Я хочу показать, что это объяснение неверное, и что за последние два года накопилось достаточно данных, чтобы говорить не про чьи-то личные провалы, а про свойство самой системы.

    habr.com/ru/articles/1053830/

    #ИИассистенты #вайбкодинг #технический_долг #code_review #качество_кода #метрики_разработки #DORA #METR #управление_разработкой #deskilling

  2. Как широкий доступ к ИИ‑кодогенерации тихо разъедает инженерную команду

    Представьте свою команду через пару лет после того, как все в ней дружно подсели на ИИ. CI зелёный. Покрытие почти сто процентов. Фичи выкатываются быстрее, чем раньше. А теперь подойдите к любому и попросите у доски объяснить, как вообще устроена система: где границы модулей, почему контракты именно такие, что рванёт, если потянуть вот за этот сервис. И окажется, что целиком этого не знает никто. Код есть, он работает, и его никто не понимает. Самое удобное объяснение звучит так: значит, набрали слабых инженеров. Я хочу показать, что это объяснение неверное, и что за последние два года накопилось достаточно данных, чтобы говорить не про чьи-то личные провалы, а про свойство самой системы.

    habr.com/ru/articles/1053830/

    #ИИассистенты #вайбкодинг #технический_долг #code_review #качество_кода #метрики_разработки #DORA #METR #управление_разработкой #deskilling

  3. Как широкий доступ к ИИ‑кодогенерации тихо разъедает инженерную команду

    Представьте свою команду через пару лет после того, как все в ней дружно подсели на ИИ. CI зелёный. Покрытие почти сто процентов. Фичи выкатываются быстрее, чем раньше. А теперь подойдите к любому и попросите у доски объяснить, как вообще устроена система: где границы модулей, почему контракты именно такие, что рванёт, если потянуть вот за этот сервис. И окажется, что целиком этого не знает никто. Код есть, он работает, и его никто не понимает. Самое удобное объяснение звучит так: значит, набрали слабых инженеров. Я хочу показать, что это объяснение неверное, и что за последние два года накопилось достаточно данных, чтобы говорить не про чьи-то личные провалы, а про свойство самой системы.

    habr.com/ru/articles/1053830/

    #ИИассистенты #вайбкодинг #технический_долг #code_review #качество_кода #метрики_разработки #DORA #METR #управление_разработкой #deskilling

  4. ИИ уже пишет 80% кода Anthropic. Самое тревожное спрятано в цифре, которую подают как успех

    Anthropic отчиталась, что больше 80% её кода теперь пишет Claude, — а её же автоматический проверяющий ловит лишь треть прошлых ошибок, то есть две трети пропускает. Если код пишет один ИИ, а проверяет такой же — они слепнут в одних и тех же местах, и второй контур даёт не защиту, а общую слепую зону. Разбираю на инженерном уровне, почему «проверка ИИ» не равна независимой проверке, как измерить слепое пятно и как сюда ложится двухконтурная схема из мира промышленной безопасности (IEC 61508).

    habr.com/ru/articles/1044850/

    #самогенерация_ИИ #независимая_проверка #валидаторы #мутационное_тестирование #формальная_верификация #ПЛК #IEC61508 #METR #надежность_кода #anthropic

  5. ИИ уже пишет 80% кода Anthropic. Самое тревожное спрятано в цифре, которую подают как успех

    Anthropic отчиталась, что больше 80% её кода теперь пишет Claude, — а её же автоматический проверяющий ловит лишь треть прошлых ошибок, то есть две трети пропускает. Если код пишет один ИИ, а проверяет такой же — они слепнут в одних и тех же местах, и второй контур даёт не защиту, а общую слепую зону. Разбираю на инженерном уровне, почему «проверка ИИ» не равна независимой проверке, как измерить слепое пятно и как сюда ложится двухконтурная схема из мира промышленной безопасности (IEC 61508).

    habr.com/ru/articles/1044850/

    #самогенерация_ИИ #независимая_проверка #валидаторы #мутационное_тестирование #формальная_верификация #ПЛК #IEC61508 #METR #надежность_кода #anthropic

  6. ИИ уже пишет 80% кода Anthropic. Самое тревожное спрятано в цифре, которую подают как успех

    Anthropic отчиталась, что больше 80% её кода теперь пишет Claude, — а её же автоматический проверяющий ловит лишь треть прошлых ошибок, то есть две трети пропускает. Если код пишет один ИИ, а проверяет такой же — они слепнут в одних и тех же местах, и второй контур даёт не защиту, а общую слепую зону. Разбираю на инженерном уровне, почему «проверка ИИ» не равна независимой проверке, как измерить слепое пятно и как сюда ложится двухконтурная схема из мира промышленной безопасности (IEC 61508).

    habr.com/ru/articles/1044850/

    #самогенерация_ИИ #независимая_проверка #валидаторы #мутационное_тестирование #формальная_верификация #ПЛК #IEC61508 #METR #надежность_кода #anthropic

  7. Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.

    #ai #metr #asi #agi

    garymarcus.substack.com/p/misp

  8. Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.

    #ai #metr #asi #agi

    garymarcus.substack.com/p/misp

  9. Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.

    #ai #metr #asi #agi

    garymarcus.substack.com/p/misp

  10. Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.

    #ai #metr #asi #agi

    garymarcus.substack.com/p/misp

  11. Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.

    #ai #metr #asi #agi

    garymarcus.substack.com/p/misp

  12. An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:

    “We Are Changing Our Developer Productivity Experiment Design”, METR (metr.org/blog/2026-02-24-uplif).

    On HN: news.ycombinator.com/item?id=4

  13. An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:

    “We Are Changing Our Developer Productivity Experiment Design”, METR (metr.org/blog/2026-02-24-uplif).

    On HN: news.ycombinator.com/item?id=4

  14. An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:

    “We Are Changing Our Developer Productivity Experiment Design”, METR (metr.org/blog/2026-02-24-uplif).

    On HN: news.ycombinator.com/item?id=4

  15. An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:

    “We Are Changing Our Developer Productivity Experiment Design”, METR (metr.org/blog/2026-02-24-uplif).

    On HN: news.ycombinator.com/item?id=4

  16. An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:

    “We Are Changing Our Developer Productivity Experiment Design”, METR (metr.org/blog/2026-02-24-uplif).

    On HN: news.ycombinator.com/item?id=4

  17. Вас пугают AI-увольнениями. Я посмотрел — кто это делает и зачем

    Год назад METR доказали что AI замедляет разработчиков на 19%. В феврале 2026 обновили данные - похоже на разворот к ускорению. Но об этом почти не написали. Зато «AI уволит 50% разработчиков» - в каждом втором заголовке. Полез разбираться, кому выгодна AI-паника. Нашёл CEO, которые увольняют тысячи и тихо нанимают обратно. Нашёл вендоров, которые пугают увольнениями и одновременно открывают вакансии. И курсы «защити карьеру от AI» за $23 000.

    habr.com/ru/articles/1017884/

    #AI #страхономика #AIпаника #увольнения #продуктивность #METR #Klarna #Block

  18. Вас пугают AI-увольнениями. Я посмотрел — кто это делает и зачем

    Год назад METR доказали что AI замедляет разработчиков на 19%. В феврале 2026 обновили данные - похоже на разворот к ускорению. Но об этом почти не написали. Зато «AI уволит 50% разработчиков» - в каждом втором заголовке. Полез разбираться, кому выгодна AI-паника. Нашёл CEO, которые увольняют тысячи и тихо нанимают обратно. Нашёл вендоров, которые пугают увольнениями и одновременно открывают вакансии. И курсы «защити карьеру от AI» за $23 000.

    habr.com/ru/articles/1017884/

    #AI #страхономика #AIпаника #увольнения #продуктивность #METR #Klarna #Block

  19. Вас пугают AI-увольнениями. Я посмотрел — кто это делает и зачем

    Год назад METR доказали что AI замедляет разработчиков на 19%. В феврале 2026 обновили данные - похоже на разворот к ускорению. Но об этом почти не написали. Зато «AI уволит 50% разработчиков» - в каждом втором заголовке. Полез разбираться, кому выгодна AI-паника. Нашёл CEO, которые увольняют тысячи и тихо нанимают обратно. Нашёл вендоров, которые пугают увольнениями и одновременно открывают вакансии. И курсы «защити карьеру от AI» за $23 000.

    habr.com/ru/articles/1017884/

    #AI #страхономика #AIпаника #увольнения #продуктивность #METR #Klarna #Block

  20. AI's Version of Moore's Law? - Computerphile

    youtube.com/watch?v=evSFeqTZdqs
    metr.org

    Note that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.

    #AI #LLM #OpenAI #Anthropic #METR

  21. AI's Version of Moore's Law? - Computerphile

    youtube.com/watch?v=evSFeqTZdqs
    metr.org

    Note that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.

    #AI #LLM #OpenAI #Anthropic #METR

  22. AI's Version of Moore's Law? - Computerphile

    youtube.com/watch?v=evSFeqTZdqs
    metr.org

    Note that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.

    #AI #LLM #OpenAI #Anthropic #METR

  23. AI's Version of Moore's Law? - Computerphile

    youtube.com/watch?v=evSFeqTZdqs
    metr.org

    Note that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.

    #AI #LLM #OpenAI #Anthropic #METR

  24. AI's Version of Moore's Law? - Computerphile

    youtube.com/watch?v=evSFeqTZdqs
    metr.org

    Note that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.

    #AI #LLM #OpenAI #Anthropic #METR

  25. 🚨 KI-Agenten exponentiell besser? METR zeigt steigende "Time Horizons" – aber 50% Erfolg = jeder 2. Versuch scheitert. Log-Skala: stabiler.

    👉 Meine Einschätzung: Wirtschaftlich relevant, aber kein Beweis für baldige Agentenübernahmen.

    (Picture Credits to METR, via metr org, abgerufen am 22.2.26, "Model Evaluation & Threat Research", Social-Media-Bearbeitung und Screenshot druch: Marlon Niklas Kaulich)

    #KI #AIAgents #METR #KünstlicheIntelligenz

  26. Cari #devs,

    Uno studio #METR ha scoperto che gli sviluppatori esperti erano convinti che l’#AI li rendesse più rapidi del 20%.

    Realtà dei fatti: impiegavano il 19% di tempo in più.

    Percezione vs realtà

    🔗 metr.org/blog/2025-07-10-early

    #llm #claudecode #chatgpt #codex #gemini #agents #agentsai

  27. Cari #devs,

    Uno studio #METR ha scoperto che gli sviluppatori esperti erano convinti che l’#AI li rendesse più rapidi del 20%.

    Realtà dei fatti: impiegavano il 19% di tempo in più.

    Percezione vs realtà

    🔗 metr.org/blog/2025-07-10-early

    #llm #claudecode #chatgpt #codex #gemini #agents #agentsai

  28. Cari #devs,

    Uno studio #METR ha scoperto che gli sviluppatori esperti erano convinti che l’#AI li rendesse più rapidi del 20%.

    Realtà dei fatti: impiegavano il 19% di tempo in più.

    Percezione vs realtà

    🔗 metr.org/blog/2025-07-10-early

    #llm #claudecode #chatgpt #codex #gemini #agents #agentsai