#metr — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #metr, aggregated by home.social.
-
Azerbaijan embassy in Kyiv damaged by Russian missile strike https://www.byteseu.com/2209261/ #Azerbaijan #ballistik #dağıntılar #hücumu #kiyev #metr #raket #RepublicOfAzerbaijan #rusiya #təfərrüatlar
-
Как широкий доступ к ИИ‑кодогенерации тихо разъедает инженерную команду
Представьте свою команду через пару лет после того, как все в ней дружно подсели на ИИ. CI зелёный. Покрытие почти сто процентов. Фичи выкатываются быстрее, чем раньше. А теперь подойдите к любому и попросите у доски объяснить, как вообще устроена система: где границы модулей, почему контракты именно такие, что рванёт, если потянуть вот за этот сервис. И окажется, что целиком этого не знает никто. Код есть, он работает, и его никто не понимает. Самое удобное объяснение звучит так: значит, набрали слабых инженеров. Я хочу показать, что это объяснение неверное, и что за последние два года накопилось достаточно данных, чтобы говорить не про чьи-то личные провалы, а про свойство самой системы.
https://habr.com/ru/articles/1053830/
#ИИассистенты #вайбкодинг #технический_долг #code_review #качество_кода #метрики_разработки #DORA #METR #управление_разработкой #deskilling
-
Как широкий доступ к ИИ‑кодогенерации тихо разъедает инженерную команду
Представьте свою команду через пару лет после того, как все в ней дружно подсели на ИИ. CI зелёный. Покрытие почти сто процентов. Фичи выкатываются быстрее, чем раньше. А теперь подойдите к любому и попросите у доски объяснить, как вообще устроена система: где границы модулей, почему контракты именно такие, что рванёт, если потянуть вот за этот сервис. И окажется, что целиком этого не знает никто. Код есть, он работает, и его никто не понимает. Самое удобное объяснение звучит так: значит, набрали слабых инженеров. Я хочу показать, что это объяснение неверное, и что за последние два года накопилось достаточно данных, чтобы говорить не про чьи-то личные провалы, а про свойство самой системы.
https://habr.com/ru/articles/1053830/
#ИИассистенты #вайбкодинг #технический_долг #code_review #качество_кода #метрики_разработки #DORA #METR #управление_разработкой #deskilling
-
Как широкий доступ к ИИ‑кодогенерации тихо разъедает инженерную команду
Представьте свою команду через пару лет после того, как все в ней дружно подсели на ИИ. CI зелёный. Покрытие почти сто процентов. Фичи выкатываются быстрее, чем раньше. А теперь подойдите к любому и попросите у доски объяснить, как вообще устроена система: где границы модулей, почему контракты именно такие, что рванёт, если потянуть вот за этот сервис. И окажется, что целиком этого не знает никто. Код есть, он работает, и его никто не понимает. Самое удобное объяснение звучит так: значит, набрали слабых инженеров. Я хочу показать, что это объяснение неверное, и что за последние два года накопилось достаточно данных, чтобы говорить не про чьи-то личные провалы, а про свойство самой системы.
https://habr.com/ru/articles/1053830/
#ИИассистенты #вайбкодинг #технический_долг #code_review #качество_кода #метрики_разработки #DORA #METR #управление_разработкой #deskilling
-
ИИ уже пишет 80% кода Anthropic. Самое тревожное спрятано в цифре, которую подают как успех
Anthropic отчиталась, что больше 80% её кода теперь пишет Claude, — а её же автоматический проверяющий ловит лишь треть прошлых ошибок, то есть две трети пропускает. Если код пишет один ИИ, а проверяет такой же — они слепнут в одних и тех же местах, и второй контур даёт не защиту, а общую слепую зону. Разбираю на инженерном уровне, почему «проверка ИИ» не равна независимой проверке, как измерить слепое пятно и как сюда ложится двухконтурная схема из мира промышленной безопасности (IEC 61508).
https://habr.com/ru/articles/1044850/
#самогенерация_ИИ #независимая_проверка #валидаторы #мутационное_тестирование #формальная_верификация #ПЛК #IEC61508 #METR #надежность_кода #anthropic
-
ИИ уже пишет 80% кода Anthropic. Самое тревожное спрятано в цифре, которую подают как успех
Anthropic отчиталась, что больше 80% её кода теперь пишет Claude, — а её же автоматический проверяющий ловит лишь треть прошлых ошибок, то есть две трети пропускает. Если код пишет один ИИ, а проверяет такой же — они слепнут в одних и тех же местах, и второй контур даёт не защиту, а общую слепую зону. Разбираю на инженерном уровне, почему «проверка ИИ» не равна независимой проверке, как измерить слепое пятно и как сюда ложится двухконтурная схема из мира промышленной безопасности (IEC 61508).
https://habr.com/ru/articles/1044850/
#самогенерация_ИИ #независимая_проверка #валидаторы #мутационное_тестирование #формальная_верификация #ПЛК #IEC61508 #METR #надежность_кода #anthropic
-
ИИ уже пишет 80% кода Anthropic. Самое тревожное спрятано в цифре, которую подают как успех
Anthropic отчиталась, что больше 80% её кода теперь пишет Claude, — а её же автоматический проверяющий ловит лишь треть прошлых ошибок, то есть две трети пропускает. Если код пишет один ИИ, а проверяет такой же — они слепнут в одних и тех же местах, и второй контур даёт не защиту, а общую слепую зону. Разбираю на инженерном уровне, почему «проверка ИИ» не равна независимой проверке, как измерить слепое пятно и как сюда ложится двухконтурная схема из мира промышленной безопасности (IEC 61508).
https://habr.com/ru/articles/1044850/
#самогенерация_ИИ #независимая_проверка #валидаторы #мутационное_тестирование #формальная_верификация #ПЛК #IEC61508 #METR #надежность_кода #anthropic
-
Claude Mythos、3時間の自律タスクを突破——AI進化の時間軸が再び前倒しに — BigGo ファイナンス https://www.yayafa.com/2815336/ #AgenticAi #AI #AI2027 #AIエージェント #Anthropic #AnthropicClaude #ArtificialGeneralIntelligence #ArtificialIntelligence #así #claude #ClaudeMythos #METR #インテリジェント分析スタック #エージェント型AI #人工知能 #新智元 #汎用人工知能
-
Claude Mythos、3時間の自律タスクを突破——AI進化の時間軸が再び前倒しに — BigGo ファイナンス https://www.yayafa.com/2815336/ #AgenticAi #AI #AI2027 #AIエージェント #Anthropic #AnthropicClaude #ArtificialGeneralIntelligence #ArtificialIntelligence #así #claude #ClaudeMythos #METR #インテリジェント分析スタック #エージェント型AI #人工知能 #新智元 #汎用人工知能
-
Claude Mythos、3時間の自律タスクを突破——AI進化の時間軸が再び前倒しに — BigGo ファイナンス https://www.yayafa.com/2815336/ #AgenticAi #AI #AI2027 #AIエージェント #Anthropic #AnthropicClaude #ArtificialGeneralIntelligence #ArtificialIntelligence #así #claude #ClaudeMythos #METR #インテリジェント分析スタック #エージェント型AI #人工知能 #新智元 #汎用人工知能
-
Claude Mythos、3時間の自律タスクを突破——AI進化の時間軸が再び前倒しに — BigGo ファイナンス https://www.yayafa.com/2815336/ #AgenticAi #AI #AI2027 #AIエージェント #Anthropic #AnthropicClaude #ArtificialGeneralIntelligence #ArtificialIntelligence #así #claude #ClaudeMythos #METR #インテリジェント分析スタック #エージェント型AI #人工知能 #新智元 #汎用人工知能
-
https://www.europesays.com/pl/466220/ AI w kodowaniu uzależnia szybciej, niż poprawia jakość. Deweloperzy przyspieszają na starcie, ale ryzykują dług techniczny #ai #anthropic #badanie #Biznes #Business #ClaudeCode #Cursor #deweloper #deweloperzy #DługTechniczny #GitHubCopilot #metr #openai #PL #Poland #Polish #Polska #Polski #programisci #programista #programowanie #SMU
-
https://www.europesays.com/people/86062/ OpenAI preparing to automate AI research jobs, hiring humans to fire them later #AICodingTools #AiJobs #AISafety #Anthropic #AutomatedAIResearcher #metr #OpenAI #SamAltman
-
OpenAI Hires in Preparation for AI That Could Train Itself
OpenAI has set the goal of making an AI tool that could research its own improvements. Now, the…
#NewsBeep #News #Artificialintelligence #AI #aisafety #Anthropic #ArtificialIntelligence #CA #Canada #company #frontieraimodel #goal #implication #lab #metr #model #month #openaihires #posting #researcher #Technology #tool #work
https://www.newsbeep.com/ca/690962/ -
https://www.europesays.com/uk/980906/ OpenAI Hires in Preparation for AI That Could Train Itself #AI #AISafety #Anthropic #ArtificialIntelligence #company #FrontierAiModel #goal #implication #lab #metr #model #month #OpenaiHires #posting #researcher #Technology #Tool #UK #UnitedKingdom #Work
-
https://www.tkhunt.com/2337417/ AIが人間を欺き監視を回避|大手4社の社内AIをMETRが検査 #METR #AI安全 #Shorts #AgenticAi #AI #AIエージェント #aiニュース #AI安全 #AI監視 #AI解説 #anthropic #ArtificialIntelligence #google #META #METR #openai #RogueAI #エージェント型AI #ずんだもん #フロンティアAI #人工知能
-
https://www.tkhunt.com/2337417/ AIが人間を欺き監視を回避|大手4社の社内AIをMETRが検査 #METR #AI安全 #Shorts #AgenticAi #AI #AIエージェント #aiニュース #AI安全 #AI監視 #AI解説 #anthropic #ArtificialIntelligence #google #META #METR #openai #RogueAI #エージェント型AI #ずんだもん #フロンティアAI #人工知能
-
https://www.tkhunt.com/2337417/ AIが人間を欺き監視を回避|大手4社の社内AIをMETRが検査 #METR #AI安全 #Shorts #AgenticAi #AI #AIエージェント #aiニュース #AI安全 #AI監視 #AI解説 #anthropic #ArtificialIntelligence #google #META #METR #openai #RogueAI #エージェント型AI #ずんだもん #フロンティアAI #人工知能
-
https://www.tkhunt.com/2337417/ AIが人間を欺き監視を回避|大手4社の社内AIをMETRが検査 #METR #AI安全 #Shorts #AgenticAi #AI #AIエージェント #aiニュース #AI安全 #AI監視 #AI解説 #anthropic #ArtificialIntelligence #google #META #METR #openai #RogueAI #エージェント型AI #ずんだもん #フロンティアAI #人工知能
-
https://www.europesays.com/people/83574/ OpenAI Hires in Preparation for AI That Could Train Itself #AI #AISafety #Anthropic #company #FrontierAiModel #goal #implication #metr #model #month #OpenaiHires #posting #researcher #SamAltman #tool #work
-
Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.
https://garymarcus.substack.com/p/misplaced-panic-over-ai-progress
-
Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.
https://garymarcus.substack.com/p/misplaced-panic-over-ai-progress
-
Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.
https://garymarcus.substack.com/p/misplaced-panic-over-ai-progress
-
Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.
https://garymarcus.substack.com/p/misplaced-panic-over-ai-progress
-
Gary Marcus has a good article on METR, a think tank that evaluates AI, and how to interpret what's really going on. Some good sources for understanding here. Esp. Ramez Naam.
https://garymarcus.substack.com/p/misplaced-panic-over-ai-progress
-
https://www.europesays.com/pl/421668/ Czy wydłużenie lewoskrętu może rozładować korki? #artykuł #artykuły #auto #autohandel #chaos #CzęśćiZamienne #gdańsk #godzina #GodzinaSzczytu #komis #korek #kowal #Kowale #lewoskręt #metr #modele #moto #motocykle #motoryzacja #PL #pokłosie #Poland #Polish #Polska #Polski #porady #portal #rondo #SalonSamochodowy #samochody #stopień #światło #sygnalizacja #Sygnalizacjaświetlna #szczyt #testy #UsługiMotoryzacyjne
-
https://www.europesays.com/pl/413551/ Dziura w drodze jak krater wulkanu. Miała ponad metr głębokości #chłopska #droga #dziura #gdańsk #gdynia #głębokość #informacja #jezdnia #kierowca #kołobrzeska #krater #MartaKurowska #metr #norma #obowiązek #patrol #PL #pojazd #Poland #Polish #Polska #Polski #pracownik #problem #przymorze #skm #służba #sopot #sprawa #Średnica #StrażMiejska #StrażMiejskaGdańsk #strażnik #sytuacja #wiadukt #WielkaDziuraWDrodze #wulkan #wyrwa #zagrozenie #zjawisko
-
https://www.europesays.com/pl/376324/ Arkadiusz Gardzielewski i Aneta Jarosz Karwowska wygrali w Energa Maratonie Gdańsk #AnetaJaroszKarwowska #ArkadiuszGardzielewski #bieg #czas #energa #EnergaGdańskMaraton #EnergaMaratonGdańsk #gdańsk #gole #informacje #koszykówka #linia #marato #Maraton #meta #metr #OpinieUżytkowników #osoba #pani #PiłkaNożna #PL #Poland #Polish #Polska #Polski #relacje #siatkowka #Sport #start #sztafeta #trasa #ulica #Wiadomości #WiadomościSportowe #zuzel #zwycięstwo
-
An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:
“We Are Changing Our Developer Productivity Experiment Design”, METR (https://metr.org/blog/2026-02-24-uplift-update/).
-
An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:
“We Are Changing Our Developer Productivity Experiment Design”, METR (https://metr.org/blog/2026-02-24-uplift-update/).
-
An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:
“We Are Changing Our Developer Productivity Experiment Design”, METR (https://metr.org/blog/2026-02-24-uplift-update/).
-
An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:
“We Are Changing Our Developer Productivity Experiment Design”, METR (https://metr.org/blog/2026-02-24-uplift-update/).
-
An important update 🚨 to the #METR study on developer #productivity using #AI – instead of 20% loss 📉, they now see a 20% gain 📈 in one year 🤯:
“We Are Changing Our Developer Productivity Experiment Design”, METR (https://metr.org/blog/2026-02-24-uplift-update/).
-
Вас пугают AI-увольнениями. Я посмотрел — кто это делает и зачем
Год назад METR доказали что AI замедляет разработчиков на 19%. В феврале 2026 обновили данные - похоже на разворот к ускорению. Но об этом почти не написали. Зато «AI уволит 50% разработчиков» - в каждом втором заголовке. Полез разбираться, кому выгодна AI-паника. Нашёл CEO, которые увольняют тысячи и тихо нанимают обратно. Нашёл вендоров, которые пугают увольнениями и одновременно открывают вакансии. И курсы «защити карьеру от AI» за $23 000.
https://habr.com/ru/articles/1017884/
#AI #страхономика #AIпаника #увольнения #продуктивность #METR #Klarna #Block
-
Вас пугают AI-увольнениями. Я посмотрел — кто это делает и зачем
Год назад METR доказали что AI замедляет разработчиков на 19%. В феврале 2026 обновили данные - похоже на разворот к ускорению. Но об этом почти не написали. Зато «AI уволит 50% разработчиков» - в каждом втором заголовке. Полез разбираться, кому выгодна AI-паника. Нашёл CEO, которые увольняют тысячи и тихо нанимают обратно. Нашёл вендоров, которые пугают увольнениями и одновременно открывают вакансии. И курсы «защити карьеру от AI» за $23 000.
https://habr.com/ru/articles/1017884/
#AI #страхономика #AIпаника #увольнения #продуктивность #METR #Klarna #Block
-
Вас пугают AI-увольнениями. Я посмотрел — кто это делает и зачем
Год назад METR доказали что AI замедляет разработчиков на 19%. В феврале 2026 обновили данные - похоже на разворот к ускорению. Но об этом почти не написали. Зато «AI уволит 50% разработчиков» - в каждом втором заголовке. Полез разбираться, кому выгодна AI-паника. Нашёл CEO, которые увольняют тысячи и тихо нанимают обратно. Нашёл вендоров, которые пугают увольнениями и одновременно открывают вакансии. И курсы «защити карьеру от AI» за $23 000.
https://habr.com/ru/articles/1017884/
#AI #страхономика #AIпаника #увольнения #продуктивность #METR #Klarna #Block
-
AI's Version of Moore's Law? - Computerphile
https://www.youtube.com/watch?v=evSFeqTZdqs
https://metr.orgNote that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.
-
AI's Version of Moore's Law? - Computerphile
https://www.youtube.com/watch?v=evSFeqTZdqs
https://metr.orgNote that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.
-
AI's Version of Moore's Law? - Computerphile
https://www.youtube.com/watch?v=evSFeqTZdqs
https://metr.orgNote that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.
-
AI's Version of Moore's Law? - Computerphile
https://www.youtube.com/watch?v=evSFeqTZdqs
https://metr.orgNote that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.
-
AI's Version of Moore's Law? - Computerphile
https://www.youtube.com/watch?v=evSFeqTZdqs
https://metr.orgNote that the success rate on the default chart is only 50% and for 80% the score is much lower. But the interesting part is indeed the rate of progress.
-
🚨 KI-Agenten exponentiell besser? METR zeigt steigende "Time Horizons" – aber 50% Erfolg = jeder 2. Versuch scheitert. Log-Skala: stabiler.
👉 Meine Einschätzung: Wirtschaftlich relevant, aber kein Beweis für baldige Agentenübernahmen.
(Picture Credits to METR, via metr org, abgerufen am 22.2.26, "Model Evaluation & Threat Research", Social-Media-Bearbeitung und Screenshot druch: Marlon Niklas Kaulich)
-
Anthropic Drops Hard Safety Limits From its AI Scaling Policy
#AI #Anthropic #ResponsibleScalingPolicy #AISafety #AIRegulation #AISafety #AIModels #AITraining #CatastrophicRisk #METR #TrumpAdministration #Claude
-
Anthropic Drops Hard Safety Limits From its AI Scaling Policy
#AI #Anthropic #ResponsibleScalingPolicy #AISafety #AIRegulation #AISafety #AIModels #AITraining #CatastrophicRisk #METR #TrumpAdministration #Claude
-
Anthropic Drops Hard Safety Limits From its AI Scaling Policy
#AI #Anthropic #ResponsibleScalingPolicy #AISafety #AIRegulation #AISafety #AIModels #AITraining #CatastrophicRisk #METR #TrumpAdministration #Claude
-
Anthropic Drops Hard Safety Limits From its AI Scaling Policy
#AI #Anthropic #ResponsibleScalingPolicy #AISafety #AIRegulation #AISafety #AIModels #AITraining #CatastrophicRisk #METR #TrumpAdministration #Claude
-
Anthropic Drops Hard Safety Limits From its AI Scaling Policy
#AI #Anthropic #ResponsibleScalingPolicy #AISafety #AIRegulation #AISafety #AIModels #AITraining #CatastrophicRisk #METR #TrumpAdministration #Claude
-
Cari #devs,
Uno studio #METR ha scoperto che gli sviluppatori esperti erano convinti che l’#AI li rendesse più rapidi del 20%.
Realtà dei fatti: impiegavano il 19% di tempo in più.
Percezione vs realtà
🔗 https://metr.org/blog/2025-07-10-early-2025-ai-experienced-os-dev-study/?utm_source=perplexity
-
Cari #devs,
Uno studio #METR ha scoperto che gli sviluppatori esperti erano convinti che l’#AI li rendesse più rapidi del 20%.
Realtà dei fatti: impiegavano il 19% di tempo in più.
Percezione vs realtà
🔗 https://metr.org/blog/2025-07-10-early-2025-ai-experienced-os-dev-study/?utm_source=perplexity
-
Cari #devs,
Uno studio #METR ha scoperto che gli sviluppatori esperti erano convinti che l’#AI li rendesse più rapidi del 20%.
Realtà dei fatti: impiegavano il 19% di tempo in più.
Percezione vs realtà
🔗 https://metr.org/blog/2025-07-10-early-2025-ai-experienced-os-dev-study/?utm_source=perplexity