home.social

#ai_safety — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #ai_safety, aggregated by home.social.

  1. ИИ может уничтожить человечество с вероятностью выше 10%. Чего именно боятся исследователи

    9 сентября руководитель Alignment Science в Anthropic Эван Хубингер написал довольно безумную для человека на такой должности вещь: лично он оценивает вероятность того, что AI убьёт всех людей в течение ближайших десяти лет, выше 10% . Поводом стало увольнение его коллеги Джейкоба Коксона. Тот три года занимался обучением моделей в OpenAI и Anthropic, а уход объяснил тем, что считает нынешнее направление развития AI слишком опасным.

    habr.com/ru/articles/1083482/

    #искусственный_интеллект #AI_safety #alignment #AGI #экзистенциальный_риск #рекурсивное_самоулучшение #AIагенты #Anthropic #OpenAI