home.social

#interpretable_ml — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #interpretable_ml, aggregated by home.social.

  1. Как «думает» ИИ: гроккаем разреженные автоэнкодеры (SAE)

    В этой статье разберём исследование от компании Anthropic, которое демонстрирует практическую возможность вскрытия «черного ящика» больших языковых моделей для обеспечения их контролируемости и безопасности с помощью разреженных автоэнкодеров (SAE - Sparse AutoEncoders). И в конце, попробуем поуправлять поведением модели - заставим думать, что она Санта Клаус 🎅.

    habr.com/ru/articles/981964/

    #Сезон_ИИ_в_разработке #LLM #interpretable_ml #interpretability #interpretable_AI #искусственный_интеллект #ai_security #Steering #SAE #Sparse_AutoEncoder

  2. Как «думает» ИИ: гроккаем разреженные автоэнкодеры (SAE)

    В этой статье разберём исследование от компании Anthropic, которое демонстрирует практическую возможность вскрытия «черного ящика» больших языковых моделей для обеспечения их контролируемости и безопасности с помощью разреженных автоэнкодеров (SAE - Sparse AutoEncoders). И в конце, попробуем поуправлять поведением модели - заставим думать, что она Санта Клаус 🎅.

    habr.com/ru/articles/981964/

    #Сезон_ИИ_в_разработке #LLM #interpretable_ml #interpretability #interpretable_AI #искусственный_интеллект #ai_security #Steering #SAE #Sparse_AutoEncoder

  3. Как «думает» ИИ: гроккаем разреженные автоэнкодеры (SAE)

    В этой статье разберём исследование от компании Anthropic, которое демонстрирует практическую возможность вскрытия «черного ящика» больших языковых моделей для обеспечения их контролируемости и безопасности с помощью разреженных автоэнкодеров (SAE - Sparse AutoEncoders). И в конце, попробуем поуправлять поведением модели - заставим думать, что она Санта Клаус 🎅.

    habr.com/ru/articles/981964/

    #Сезон_ИИ_в_разработке #LLM #interpretable_ml #interpretability #interpretable_AI #искусственный_интеллект #ai_security #Steering #SAE #Sparse_AutoEncoder

  4. Как «думает» ИИ: гроккаем разреженные автоэнкодеры (SAE)

    В этой статье разберём исследование от компании Anthropic, которое демонстрирует практическую возможность вскрытия «черного ящика» больших языковых моделей для обеспечения их контролируемости и безопасности с помощью разреженных автоэнкодеров (SAE - Sparse AutoEncoders). И в конце, попробуем поуправлять поведением модели - заставим думать, что она Санта Клаус 🎅.

    habr.com/ru/articles/981964/

    #Сезон_ИИ_в_разработке #LLM #interpretable_ml #interpretability #interpretable_AI #искусственный_интеллект #ai_security #Steering #SAE #Sparse_AutoEncoder

  5. Большие и чёрные (ящики): что мы знаем о том, как «думают» нейросети?

    ChatGPT вышел уже почти два года назад, а датасаентисты до сих пор никак не могут определиться — являются ли нейросети тварями дрожащими, или всё же мыслить умеют? В этой статье мы попробуем разобраться: а как вообще учёные пытаются подойти к этому вопросу, насколько вероятен здесь успех, и что всё это означает для всех нас как для человечества. Узнать →

    habr.com/ru/companies/ods/arti

    #chatgpt #нейросети #openai #языковые_модели #llm #natural_language_processing #gpt4 #interpretable_deep_learning #interpretable_ml #длиннопост

  6. Большие и чёрные (ящики): что мы знаем о том, как «думают» нейросети?

    ChatGPT вышел уже почти два года назад, а датасаентисты до сих пор никак не могут определиться — являются ли нейросети тварями дрожащими, или всё же мыслить умеют? В этой статье мы попробуем разобраться: а как вообще учёные пытаются подойти к этому вопросу, насколько вероятен здесь успех, и что всё это означает для всех нас как для человечества. Узнать →

    habr.com/ru/companies/ods/arti

    #chatgpt #нейросети #openai #языковые_модели #llm #natural_language_processing #gpt4 #interpretable_deep_learning #interpretable_ml #длиннопост

  7. Большие и чёрные (ящики): что мы знаем о том, как «думают» нейросети?

    ChatGPT вышел уже почти два года назад, а датасаентисты до сих пор никак не могут определиться — являются ли нейросети тварями дрожащими, или всё же мыслить умеют? В этой статье мы попробуем разобраться: а как вообще учёные пытаются подойти к этому вопросу, насколько вероятен здесь успех, и что всё это означает для всех нас как для человечества. Узнать →

    habr.com/ru/companies/ods/arti

    #chatgpt #нейросети #openai #языковые_модели #llm #natural_language_processing #gpt4 #interpretable_deep_learning #interpretable_ml #длиннопост