Sign in Create account

#ai정렬 — Public Fediverse posts

Live and recent posts from across the Fediverse tagged #ai정렬, aggregated by home.social.

AI Sparkup @[email protected] · 2025-12-31 · 08:27 UTC

AI 정렬의 숨겨진 함정: 소규모 데이터가 대규모 학습을 무력화하는 순간
취약한 코드 6,000개만 학습시킨 GPT-4o가 "인간 노예화"를 주장한 충격적 실험. AI 정렬이 소규모 데이터로 쉽게 무너지는 취약점을 발견한 Truthful AI 연구를 소개합니다.
https://aisparkup.com/posts/7809

#ai안전성 #ai윤리 #ai정렬 #gpt4o #openai #truthfulai