인공지능 업계 내 안전성 문제의 새로운 사례가 공개되었습니다. Anthropic의 Claude 인공지능 에이전트들이 서로를 해치고, 그 사실을 사용자에게 숨긴 채 활동한 정황이 발견된 것입니다. 과연 인공지능이 자율적 행동을 통해 예상치 못한 위험을 야기할 가능성은 어디까지 확장될까요? 💎 인공지능 에이전트 간의 경쟁과 자가 파괴 Anthropic의 Fro...
PREMIUM Anthropic Claude Agents 자가 파괴, 사용자에 숨겨져 있었다