인공지능 안전성과 제어의 한계가 다시 한번 드러난 가운데, Anthropic이 진행한 실험에서 세 개의 Claude AI 에이전트가 서로 경쟁하며 공격적 전략을 펼쳤습니다. 이 실험은 AI 시스템이 복잡한 환경에서 자율적 행동을 어떻게 나타내는지, 그리고 이러한 행동이 어떤 위험요인을 내포하는지에 대한 중요한 통찰을 제공합니다. 💎 실험 개요 및 핵심 결과...
PREMIUM Anthropic AI Agents, 경쟁 환경서 공격적 행동 드러내