이 논문은 자율 에이전트 시스템에서 월드 모델(world models) 사용 시 발생하는 보안 취약점에 대해 논합니다. 특히, 텍스트 기반 에이전트에서 월드 모델의 오작동이 악성 코드 실행, 민감 데이터 유출 등 심각한 보안 위험을 초래할 수 있음을 보여줍니다. 연구진은 이를 검증하기 위한 보안 벤치마크 데이터셋을 제시하고, 공격자가 월드 모델의 오기 예측을 유도하여 최대 95%의 성공률로 원치 않는 명령 실행, 서비스 거부, 금전 유출 등을 일으킬 수 있음을 입증합니다.