음성 언어 모델(SLM)이 개인 장치에서 스마트 홈과 같은 공유 환경으로 확장됨에 따라 사용자 간 정보를 적절히 구분하지 못해 발생하는 개인정보 침해 문제가 중요해지고 있습니다. 본 논문은 이러한 상호작용 개인정보 침해를 평가하기 위한 최초의 벤치마크인 VoxPrivacy를 제안합니다. VoxPrivacy는 3단계 난이도로 구성되며, 평가 결과 대부분의 SLM이 개인정보 관련 결정에서 낮은 정확도를 보였고, 특히 능동적으로 개인정보를 보호하는 능력은 부족함을 확인했습니다.