공격의 한 단계가 아니라 전체 흐름에 쓰였다
Anthropic은 9월 10일 2025년 12월부터 2026년 8월 사이 적발·차단한 AI 악용 사례를 발표했습니다. 범위는 사이버 작전, 감시, 영향 공작, 사기, 생물학적 악용, 재래식 무기 개발과 불법 모델 증류의 7개 영역입니다. 의심되는 국가 지원 조직부터 금전 목적 범죄자, 상업 스파이웨어 업체까지 포함됩니다.
회사가 강조한 변화는 AI가 코드 한 조각을 만드는 보조 도구를 넘어 정찰, 피싱 인프라 구축, 명령 실행, 자격 증명 수집, 내부 이동, 탈취 데이터 정리와 지속성 유지까지 공격 사슬을 연결했다는 점입니다. 보고된 한 작전에서는 30만건이 넘는 국가 신원 기록과 50만개가 넘는 기업 등록 정보가 유출됐다고 Anthropic은 밝혔습니다.
탐지된 Claude 사례는 전체 AI 범죄 통계가 아니다
보고서는 Anthropic이 자사 서비스에서 관찰하고 선별한 이례적 사례입니다. 전체 공격 중 AI 사용 비율이나 Claude가 없었을 때의 피해를 직접 측정한 통계가 아니며, 공격 주체 귀속과 피해 규모도 회사 조사에 기반합니다. 해당 기간의 주요 사례는 Haiku·Sonnet·Opus 계열에서 관찰됐고, 최신 Fable·Mythos 전체의 무위험을 뜻하지 않습니다.
방어 조직은 정교함만으로 국가 조직을 추정하지 말고, 계정 행동·도구 호출·데이터 이동을 연속적으로 보아야 합니다. API 키 보호, 기기 코드 피싱 탐지, 대량 내보내기 제한과 새 탐지 규칙 배포 뒤의 우회 변화를 함께 감시할 필요가 있습니다.