안전·정렬·해석가능성Anthropic
'Detecting and countering misuse of AI
'Detecting and countering misuse of AI: September 2026' 공개 — 2025년 12월~2026년 8월 차단한 오남용 작전을 7개 유형으로 정리. 러시아 첩보 GTG-20006 은 개발·인프라 확보·피싱·지속성·C2·데이터 유출까지 자동화해 우크라이나·유럽 등 20개 이상 조직을 표적으로 삼고 국가 신원기록 30만 건 이상을 탈취했고, GTG-50014 는 안드로이드 APK 180만 개를 내려받아 자격증명을 수집한 뒤 SaaS 공급망 공격으로 34시간 만에 기업 테넌트 40여 곳에 접근함. 중국계 GTG-10007 은 자율 연구 프로그램으로 한 달에 12개 이상의 제로데이를 찾아냈고, GTG-50020 은 여러 제공사의 프로덕션 AI API 키를 직접 표적으로 삼아 미공개 Claude 모델 접근을 시도했다가 실패함. Anthropic 은 '정교한 공격에 더 이상 정교한 공격자가 필요하지 않다'며 AI 가 노동·도구 격차를 무너뜨렸다고 밝힘.
왜 중요한가
공격 자동화의 임계가 넘어간 지점을 1차 사업자가 수치와 함께 기록한 문서로, AI 공급망(API 키) 자체가 표적이 되기 시작했음을 보여준다.
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
공식 발표anthropic.comhttps://www.anthropic.com/threat-intelligence-report-september-20262026년 9월 14일에 더한 조각 · 그 주 보기
같은 주에 나온 조각09.11'Scaling Storage for 1 Billion ChatGPT Users (Part I)' 공개공식 발표09.10Agents API 퍼블릭 베타 공개공식 발표09.10ChatGPT Work 에 Data agent 를 공개함공식 발표09.10클라우드 샌드박스에서 실제 셸을 과제당 300턴 이상 조작하며 각 과제 자체의 검증기로 보상을 받는 122B…논문