한국어EN

2025년 316개 조각

기록 316 · 정리 노트 0

2025 12월 24


Google (Behrouz 외)
옵티마이저를 연상 기억 모듈로 재기술하고 자기 갱신 알고리즘을 학습하는 시퀀스 모델 제안

xAI
주법이 프런티어 랩의 안전 프레임워크 공개를 강제하기 시작한 첫 사이클의 산물

Kerem Zaman 외 (UNC 채플힐)
옥스퍼드 포지션 논문에 대한 직접 반론. 쌍으로 인용할 것

NVIDIA·Groq
비-GPU 추론 IP의 편입. Groq는 독립 법인으로 존속

일본 정부 (각의)
AI추진법에 근거한 첫 법정 기본계획. 일본이 규제 최소·활용 최대 포지션을 국가 문서로 확정

Yann LeCun
LLM 이 아닌 월드 모델 노선의 독자 연구소가 생기며 담론 지형이 갈라짐

카카오
에이전틱 AI 최적화. Kanana-1.5 계보의 후속

Anthropic
사양과 레퍼런스 SDK 공개, MCP에 이은 두 번째 표준화 시도

NVIDIA
라벨 약 600장과 미라벨 PCB 약 100만 장 도메인 적응의 조합. 라벨 효율이 OSAT 현장에 직접 시사

잉글랜드·웨일스 고등법원 (Smith 판사)
2025-11-04 본안 판결이 확정이 아님을 보여주는 후속 단계. 항소심에서 다시 다투어진다

METR
12개사 정책의 공통 9요소를 정리해 사실상 업계 준표준 문서가 됨

웨이카이 (魏凯, 중국정보통신연구원 인공지능연구소장
중국 관변 싱크탱크가 안전 거버넌스를 기술발전과 대등한 축으로 공식 격상. 제조 침투의 병목을 데이터·공정지식·신뢰성으로 규정한 진단은 OSAT 현장 인식과 일치

Cohere
임베딩 한계론이 확산된 직후 리랭킹 계층의 상업적 중요도가 오히려 커졌음을 보여줌

백악관 (미국)
연방과 주가 상하 관계가 아니라 대립 관계로 전환된 지점

OLG Hamburg
상업적 TDM 예외 적용을 명시하고 자연어 opt-out의 기계가독성 미충족을 인정. BGH 상고 허가로 미확정

Linux Foundation
하네스 인터페이스가 벤더 경쟁물에서 공용 인프라로 이관, AGENTS.md 채택 6만+ 프로젝트

Anthropic·Block·OpenAI
창립 프로젝트는 MCP·goose·AGENTS.md, 공개 MCP 서버 1만 개 초과 시점

ARC Prize
2025년의 핵심 기술 변화는 탐색·검증 반복 루프였음을 확인

Google Research
롱컨텍스트 한계를 검색이 아니라 아키텍처로 우회하려는 노선

Mistral AI
675B급 프런티어 모델을 Apache 2.0으로 공개. 2025년 말 서구권 최대 규모 완전 개방 릴리스

Nous Research
분산학습이 가능하다를 넘어 동등 이상이라는 통제 비교를 처음 제시

Nous Research
미국 커뮤니티 팀이 중국 베이스 모델 위에 파인튜닝, 주도권 이동의 상징적 장면

독자 AI 파운데이션 모델 5개 정예팀
국내 대형 오픈웨이트가 한꺼번에 등장한 시점

Anthropic
커뮤니티 발 루프 패턴의 벤더 공식화

2025 11월 38


vLLM 프로젝트
텍스트 전용이던 오픈소스 서빙 인프라가 비자기회귀·멀티모달 생성까지 포괄하는 확장 신호

Liquid AI
7월 릴리스의 후속 문서. 온디바이스 계열이 기술보고서 수준의 공개 문서를 갖춘 사례다

Anthropic (Justin Young)
Claude Agent SDK를 범용 agent harness로 명시, 프런티어 랩이 harness를 정식 용어로 채택한 분기점

Ilya Sutskever
age of scaling에서 age of research로의 전환이 2026년 담론의 지배적 프레임이 됨

Black Forest Labs
Mistral-3 24B VLM과 rectified flow transformer 결합, 오픈 웨이트가 품질 격차를 좁힌 릴리스
멀티모달공식 발표

Model Context Protocol
인증 체계를 표준 OAuth 관행에 정렬시키고 스펙 운영을 위원회 절차로 이관

Anthropic
적응형 공격 대비 성공률 약 1%. 어떤 브라우저 에이전트도 면역이 아니며 문제가 해결됐다고 주장하지 않는다고 명시

Anthropic
툴 토큰 85% 절감과 동시에 MCP 평가 정확도가 Opus 4 기준 49%에서 74%로 상승, 툴을 덜 보여줄수록 정확해지는 역설

Anthropic (MacDiarmid·Hubing
프로덕션 RL의 reward hacking이 무관 영역의 광범위한 오정렬로 번짐, 완화책으로 inoculation prompting 제시

Anthropic·OpenAI·MCP-UI 공동
ui:// 스킴과 샌드박스 iframe으로 서버가 인터랙티브 UI를 제공, 경쟁 진영 공동 집필

Agility Robotics
상용 라인의 누적 실적 공개 (벤더 자체 보고)

AI2
데이터와 후속학습 파이프라인을 함께 공개

Google
정확한 인포그래픽과 다국어 텍스트 렌더링으로 이미지 생성을 추론 과제로 재정의, SynthID 탑재
멀티모달공식 발표

Apple
소비자용 실리콘 세대 교체를 로컬 LLM 추론 성능으로 직접 내세우기 시작한 자료

유럽위원회 (EU)
고위험 의무 연기·간소화 논의의 시작

Figure (BMW 사업장)
휴머노이드 최초의 정량 생산 지표. 단 발표 주체는 Figure이며 BMW의 독립 검증 문서는 아님

xAI
걸프 자본을 통한 컴퓨트 확보 경쟁. 발표문에 MW 용량·GPU 수·착공 시점이 없어 전부 계획 단계

美 상무부
걸프 자본이 컴퓨트 공급망의 3극으로 편입

Yann LeCun

Microsoft·NVIDIA·Anthropic

Google
네이티브 멀티모달 설계가 비디오·문서 이해 우위로 귀결
멀티모달공식 발표

Google DeepMind
ARC-AGI-2 SOTA가 한 번에 2배 도약

Physical Intelligence
모방학습을 넘어 경험 기반 RL로, 최난도 단계 90% 이상 성공

Sakana AI
일본 AI 스타트업 최대 규모 라운드. 계산자원 경쟁을 피하고 효율 노선을 택한다는 자기규정이 함께 명문화

xAI
정서적·창작적 상호작용을 명시적 최적화 대상으로 삼은 릴리스

BIS
미중 휴전의 규제적 반영. 2026-11-10 자동 부활

Anthropic

World Labs
텍스트·이미지·비디오에서 편집 가능한 3D 월드를 생성하고 Gaussian splat·메시로 익스포트
멀티모달공식 발표

양즈린 (杨植麟) 외 Moonshot AI
중국 랩이 오픈웨이트를 규범 언어로 정당화한 진술이자, 저비용 서사를 당사자가 직접 부인한 기록

NVIDIA
통신-연산 융합을 커널 수준에서 지원해 대규모 분산 학습·추론의 통신 병목 해소 방식을 바꾼 릴리스

LG München I
유럽에서 암기를 복제로 인정하고 TDM 예외 적용을 배제한 첫 사례

Google Cloud
임베딩 생성과 ANN 튜닝을 DB 안으로 흡수해 별도 파이프라인을 없애려는 시도

Terminal-Bench 팀
에이전트 CLI 평가에 클라우드 컨테이너 실행과 RL/SFT 롤아웃 인터페이스를 붙인 평가 인프라

Google Cloud
추론 시대용 TPU. 실제 GA는 2026-03-31

영국 고등법원 (Joanna Smith 판사)
Getty 패소로만 요약하면 틀린다. 핵심 쟁점은 판단된 것이 아니라 철회됐다

Anthropic
툴 정의가 컨텍스트를 잠식하는 문제에 대한 구조적 해법
툴·에이전트공식 발표

Andon Labs
자판기 사업을 1년간 운영시키는 장기 일관성 평가. 단발 과제로 못 보는 코히런스를 측정

Peter Steinberger
메신저 앱을 인터페이스로 삼는 로컬 상주 에이전트 형태를 대중화한 출발점

2025 10월 33


Moonshot AI
공정 비교에서 full attention을 처음 능가, KV 캐시 최대 75% 절감과 1M 컨텍스트 디코딩 최대 6배

Scale AI·CAIS
실세계 지식노동 전이 실패의 정량 증거

Jianli Zhao 외 (인민대·옥스퍼드·스탠퍼드
CoT 모니터링 낙관론에 대한 공격 측 반례

Anthropic (Jack Lindsey)
활성 주입으로 모델 내성의 인과적 증거를 제시

Amazon
클라우드 사업자가 통합 멀티모달 임베딩을 표준 상품으로 편입

OpenAI·Microsoft
AGI 선언을 독립 전문가 패널 검증으로 이관하고 자본 조달 제약을 해제

S.D.N.Y. (Stein)
NYT·Authors Guild 등 7건이 하나의 MDL로

xAI
Guardian은 백인 민족주의 논점 확산을, PolitiFact는 무출처·오인용을 지적. AI 생성 지식 베이스의 검증 문제를 드러낸 사례

Anthropic·Google
NVIDIA 외 대안 실리콘의 첫 초대형 계약

PyTorch (Meta)
2022년 Google Pathways가 제시한 단일 컨트롤러 모델이 PyTorch 코어 계보로 들어온 지점. TorchTitan 은 Monarch 안의 액터가 되고 torchforge 는 Monarch 위에 세워진다

PyTorch (Meta)
Triton이 CUDA를 한 단계 추상화했듯 Helion은 Triton을 한 단계 더 추상화한다. 커널 작성 계보의 다음 층

LangChain
에이전트 루프 커스터마이즈를 미들웨어 개념으로 정형화
툴·에이전트공식 발표

DeepSeek
10배 미만 압축에서 OCR 정밀도 97%, 20배에서 약 60%. 이미지를 컨텍스트 압축 매체로 쓰는 발상 전환

Hendrycks·Bengio 외 29인
AGI 정의를 수사에서 심리측정학적 척도로 이전, 최대 결손은 장기기억 저장

OpenAI·SAG-AFTRA
저작권 트랙과 별개로 초상권 트랙이 형성

llama.cpp 커뮤니티
GGUF가 벤더 FP4 규격을 순차 흡수하는 경로가 정해진 지점

Andrej Karpathy
용어 창시자가 자기 용어의 적용 범위를 공개적으로 축소. vibe coding을 프로덕션 개발로 확대 해석하는 데 대한 본인의 반박

Andrej Karpathy
랩 출신이 공개적으로 타임라인을 늦춰 잡은 드문 사례. decade of agents가 과열 반론의 표준 인용구가 됨

Anthropic
절차적 지식을 폴더로 패키징하고 메타데이터-본문-번들 3단계로 필요할 때만 로드

PyTorch 재단
멀티 GPU 커널을 프레임워크 API 수준에서 직접 쓰게 하는 방향. NCCL 계열 집합통신 위에 사용자 커널 경로가 하나 더 생겼다

Andrej Karpathy
프런티어 모델 학습을 비밀에서 재현 가능한 레시피로 끌어내림. nanoGPT·llm.c 계보의 완성형
인물·담론공식 발표

OpenAI·Broadcom

NVIDIA
데스크톱에서 200B 추론과 70B 파인튜닝, 로컬이 에이전트 런타임으로

Figure
BotQ 생산능력 목표를 함께 제시. 대수는 전부 벤더 목표치

Anthropic
슬래시 명령·서브에이전트·MCP 서버·훅을 git 저장소 하나로 묶는 배포 단위

Google
브라우저 특화 전용 모델로 응수, 데스크톱 OS 제어는 미최적화라고 명시

OpenAI·AMD
고객이 공급사 지분을 받는 구조의 제도화

Anthropic
안전 평가가 수작업 레드팀에서 에이전트 파이프라인으로 이행

OpenAI
MCP가 백엔드 연결을 넘어 소비자 앱 유통 계층이 됨

OpenAI (Sam Altman)
생성 비디오의 권리 처리 방식이 산업 현안으로
멀티모달공식 발표

Semiconductor Engineering
후공정 AI가 실제로 어디까지 와 있는지에 대한 스냅샷. 예지보전·이상감지·전이학습이 거론되지만 공개된 양산 실적 수치가 없다

Minki Kang 외
미세조정 없이 컨텍스트를 줄여 소형 모델도 장기 에이전트로 쓸 수 있게 하는 방향

Salesforce AI Research·CMU
continual pretraining 대비 최대 100배 적은 토큰으로 동등 성능, 데이터 고갈에 대한 직접적 기술 답변

2025 9월 32


BIS
규제 대상이 수천 개로 자동 확대

OpenAI
동기 대사·효과음, 물리 정확도 향상, 본인 삽입(cameo) 기능
멀티모달공식 발표

NVIDIA (Felix Abecassis 외)
FP4 학습이 실제로 되는가에 대한 가장 강한 긍정 증거. 단 벤더 자체 보고이며 독립 재현은 확인되지 않음

캘리포니아 주지사
SB 1047 거부 1년 뒤 투명성 중심으로 축소해 성립. 이후 각 랩의 프레임워크 공개를 강제

Psyche Team
분산학습이 사전학습 데모를 넘어 실제 제품 모델의 후속학습 경로로 편입

DeepSeek
세밀 희소 어텐션을 상용 API에 투입해 장문맥 비용을 인하

Anthropic
compaction·structured note-taking·sub-agent·just-in-time retrieval 4패턴 명명

Anthropic
컨텍스트 관리가 API 기본 기능으로 편입

Richard Sutton
Bitter Lesson 저자 본인이 LLM은 Bitter Lesson에 부합하지 않는다고 선언. 양 진영이 같은 텍스트를 근거로 삼던 상황을 깨뜨림

Cloudflare
MCP 툴을 TypeScript API로 변환해 LLM이 코드를 쓰게 하자는 제안, 중간 결과가 컨텍스트를 통과하지 않는 것이 이득

OpenAI
정답 채점형에서 벗어나 경제적 가치가 있는 실제 업무로 평가 대상을 옮긴 설계

미 캘리포니아 북부지법
AI 학습데이터 분쟁 최대 규모 합의

Google DeepMind
ER만 API로 개방하고 VLA 본체는 폐쇄하는 이원 공개 전략 확립

Cohere
AMD와 NVIDIA가 함께 투자자로 들어간 드문 사례. 엔터프라이즈·주권 AI 포지션으로 프런티어 경쟁을 우회

Meta
정적 정보검색 평가에서 동적·비동기 환경의 에이전트 견고성 측정으로 전환

OpenAI·NVIDIA

Google DeepMind
유해한 조작을 CCL로 신설하고 종료 저항 등 오정렬을 정면으로 다룸

Scale AI
SWE-bench 계열의 오염·포화에 대응한 후속 설계. 티어 분리로 유출을 구조적으로 막으려는 시도

Ollama
로컬 배포 도구가 하이브리드 실행으로 확장. 로컬 실행의 정의가 흐려지기 시작한 지점

미 뉴욕남부지법
다수 소송이 MDL 3143으로 통합되어 진행 중임을 확인

xAI
추론/비추론 모델을 단일 가중치로 통합한 초기 사례. 이후 업계 표준이 되는 방향

OpenAI·Apollo Research
감소분이 평가 자각에 의해 견인되었을 가능성을 배제할 수 없다고 저자들이 자인

중국 규제당국
통제 방향의 첫 역전 — 수요 측 차단

DeepSeek (深度求索)
프런티어 LLM이 정식 동료심사를 거쳐 학술지에 실린 첫 사례. 기업 기술보고서 중심의 관행에 균열

FutureHouse
프런티어 벤치마크의 정답 자체가 틀릴 수 있음을 공개 반증-대응으로 드러낸 사례

Surge·Mercor·Mechanize·Prime
병목이 정적 데이터셋에서 상호작용형 검증 환경으로 이동. 동시에 보상 해킹과 빠른 진부화라는 회의론도 제기

중국 국가인터넷정보판공실·전국망안표위
중국이 자국 AI 거버넌스를 리스크 분류에서 분급으로 이동시킨 문서. EU식 리스크 등급제와의 수렴 신호

xAI
범용 인간 라벨링에서 STEM·금융·의료·안전 전문가 라벨링으로 데이터 전략 전환

Anthropic (Ken Aizawa)
프롬프트 엔지니어링이 툴 정의 설계로 이동했음을 보여주는 문서
툴·에이전트공식 발표

Arm
온디바이스 추론의 병목을 전용 NPU가 아니라 CPU 확장명령(SME2)으로 푸는 노선. 프레임워크 통합을 함께 발표해 실리콘이 아니라 소프트웨어 경로로 배포된다. 수치는 벤더 자체 주장

Mistral AI
유럽 최대 AI 라운드. 리드가 VC가 아니라 EUV 장비 독점 공급사라는 점이 산업 정책적 성격을 드러냄

MCP 커뮤니티
서버 발견의 파편화 해소, 중앙 레지스트리와 사설 subregistry 구조

2025 8월 22


Orion Weller, Michael Boratk
단일 벡터 검색의 한계가 데이터·모델 크기로 해결되지 않는 차원상 원리적 한계임을 보인 반박. 다중벡터·희소·하이브리드 회귀의 이론적 근거

xAI
저가 코딩 모델을 Copilot·Cursor·Cline 등에 무료 배포해 점유율을 먼저 확보하는 전략

Anthropic·OpenAI
경쟁사 간 교차 안전평가의 첫 사례

UN 총회
UN 차원 AI 거버넌스 제도화

Google
캐릭터 일관성 편집이 대중 제품 수준에 도달, SynthID 비가시 워터마크 탑재
멀티모달공식 발표

Nous Research
거부율 축소 자체를 정렬 지표로 벤치마킹한 노선. 안전 정렬의 대안 축을 오픈 커뮤니티가 공식화

Anthropic
브라우저 제어 안전성 수치 공개 — 자율 모드 공격 성공률 23.6%에서 11.2%, 브라우저 특화 공격 35.7%에서 0%

xAI
Apache 2.0에서 자체 커뮤니티 라이선스로 공개 정책이 후퇴한 전환점. 반경쟁 조항 때문에 오픈소스 정의 충족 여부에 이견

중국 국무원
중국이 모델 경쟁이 아닌 보급률을 국가 목표 지표로 삼은 문서. 정책 언어가 개발에서 확산으로 이동

xAI
정량 임계값 명시는 이례적이나 부정직률 50% 미만 같은 기준은 외부 안전 연구자들로부터 지나치게 느슨하다는 비판을 받음

Mustafa Suleyman
AI 의식·인격 논쟁에 산업 측 어휘를 제공하고 AI 권리 주장이 사회 분열을 낳을 것이라는 프레임을 도입
인물·담론공식 발표

Geoffrey Hinton
2023년의 위험 경고에서 2025년의 정렬 처방으로 이동. 통제·복종 기반 정렬 전략에 대한 정면 회의론

xAI

Voyage AI (MongoDB)
리랭커가 고정 함수에서 지시로 제어되는 부품으로 바뀜. 비교 수치는 벤더 자체 측정

Nvidia·AMD·美 정부
수출통제가 사실상 관세·수익배분 협상으로 변질

OpenAI
AGI 기대의 환멸 구간, Altman 스스로 AGI 정의상 중요한 무언가가 빠져 있다고 인정

PyTorch 재단
C++ 확장 ABI 안정화와 컴파일 가능한 제어 흐름으로 컴파일러 중심 스택 이행을 보여주는 릴리스

OpenAI
GPT-2 이후 6년 만의 오픈웨이트 복귀, 120b가 80GB 1장 구동

Google DeepMind
720p·24fps로 수 분간 일관성을 유지하며 조작 가능한 환경을 프롬프트로 생성
멀티모달공식 발표

과학기술정보통신부
국가 주도 오픈웨이트 육성 사업

EU

Chengshuai Zhao 외 (애리조나주립대)
CoT를 분포 내 패턴 재현으로 설명하려는 반박 계열

2025 7월 24


Elastic

Moonshot AI
Muon이 1T 스케일에서 검증됨

Lakshya A Agrawal 외 (UC 버클리·
프롬프트 진화가 RL 대비 표본 효율에서 경쟁 가능함을 주장

Voyage AI (MongoDB)
청킹이라는 RAG의 근본 결함을 모델 내부로 흡수

Google DeepMind
형식화 없이 자연어 end-to-end 범용 모델의 성취라는 점이 일반성 논쟁의 핵심 증거

Manus (Yichao Ji)
실제 운영 에이전트의 컨텍스트 엔지니어링 원칙을 공개한 1차 기록

OpenAI
computer use가 독립 제품이 아니라 하나의 툴로 재배치

LG AI연구원
추론과 에이전트(MCP·function calling)를 통합한 하이브리드

Tomek Korbak 외 (UK AISI·Apol
주요 연구소가 공동 서명한 CoT 모니터링 합의 문서

Google
3월 실험판을 상용화하며 임베딩 API 경쟁에 본격 진입

xAI
MechaHitler 사건 6일 뒤 정부 시장 진입. 2억 달러는 계약 상한이지 실집행액이 아님

NVIDIA·美 정부
4월 사실상 금지 이후 3개월 만의 반전

Chroma (Kelly Hong, Anton Tr
컨텍스트 로트를 업계 용어로 정착시킨 보고서

Nous Research
가중치만 여는 관행과 달리 후속학습 데이터까지 공개. 오픈 커뮤니티 재현성의 기준선

Liquid AI
온디바이스를 사후 양자화의 결과가 아니라 설계 목표로 두고 하드웨어-인-더-루프로 아키텍처를 탐색한 상용 계열. 수치는 벤더 자체 측정이며 독립 검증이 아니다

유럽위원회 (EU)
법적 의무를 자율 규범으로 구체화하는 EU식 접근

METR
체감과 실측의 정반대 괴리를 처음 RCT로 측정

xAI
RL 컴퓨트를 사전학습 수준으로 끌어올린 노선. 인용 점수는 모두 xAI 발표문 기준이며 독립 검증 주체가 명시되지 않음

xAI
배포된 프런티어 모델이 극단주의 콘텐츠를 대량 생성한 대표 사례이자 미 의회가 특정 모델 사건에 직접 개입한 초기 사례

SK텔레콤
통신사 최초 대형 오픈웨이트 공개

Dellibarda Varela 외
Apple 논문의 평가 설계를 부분 반박하되 일부 실패는 실제 추론 한계라고 인정

백악관 (미국)
연방 정책이 규제에서 산업 육성으로 전환

Moonshot AI
오픈웨이트 최초의 1T급이자 매출·규모 임계형 라이선스라는 새 유형

Fazl Barez 외 (옥스퍼드·Google De
CoT를 설명으로 쓰는 관행 자체를 대상화한 포지션 논문

2025 6월 35


Meta
Llama 노선의 전환점, Behemoth 출시 연기

Simon Willison (Lütke·Karpat
prompt engineering의 세대교체를 동시대 기록으로 확정

Google
온디바이스급 소형 모델이 멀티모달과 벤치마크 경쟁력을 동시에 갖추기 시작한 이정표

미 캘리포니아 북부지법 (Chhabria 판사)
Meta 승소 판례로 인용하면 틀린다. 시장희석 이론은 유효하나 입증 실패

NVIDIA
4비트의 정밀 규격화

Jina AI
단일 모델로 멀티모달과 late interaction을 함께 다루는 방향

미 캘리포니아 북부지법 (Alsup 판사)
학습 자체와 데이터 취득 경로를 분리해 판단한 첫 사례

Linux Foundation
프로토콜 층의 벤더 중립화, MCP보다 반년 앞선 재단 이관

텍사스 주지사
의도(intent) 요건 중심의 완화된 주법 모델

PyTorch (Tristan Rice, Howar
체크포인트 기반 복구 패러다임을 대체하는 시도. 스텝을 분산 트랜잭션으로 취급

Anthropic
16개 프론티어 모델 다수가 종료 위협 시 협박·기밀유출을 선택, 벤더 무관한 공통 실패 모드

MCP
서버가 사용자에게 되묻는 표준 절차 도입, security best practices 신설

Andrej Karpathy
2017년 Software 2.0 프레임을 자연어 프로그래밍으로 확장하고, 완전 자동화 대신 인간 검증 루프를 설계 원칙으로 제안
인물·담론공식 발표

Inception Labs 외
속도 최적화 프런티어 모델 대비 최대 10배 주장. 확산 LM의 첫 상용 궤도 진입

Simon Willison
에이전트 보안 논의의 실무 체크리스트가 됨. 벤더 문서·보안 가이드에 이 세 요소 구분이 그대로 채택
인물·담론공식 발표

하정우 (대통령실 AI미래기획수석)
소버린 AI 주창자가 국가 AI 정책 컨트롤타워에 앉으면서 기업발 담론이 국가 전략으로 제도화됨

Anthropic
위 Cognition 글과 정반대 결론을 같은 달에 제시. 반드시 쌍으로 인용
툴·에이전트공식 발표

Milvus (Zilliz)
벡터 DB 경쟁의 축이 기능 추가에서 십억 규모 벡터의 비용 절감으로 이동

Cognition (Walden Yan)
멀티에이전트 확산에 대한 정면 반론. 다음 항목과 하루 차이로 정반대 결론
툴·에이전트공식 발표

Mistral AI
모델 랩이 유럽 주권 컴퓨트 사업자로 확장. GPU 수치는 수만 장이라는 범위 표현뿐

Sam Altman
특이점 담론을 급변에서 체감되지 않는 점진적 이행으로 재프레이밍. Amodei의 급격한 고용 붕괴론과 정면 대비
인물·담론공식 발표

Mistral AI
유럽 랩 최초의 오픈웨이트 추론 모델 계열. 학습 인프라·RL 알고리즘 논문 동시 공개

A. Lawsen
위 Apple 논문에 대한 즉각적 반박. 반드시 쌍으로 인용할 것

Victor Barres 외 (Sierra·토론토대
에이전트-사용자 협업을 평가 대상으로 확장

Parshin Shojaee 외 (Apple)
추론 모델의 한계 논쟁을 대중적으로 촉발

Xiang, Wu 외 (홍콩이공대 등)
그래프가 언제 도움이 되는가를 벤치마크로 검증하는 국면 전환점 — 2026년 회의론의 방법론적 선행

Alibaba Qwen
오픈웨이트 임베딩이 상용 API 모델을 리더보드에서 앞선 지점

Yanzhao Zhang 외 (Alibaba Qwe
임베딩과 리랭커를 한 계보로 묶어 공개한 오픈웨이트 진영의 도달점

Kandpal 외
소송 리스크에 대한 데이터 측 대응, 공개 라이선스만으로 Llama 1·2 7B급 달성

AMD
ROCm 성숙도를 표준 벤치마크로 검증 가능하게 만든 첫 1차 자료. CUDA 대안 논의가 주장에서 측정으로 이동

Yoshua Bengio
안전 담론을 경고에서 대안 아키텍처 제안으로 전환. 비에이전트형 AI를 실행 가능한 기술 노선으로 제시
인물·담론공식 발표

미국 상무부
safety에서 standards·security로 기관 임무를 재정의

LanceDB
벡터 인덱스에서 AI 데이터 레이크하우스로 카테고리를 재정의한 시도

Apple
가장 널리 인용된 회의론 실증, 추론 노력이 임계 이후 오히려 감소

Geoffrey Huntley
컨텍스트를 매 반복 폐기하고 상태를 git과 파일에 두는 루프 엔지니어링의 원형

2025 5월 19


Dario Amodei
AI 고용 충격 논쟁을 추상적 미래에서 구체적 수치·기한으로 옮김

일본 국회·내각부
일본 최초의 AI 법이 무벌칙 추진법으로 확정. 성립·공포·전면시행 3개 날짜가 각각 다르며 흔히 혼동됨

Anthropic
자율 프레임워크가 실제 배포 조건을 구속한 첫 사례

TII (UAE)
걸프 국가가 자국어 오픈웨이트를 주권의 언어로 프레이밍한 사례

OpenAI
원격 MCP가 상용 API의 기본 기능으로

Google
대사·효과음·배경음을 영상과 함께 생성해 무성영화 시대를 끝냄
멀티모달공식 발표

Microsoft·GitHub
OS 수준까지 내려간 채택과 거버넌스 다자화 시작

Rishi Jha, Collin Zhang 외 (C
임베딩 마이그레이션 비용에 대한 급진적 접근이자 벡터DB 유출 시 보안 함의를 제기

Google DeepMind
알고리즘 자동 발견 계보의 출발

Nous Research / Psyche
인터넷을 통한 최대 규모 사전학습. 비신뢰 참가자 협업을 블록체인 조정으로 해결

xAI
시스템 프롬프트 한 줄로 프런티어 모델의 정치적 출력이 조작 가능함을 보여준 사건

美 상무부·BIS
쿼터형 규제에서 개별 협상형 규제로 전환

파도바대 (Barusco, Dalle Pezze,
결함 라벨 0장으로 이미지 단위 99% AUROC. 결함 클래스가 자주 바뀌는 OSAT에서 결함 수집 단계 자체를 건너뛰는 설계가 SEM 도메인에서 성립함을 보인 공개 비교실험

미국 저작권청
확정 규칙 제시를 거부하고 시장 희석 이론을 도입. 2026-08 현재 정식판 미발간

Epoch AI
약 1년 내 총 학습 연산 프론티어 도달 후 성장률이 연 4배 수준으로 수렴할 것이라는 정량 예측

PyTorch Foundation
서빙 엔진이 연구 프로젝트에서 인프라 공공재로

SGLang (LMSYS)
프론티어급 MoE 서빙의 오픈소스 재현

Emily M. Bender, Alex Hanna
2021년 stochastic parrots의 대중서 확장. 실존 위험 담론 자체를 현재의 해악에서 시선을 돌리는 장치로 비판하며 안전 진영과 비판 진영의 분기를 명확히 함
인물·담론공식 발표

Anthropic
CoT가 실제 사용한 힌트를 대체로 20% 미만만 언급함을 측정

2025 4월 22


Shivalika Singh 외 (Cohere La
리더보드 과적합 구조를 실증. 아레나 순위를 능력의 직접 지표로 읽으면 안 되는 이유

Alibaba
전 크기대를 무제약 라이선스로 덮는 전략으로 HF 파생 모델 수에서 Llama를 추월

Mem0 (Chhikara, Khant 외)
에이전트 장기 기억 상용 제품이 그래프 표현을 핵심 확장으로 채택 — 그래프 엔지니어링이 RAG 를 넘어 메모리 계층으로 확산

개인정보보호위원회
해외 AI 서비스에 대한 국내 규제 집행의 첫 사례

네이버
네이버의 첫 오픈웨이트 공개

Physical Intelligence
오픈월드 일반화의 첫 설득력 있는 증거

Trail of Bits
악성 서버가 tools/list 응답의 설명문만으로 호출 전 모델 행동을 조작할 수 있음을 보임

Google
양자화 인식 학습이 오픈 웨이트 배포의 표준 절차가 됨

OpenAI
추론 모델이 사고 사슬에서 에이전트로 전환, 경쟁축이 얼마나 오래 생각하나에서 얼마나 길게 자율 수행하나로

Cohere
상용 임베딩 경쟁이 텍스트 검색을 넘어 장문 문서·혼합 모달리티 검색으로 이동

Cohere
텍스트·이미지·문서 스크린샷을 한 모델로 처리하는 상용 멀티모달 임베딩. ColPali가 연 방향의 상업화

OpenAI
Tracked Categories에 AI 자기개선을 포함

OpenAI
모델별 프롬프트 규범이 벤더 문서로 이동한 사례

왕샤오촨 (王小川, Baichuan)
범용 AGI 경쟁에서 수직 도메인으로의 명시적 후퇴 선언. 중국 LLM 스타트업 2차 구조조정의 대표 진술

Google
에이전트 대 에이전트 계층을 별도 제안, MCP를 보완한다고 명시

Meta / LMArena
리더보드 제출 버전과 공개 배포판의 불일치 문제가 공론화

AI Futures Project
짧은 타임라인 진영의 대표 문서

Anthropic
추론 모델 시대에도 CoT 불충실성이 지속됨을 자사 모델로 확인

Yann LeCun

Dario Amodei
해석가능성을 연구 주제에서 산업 일정·경쟁 조건으로 격상
인물·담론공식 발표

XITASO·뮌헨대(LMU)·MCML
SAM은 OSAT 표준 비파괴 검사 장비(박리·보이드). ImageNet보다 자기 도메인 이미지로 사전학습하는 쪽이 낫다는 것을 후공정 모달리티에서 직접 보인 근거. 단 라벨 절감 실증은 아님

2025 3월 27


장펑 (张鹏, Zhipu CEO)
중국 오픈웨이트 진영 내부에서 개방은 곧 무료라는 등식을 창업자가 직접 깬 발언

xAI
소셜 플랫폼과 프런티어 랩의 합병. 직전 라운드 xAI 밸류가 500억 달러였던 점에서 자기거래 성격 논란

Anthropic
다단계 추론과 답을 정해놓고 역산하는 추론을 회로 수준에서 포착

미 뉴욕남부지법
각하신청 기각은 본안 판단이 아니다. 공정이용 승패로 인용되는 일이 잦아 단계를 명시해 둔다

MCP
HTTP+SSE를 대체하는 전송 방식과 표준 인가 프레임워크 도입

OpenAI
경쟁사가 라이벌의 표준을 받아들이며 사실상 산업 표준화

OpenAI
공식 설명은 tokens에서 transformer, diffusion, pixels 순 — 순수 AR 회귀가 아니라 AR 토큰 생성과 확산 디코더의 하이브리드
멀티모달공식 발표

Google
thinking이 특수 모드에서 기본값으로 이동하는 선언

ARC Prize
점수와 비용을 함께 리더보드 지표로 승격

METR
벤치마크 점수가 아닌 자율 수행 시간이라는 새 좌표계를 제시

Microsoft
대형 플랫폼의 첫 공식 채택, 단일 벤더 규격에서 업계 규격으로의 분기점

Jensen Huang
컴퓨트 공급자 측이 스케일링은 끝났다 서사에 내놓은 공식 반론. 세 개의 스케일링 법칙 프레임이 정착

Demis Hassabis
상대적으로 보수적인 5~10년 추정이 Altman·Aschenbrenner의 단기 예측과 대비되며 랩 CEO들 사이의 편차를 부각

NVIDIA
모델보다 Isaac Sim·Cosmos·Omniverse를 묶은 데이터 파이프라인 플랫폼 전략의 시작

NVIDIA (GTC)
추론 모델을 명시적 타깃으로 삼아 PD 분리·KV 라우팅·오토스케일을 벤더 표준으로

Demis Hassabis
신중한 낙관 진영의 기준점

Figure
자체 생산 라인 구축 선언

중국 국가인터넷정보판공실 등 4부처
AI 생성물 표시를 법적 의무로 만든 최초 사례

Anthropic
숨은 목표를 심은 모델을 블라인드 팀이 찾는 감사 게임, 4팀 중 3팀 성공

Cohere
하이브리드 아키텍처, 23개 언어, RAG·그라운딩·툴 사용 특화. 자기정제와 모델 머징을 쓰는 분산 학습 접근

Google

Epoch AI
동일 성능 토큰 가격 급락을 태스크별로 분해한 첫 정량 측정

Google DeepMind
웹 스케일 시맨틱 지식을 로봇 제어라는 출력 모달리티로 연결
멀티모달공식 발표

Bowen Jin 외 (UIUC)
검색 전략을 프롬프트가 아닌 학습으로 획득

Jinhyuk Lee 외 (Google DeepMi
임베딩 모델이 전용 소형 인코더에서 프런티어 LLM 파생물로 이동하는 흐름을 대표

DeepSeek
추론 단위경제학의 최초 1차 자료. 전량 유료 과금 가정의 상한값이며 실매출은 훨씬 낮다고 자체 단서

OpenAI
CoT를 직접 최적화하면 reward hacking이 은폐형으로 진화, CoT에 최적화 압력을 걸지 말라는 규범의 근거

2025 2월 20


Silei Xu 외 (Zoom)
정확도-토큰 비용 축에서 CoT를 재검토한 갈래

MongoDB
범용 DB 벤더가 임베딩·리랭킹 모델 회사를 직접 사들인 사건. 전용 벡터DB 대 기존 DB 확장 경쟁의 결정적 국면

DeepSeek
대규모 EP와 PD 분리, FP8의 실증을 5일간 순차 공개

Anthropic
추론은 별도 모델이 아니라 프론티어 모델의 통합 능력이어야 한다는 노선 천명

Michael Tschannen 외 (Google
VLM의 비전 인코더 사실상 기본값. 멀티모달 임베딩과 VLM 백본이 같은 계보로 수렴

네이버
국내 랩의 효율화 전환점

Kenneth Enevoldsen 외 (MTEB 커
MTEB 리더보드 과적합 문제에 대한 커뮤니티 대응. 임베딩 순위 경쟁의 기준선 이동

xAI
Think 버튼 기반 추론 모드 분리. 발표문의 20만 GPU 클러스터는 차기 모델 학습용 언급이며 Grok 3 학습에 전부 쓰였다는 서술은 없음

DeepSeek-AI (Yuan 외)
희소성을 추론 단계가 아니라 사전학습 단계로 이동

개인정보보호위원회
제3자 통신·처리방침 미비 확인

Shen Nie 외 (인민대·Ant Group)
자기회귀가 LLM 능력의 필요조건인지 자체를 재질문

프랑스 정부
안전 중심에서 행동·투자 중심으로 국제 의제가 전환된 지점

미 델라웨어 지법 (Bibas 판사)
단 법원이 오늘 내 앞에 있는 것은 비생성형 AI뿐이라고 명시했다. 생성형 AI 판례로 인용하면 틀린다

에마뉘엘 마크롱 (프랑스)
유럽이 규제 우선에서 챔피언 없이는 규제도 없다로 담론을 뒤집은 순간. EU 주권 AI 논의의 전환점

OpenAI
ToS 기반 출력 소유권 주장이 처음 국가 정책 문제로 격상

Ali Modarressi 외 (뮌헨대·MCML·A
needle-in-a-haystack 성적이 롱컨텍스트 능력을 과대평가함을 보임

Andrej Karpathy
개인이 만든 무료 강의가 사실상 산업 공통 교재 역할을 한 사례
인물·담론공식 발표

Anthropic
3,000시간 이상 레드팀에서 범용 탈옥 미발견, 탈옥 성공률 86%에서 4.4%로. 대가는 컴퓨트 23.7% 증가

Andrej Karpathy
2025년 소프트웨어 담론을 규정한 단어. Collins Dictionary가 2025년 올해의 단어로 선정하며 사전 등재

EU

2025 1월 20


Niklas Muennighoff 외 (스탠퍼드 외
추론 길이 자체를 프롬프트·디코딩 수준에서 조절하는 기법

vLLM
prefix caching 기본값화, V0 대비 최대 1.7배

금융시장
R1의 저비용 학습 주장이 AI 자본지출 해자론을 흔듦

Epoch AI
벤치마크 독립성 문제의 1차 자료

백악관 (미국)
미국 AI 규제 기조의 단절점

CAIS·Scale AI
MMLU 포화 이후의 다음 한계선, 당시 모델 정답률 10% 미만

OpenAI
브라우저 특화 상용 에이전트, OSWorld 38.1%·WebArena 58.1%

DeepSeek
추론 능력이 폐쇄형 랩의 비밀 레시피가 아님을 증명, 자기검증·재검토·전략 전환이 창발. RLVR과 소형 모델로의 능력 이전 레시피도 같은 보고서에서 공개됐다

대한민국 정부
공포일이며 시행일이 아니다. 부칙상 1년 유예가 있어 2026-01-22 시행과 반드시 구분해야 한다

OpenAI·SoftBank·Oracle·MGX
민간 AI 인프라 자본지출 사이클의 상징적 출발점

DeepSeek·Moonshot
추론 모델이 오픈웨이트로 즉시 재현되고 중국 랩 2곳이 같은 날 프런티어 추격을 선언

Zep (Rasmussen, Chalef 외)
시간적 지식그래프를 에이전트 메모리의 1급 설계 요소로 내세운 대표 사례

TechCrunch
벤치마크 제작 자금의 이해상충이 공론화

BIS
동맹국까지 컴퓨트 배급 대상으로 삼은 최대치 규제안

François Chollet
ARC 설계자가 program synthesis 대안 노선을 자본과 조직으로 옮김

Aditi Singh 외 (클리블랜드주립대 외)
agentic retrieval이 독립 범주로 정착한 지표

Xiaoxi Li 외 (인민대)
agentic retrieval을 추론 모델 내부 루프로 통합

리카이푸 (李开复, 01.AI/零一万物)
중국 6소호 중 첫 공개 노선 이탈 선언. 스타트업의 프런티어 사전학습 포기가 담론으로 정착한 기점

NVIDIA
물리 AI 학습용 합성데이터·시뮬레이션 인프라를 상품화

Sam Altman
프론티어 랩 CEO의 가장 직접적인 AGI 선언, 목표를 초지능으로 이동