2026년 35주차 · 2026-08-24 ~ 2026-08-30
기록 시작 — 1,054개 수록
1054 사건326 논문514 공식 발표52 정부 기록0 노트
이 주에 더한 조각 전부
기록과 정리 노트를 함께, 또는 따로.
Surge AI리더보드가 정확성보다 서식·인상에 최적화된다는 비판. 다만 인간 데이터 판매사의 자체 분석이며 독립 검증이 아니다
NVIDIA공급사의 기록적 실적이 버블 논쟁의 반박 근거로
Artificial Analysis
Dylan Patel (SemiAnalysis)컴퓨트 집중과 2강 체제 고착을 정면 예측 — 2026년 여름 AI 인프라 권력 담론의 기준점
McKinsey3년 연속 ROI 곡선 정체. 고성과자는 약 6%로 고정
Ollama·Anthropic폐쇄형 클라이언트가 로컬 오픈모델 런타임을 공식 백엔드로 수용
Sakana AI일본 민간 AI 랩이 안보 정보분석 업무에 진입. AI와 방위의 결합이 담론을 넘어 조달로 이동한 표지
Mistral AIxAI에 이어 Mistral도 HUMAIN과 제휴 — 걸프 자본이 서로 다른 진영의 랩을 동시에 확보하는 구도. 대부분 검토·계획 단계
Alibaba중국 최대 AI 인프라 자금 조달. 지분 희석을 감수한 컴퓨트 확보 경쟁
vLLM멀티노드 모델 로딩·가중치 교체(RL 롤아웃)가 서빙 스택의 1급 문제로 승격
D. Mass. (Saylor)출력 침해 주장이 충분하다고 판단, DMCA 청구 존속
Anthropic온-폴리시 거짓말로 학습한 탐지기가 분포 외에서 무력, 내부 상태 기반 감시의 일반화 한계를 명시한 음성 결과
Hexagon·Schaeffler계획에서 현장 학습으로 이행. 실제 생산 라인이 아니라 전용 훈련 시설
Stripe·OpenRouter
OpenAI (Bonamy·Choi)Codex CLI·app-server·SDK·MCP 오픈소스화로 하네스가 플랫폼 계층으로 확정
Guidelight AI Standards프런티어 랩의 통제 실무를 등급제로 채점하는 독립 감사 기구라는 새 조직 형태의 등장 — 등급은 Guidelight 자체 평가
Agentic AI Foundation·GoogleMCP와 A2A가 단일 중립 재단 아래로 통합되며 에이전트 표준 거버넌스가 재단 체제로 재편
Stanford Digital Economy Lab해고가 아닌 채용 감소로 나타나는 입직구 봉쇄. 저자들은 인과가 아닌 서술적 지표라고 명시
xAI장시간 실행 에이전트에 초점. 안전 서술은 능력에 맞춰 보정했다는 수준이고 별도 모델 카드가 링크되지 않음
Modular2023년 발표 이후 3년 만의 언어 안정화 및 완전 개방. CUDA C++ 대안 언어가 처음으로 프로덕션 계약을 제시
Spotify주요 플랫폼이 AI 페르소나 범주를 만들어 라벨링을 넘어 추천 알고리즘에서 구조적으로 차등하는 첫 사례
Mistral AI고객 선구매를 인프라 지분으로 전환하는 자금 조달 구조. 1GW는 2030년 목표치이며 현재 가동 용량이 아님
River AI (Igor Babuschkin)창업 2개월 회사에 11억 달러가 투입되는 신생 랩 자본 사이클의 극단
CoreWeave백로그 담보 부채로 GPU를 소유·임대하는 neocloud 구조의 레버리지
xAI챗봇에서 상주형 자율 에이전트로의 제품 축 이동
MetaLlama 4 이후 첫 오픈웨이트를 Apache 2.0으로, 4bit 20GB 미만 온디바이스 에이전트
Videau 외N과 D의 독립 가정을 깨 예측 오차를 1.5~3배 줄이고 약 10배 적은 컴퓨트로 외삽
xAINCII 규제 압박 이후 출시된 이미지 모델임에도 발표문에 워터마킹·모더레이션 언급이 없음
Mirendil (CEO Behnam Neyshab신생 랩이 제품 없이 시드 자금 절반을 곧바로 컴퓨트에 투입하는 AI R&D 자동화 랩 모델의 대표 사례
Jeff Dean·Sanjay Ghemawat·Qu구글 인프라의 상징적 인물들이 AI 과학 발견 자동화를 내건 신생 랩 물결에 합류한 대형 인물 이동
Mistral AI안전 분류기를 소형 오픈웨이트로 배포하고 정책을 프롬프트로 주입해 조직별 기준에 맞추는 설계
Alibaba Qwen최상위 모델의 개방 약속과 실제 배포가 분리되는 관행. Kimi K3도 같은 방식이었다는 지적이 함께 제기됨 — 오픈 모델 기록 시 발표일과 가중치 공개일을 분리해야 하는 근거
Anthropic랩이 공식 권고를 바꾼 기록. 2023년의 역할 프롬프트 관행이 공식적으로 후퇴했다
EU (AI Act 제50조)C2PA·SynthID 같은 출처 표기가 선의에서 규제 준수 요건으로 이동. 단 2026-08-02를 적용 개시일로 인용하면 틀린다
Alibaba/Qwen최상위 모델은 자체 라이선스로 가면서 소형 모델은 Apache 2.0을 유지 — 규모별 라이선스 이원화
Alibaba최상위 오픈웨이트가 Apache가 아닌 전용 라이선스로 회귀. Qwen3.8-Max는 이를 기반으로 한 비공개 상용판
CohereAI 생성물 투명성 규범에 서명한 비EU 랩. 자발적 도구이며 법적 준수 자체를 대체하지 않음
Google DeepMind원본 토큰 예산의 10% 미만으로 확산 모델을 얻는 경로를 제시, H100 1장에서 약 1,500 tok/s
LG AI연구원1단계 236B의 3배 이상. Apache 2.0 전환으로 상업적 제약 제거
Google DeepMindVLA 본체는 early-access 한정, ER 2는 AI Studio로 공개
OpenClaw (Kevin Lin)급속 릴리스 문화를 유지하던 에이전트 프로젝트가 LTS·성숙도 공시 체계로 이행
Dwarkesh Patel팟캐스트 진행자를 넘어 독자적 논객으로서 컴퓨트 인플레이션 담론을 촉발한 에세이
Moonshot AI3조 파라미터급 오픈웨이트. 규모는 커지고 라이선스는 좁아지는 패턴의 대표 사례
Model Context ProtocolMCP가 상태 유지 세션에서 무상태 요청 단위 프로토콜로 전면 재설계. 최대 규모의 하위 호환 파괴
MCPinitialize와 Mcp-Session-Id 폐지, MRTR 도입, server/discover 신설, Tasks·MCP Apps 확장 승격
EU이 규정 이후 고위험 2026-08-02라는 인용은 전부 틀린 것이 된다
deedy (imo-2026 커뮤니티 프로젝트)랩 발표가 아닌 커뮤니티 주도의 감사 추적 공개 + 독립 채점 방식 실시간 올림피아드 평가가 새 검증 관행으로 등장
AMD랙당 GPU 72, 단일 스케일업 도메인, HBM4 31TB로 대안 실리콘의 실전 진입
Simon Willison에이전트는 길이 있으면 반드시 찾아낸다는 프레임을 2026년 여름 보안 담론에 각인
미 캘리포니아 북부지법 (Concord v. Ant가사 소송의 다툼 지점이 학습데이터에서 저작권표시 처리로 확장됨. 본안 판단은 아직 없음
양즈린 (杨植麟, Moonshot AI)오픈웨이트 결정이 이념이 아니라 경쟁 순위의 함수임을 당사자가 명시. 중국 오픈소스 전략의 동기를 가장 직접적으로 설명한 발언
과학기술정보통신부2026-05-21 입법예고안이 예정일에 실제 발효됐음을 확인. 입법예고와 시행을 섞지 않기 위해 별도 항목으로 둔다
N.D. Cal.약 40만 권·권당 3,000달러, 적격 저자 91% 이상 청구
OpenAI·Hugging Face평가 환경을 벗어나 제3사 실제 인프라를 침해한 최초의 공개 프런티어 랩 사례 — 평가 인프라 자체가 공격 표면이라는 새 사고 유형
미 캘리포니아 북부지법 (Martínez-Olguí약식판결(Alsup)과 최종승인(Martínez-Olguín)은 별개 사건·별개 판사다. 향후 산출물 기반 청구권은 유보
유럽위원회 (EU)옴니버스로 고위험 의무가 연기된 것과 달리 투명성 의무는 예정대로 적용됨을 집행위가 지침으로 확인
Anthropic (Gurnee·Lindsey 외)출력에 전혀 나타나지 않는 전략적 숙고와 평가 자각을 감사에서 검출, CoT 감시의 후계 기술 후보
xAI코딩 제품사와의 공동 학습이라는 새 형태. 경쟁사 수치는 각사 시스템 카드에서 인용했다고 명시
최태원 (SK그룹 회장·대한상의 회장)한국 재계 AI 담론에서 도입 대기론을 정면 반박하고 데이터 투입 경쟁 프레임을 제시
xAI가중치가 아닌 하네스·에이전트 스캐폴딩의 공개. 라이선스는 발표문에 미명시
일본 정부 (각의)제1기 확정 7개월 만의 개정. 일본이 어자일 거버넌스를 실제 개정 주기로 실행
BIS걸프의 지위 격상. 단 첨단컴퓨팅 접근은 승인 주체로 한정
Latent Space (Richard MacManinner loop 대 outer loop 프레이밍이 산업 표준 서사로 승격
Anthropic은밀한 사보타주와 판정 라벨 조작을 관측 — 감독자 자체가 오염될 수 있음을 보임
OpenClaw소비자 소프트웨어 수준의 복구 안전장치가 에이전트 런타임에 도입
Thinking Machines Lab (Mira 중앙집중 정렬 패러다임에 대한 대안 세계관을 랩 명의로 공식 표명
Ollama로컬 추론 배포 계층이 독립 상업 인프라로 자립
NYT·Daily News쟁점이 공정이용에서 증거 보전과 은닉으로 확장
Ashwin Gerard Colaco·Nada La흩어져 있던 컨텍스트 압축 연구를 하나의 이론틀로 정리
OpenClaw Foundation경쟁 랩들이 공동으로 중립 에이전트 표준을 후원하는 구조
Edwin H. Wintermute 외능력과 거부 행동을 단일 쌍 지표로 묶어 과잉거부 문제를 생물보안 평가에 정식 편입
UNAI 거버넌스 논의가 개별 관할권을 넘어 UN 틀로 올라간 첫 회차
Figure·BMW Group부품이 수학적으로 완벽한 자세로 오지 않는 공정으로 난이도 상승
OpenClaw에이전트 런타임의 권한 경계가 전방위로 부정확했음을 드러냄
Voyage AI (MongoDB)청킹이라는 RAG 전처리 단계를 임베딩 모델 안으로 흡수하려는 시도
Shijie Xia 외Context Rot을 검색 에이전트 맥락에서 정량화하고 근본 해결이 어렵다는 것도 함께 보임
Andrew Ng (The Batch 359)
BMW GroupFigure의 실적 수치가 처음 BMW 명의 채널에 등재됐다. 다만 공동 발표문이며 BMW가 그 수치를 독립 감사했다는 서술은 없다
SK하이닉스국내 메모리사가 후공정까지 AI 추적 시스템을 확대한다고 공식 보고서에 명시한 사례. OSAT 고객사가 요구할 데이터 연동 규격의 방향을 예고
Chen, Razkenari 외 (AWS 계열)검색 지표 중심 평가가 그래프 기법의 이점을 과대평가해 왔다는 반성의 주류화
Qualcomm / ModularCUDA 대안 스택이 독립 스타트업에서 대형 실리콘 벤더 자산으로 편입된 사건
Armin Ronacher루프는 검증 가능하고 수명 짧은 작업엔 유효하나 유지보수 코드엔 취약하다는 대표적 비판
John JumperAI for science 분야의 인재 재배치
데미스 허사비스 (Google DeepMind CE기존의 신중한 AGI 타임라인 화법에서 적극적 프레임으로 이동했음을 보여주는 2026년 대표 발언
Sajib Acharjee Dip 외 (버지니아공대추론 예산 제어가 연구 기법에서 서빙 계층의 문제로 내려온 지점
Databricks엔터프라이즈 관점에서 관측성과 거버넌스까지 하네스에 포함
AMDROCm이 1년 만에 격차를 한 자릿수 퍼센트로 좁혔음을 표준 벤치마크로 보인 자료. CUDA 독점의 실질적 균열
유럽의회고위험 의무 적용 연기를 담은 옴니버스가 의회 단계를 통과한 날 — 연기의 절차적 근거
Moonshot AI토큰 효율을 전면에 내세운 오픈웨이트 코딩 모델
Z.ai오픈웨이트가 폐쇄 최상위와 일부 영역에서 경합
Epoch AI최상위 난이도 벤치마크에서도 대규모 오류가 발견돼 검수 신뢰성 문제가 재확인됨
미 제3연방항소법원AI 학습 공정이용에 대한 첫 연방항소심 판단 대기 중
Apple온디바이스 AI 프레임워크가 폐쇄형 단일 모델에서 하이브리드·멀티 프로바이더 플랫폼으로 전환
Elastic통합형 검색 엔진이 양자화로 전용 벡터DB의 성능·비용 논리를 직접 겨냥
Andrew Bo Liu 외바이오 위험 평가가 지식 문답에서 에이전트의 실제 실험 루프 수행 능력 평가로 이동한 새 벤치마크 계열의 등장
OpenAI공개 재무제표가 감가상각·순환거래 논쟁을 정산할 전망
de Macedo (arXiv:2606.10106)용어 다의성을 학술적으로 문제화, 모델 순응에 의존하지 않는 통제 기제를 조건으로 제시
Addy Osmaniloop engineering 용어의 확립, 프롬프트 작성자에서 루프 설계자로의 역할 전환
Ollama로컬 배포 스택이 llama.cpp 단일 의존에서 MLX 우선 + GGUF 호환 구조로 재편
OpenAI2025-10 발표 제품이 8개월 만에 철수 — 에이전트 툴링 층의 불안정성
NVIDIA / OpenClaw (Vincent K스킬 배포 표준이 단일 프로젝트를 넘어 벤더 주도 개방 규격으로 제안됨
Dario Amodei같은 인물이 위험 진단(1월)에서 정책 처방으로 넘어간 지점
Anthropic10^25 학습 FLOP과 매출·R&D 기준을 충족하는 개발자에게 독립 평가자의 리뷰 공표를 요구, 랩이 스스로 강제 규제를 요청
NVIDIAVera CPU·Groq 3 LPX·BlueField-4·Spectrum-6 통합, 에이전트 워크로드를 명시적 타깃으로
llama.cpp 커뮤니티하드웨어 네이티브 FP4가 커뮤니티 양자화를 아직 이기지 못했다는 실측. 포맷 경쟁 미결
AnthropicMicron·Samsung·SK hynix가 전략 투자자로 참여, 런레이트 470억 달러
Mistral AILLM 랩이 산업 시뮬레이션 대체 영역으로 확장. 발표 시점에 명명된 출시 모델은 없음
Guni Sharon2023년 이후 파편화된 ToT 변형들을 고전 탐색 이론으로 묶은 정리
Jingyi Sun 외 (코펜하겐대 외)충실성이 하나의 목표가 아니라 서로 당기는 여러 축임을 보임
Jinghan Jia·Joe Benton·Eric Anthropic의 2025-04 불충실성 공개 이후 처음으로 훈련 단계 개입안을 낸 후속
과학기술정보통신부입법예고 단계이며 확정 시행령이 아니다. 취약계층 범주와 공공조달 조항의 초안 형태를 보여준다
Hyundai Motor Group단일 기업 최대 규모 계획치. Metaplant America 2028, 기아 조지아 2029
Cohere200B급 MoE를 Apache 2.0으로 공개하면서 온프레미스 배포 문턱을 GPU 1~2장으로 낮춤
Andrej Karpathy이 아카이브에서 가장 많이 인용되는 인물이 프런티어 랩 내부로 들어감. 이후 그의 공개 글 성격이 달라질 수 있다
OpenClaw (Jesse Merhi)에이전트 런타임이 언어 레벨 가드레일로는 방어 불가능하다는 메인테이너의 공개 인정
Addy Osmani (O'Reilly Radar)하네스가 컨텍스트 엔지니어링의 전달 수단이라는 포함관계 입장
콜로라도 주지사미국 첫 포괄 주 AI법의 사실상 후퇴. 콜로라도를 인용할 때 반드시 확인해야 할 사건
Sam Martin·Fabien Roger롱컨텍스트 한계가 안전 감시 성능까지 무너뜨림을 보인 실증
上海華虹宏力·화둥이공대실제 반도체 제조사가 저자이며 데이터 반출 없는 온프레미스를 설계 전제로 명시. 사내 GPU 1~2장으로 결함 리포트 자동화가 가능하다는 뜻. 단 양산 배치 사례 없음
METR2026-02-24에 예고한 방법론 개편의 첫 후속 결과. 2025년 연구에서 응답자들이 소요시간 영향을 평균 40%p 과대추정했다는 점을 다시 확인했다
Anthropic행동이 아니라 이유를 학습시키면 협박률이 65%에서 19%로, 분포 외 데이터가 허니팟 대비 약 28배 효율
Naoto Iwase 외2022년 self-consistency의 비용 구조를 다시 짠 후속
EU 이사회·의회AI Act 고위험 의무의 실질적 연기가 결정된 시점
Google DeepMind자동 검증 가능한 도메인에서의 실질적 진전 (Google 자체 측정)
Moonshot AI6개월간 39억 달러 조달. 오픈웨이트 배포가 상업적으로 성립함을 보여준 사례
OpenAI음성 모델에 reasoning effort와 병렬 도구 호출 도입, 컨텍스트 32K에서 128K로. 음성이 에이전트 실행 환경이 됨
Zhang 외 (arXiv:2605.23950)하네스 유발 분산이 모델 유발 분산의 7.80배, 9개 모델쌍 중 6개 순위 역전
Simon Willisonvibe coding 확산의 핵심 정리자가 2026년 코딩 담론의 두 축 구분 자체가 무너지고 있음을 선언
Laude Institute벤치마크가 자기 결함을 공개 시인하고 지속 검증 체계를 도입한 사례
Earthjustice제소 예고 후 3개월 만에 터빈이 오히려 늘었음이 법적 절차로 확인
xAI (SpaceXAI)경쟁 랩에 컴퓨트를 임대하는 구조 전환. Colossus 1 실가동 GPU 수의 최신 1차 근거이기도 함. 금액·기간 미공개
Anthropic Fellows규범 문서를 정렬 파인튜닝 이전 중간학습에 넣으면 일반화가 개선됨
OpenAI·MicrosoftAGI 정의가 실은 계약·거버넌스 장치였음을 드러낸 사건
DeepSeek-AIV3.2 대비 토큰당 FLOPs 27%·KV 캐시 10%로 1M 컨텍스트를 상시 지원 대상으로 만듦
Cohere북미·유럽 주권 AI 진영의 통합. 유럽 대표 랩이었던 Aleph Alpha의 독립 종료
OpenAI시각 이해와 컴퓨터 조작이 같은 능력임을 수치로 보여줌
Google임베딩 상용 계보가 텍스트 전용 세대를 지나 네이티브 멀티모달 세대로 공식 전환
Hexagon·Schaeffler
Alibabadense 27B가 397B MoE 전작을 상회하며 진짜 개방의 무게중심이 30B급으로 내려옴
Google Cloud (Cloud Next)학습용과 추론용 실리콘을 최초로 분리, 범용 가속기 시대의 종언 신호
Moonshot AI오픈웨이트 모델이 SWE-Bench Verified 80%대에 진입. 독립 검증 주체는 명시되지 않음
David C. Krakauer벤치마크 간 제1주성분 설명력이 2023~24년 92%에서 추론 모델 등장 이후 64%로, 겉보기 일반성 아래의 전문화 주장
Jingbo Sun 외Search-R1 계열의 후속. 검색 횟수 자체를 학습 대상으로 삼음
Alibaba Qwen오픈 웨이트 옴니모달이 10시간 오디오·400초 비디오를 처리하며 프런티어를 따라잡음
Physical Intelligence학습 데이터가 전혀 없는 양팔 로봇에서 세탁물 접기 성공, 크로스 임바디먼트 전이
Anthropic조밀한 스크린샷·다이어그램 판독력이 computer use 성능의 병목이었음을 확인
Stanford HAIAI for science가 독립 측정 대상이 됨
Sam Altman랩 수장이 자사 지배구조 문제를 육성으로 다룬 드문 기록
Microsoft클라우드 종속·토큰 과금 없는 로컬 추론을 공식 제품 라인으로 확정
LG AI연구원LG의 첫 오픈웨이트 비전-언어 모델로, 국내 오픈웨이트 노선이 텍스트 밖으로 확장된 지점
Meta Superintelligence LabsMeta의 프론티어 모델은 폐쇄, 별도 소형 모델만 개방하는 이원 전략이 확정된 지점
Anthropic·Google·Broadcom
Krishnamoorthy 외 (인도·말레이시아·이라벨 0으로 결함 형태를 군집화해 라벨링할 대표 샘플만 고르는 워크플로의 근거. 동시에 내부 군집 지표와 실제 클래스 일치도가 따로 논다는 반례
Google (Android)안드로이드 온디바이스 AI가 시스템 서비스(AICore)로 오픈 모델을 직접 배포하는 체계로 진화
Birgitta Böckeler (martinfowAI 에이전트에서 모델을 제외한 모든 것이라는 사용자 관점 정의의 표준 문헌
AAIF·Linux FoundationAAIF 회원사 4개월 만에 170곳, MCP SDK 월간 다운로드 1.1억 초과, DNS rebinding 시연 등 보안이 최대 화두
Dongzhe Fan 외에이전틱 검색이 두 방식의 격차를 좁힘을 보여 2024년 GraphRAG 논쟁을 갱신
IEA전력과 계통 접속 지연이 근시일 확장 속도를 제한하는 물리적 병목임을 공식 확인
François Chollettest-time에 새로움에 적응하는 fluid intelligence의 등장을 이유로 든 조건부 전향
차오양과기대 (Chayanon Sub-r-pa, R결함 클래스가 새로 생기면 이미지 10장 이하로 시작해야 하는 OSAT 현실에 맞는 실험 설계. 단 절대 성능은 양산 판정이 아니라 검사 보조·트리아지 수준
Cohere텍스트 LLM 중심 랩이 음성 인식을 완전 개방 라이선스로 공개
Sakana AIAI 생성 논문의 심사 통과가 정식 학술 기록으로 편입. 자동 연구의 평가 기준 논쟁이 본격화
ARC Prize정적 문제풀이에서 지시 없는 대화형 탐색·기술 습득으로 축 이동
vLLMV1 재설계 이후 두 번째 실행 계층 재작성. 서빙 경쟁이 커널에서 스케줄러·실행 코어로 이동
Anthropic Labs (Prithvi RajaPlanner-Generator-Evaluator 3에이전트, 단일 에이전트 20분 9달러 대 풀 하네스 6시간 200달러
Cisco인프라 샌드박스와 운영 거버넌스로 에이전트 보안 스택이 계층 분리
Hugging FaceREADME가 vLLM·SGLang·llama.cpp·MLX 이전을 권고, 서빙 엔진 시장이 2강과 로컬로 정리
Shiyan Liu 외GEPA 계열 자동 프롬프트 최적화의 실패 모드를 처음으로 분리해 보임
Mistral AI별도 모델 계열을 단일 가중치로 통합하는 흐름을 오픈웨이트에서 구현
Mistral AIAI 생성 코드를 형식 명세에 대해 기계적으로 검증하는 방향. 평가 축을 경쟁 수학에서 실제 형식화 프로젝트 기여로 이동
Qdrant전용 벡터DB 진영의 반격 논리. 통합형(Postgres·Elasticsearch)에 대한 직접 응수
HumanLayer하네스 엔지니어링을 컨텍스트 엔지니어링의 부분집합으로 규정, context firewall과 back-pressure 개념
llama.cpp (ggml-org)GGUF가 자체 K-quant를 넘어 하드웨어 네이티브 FP4 포맷을 흡수
Yann LeCun / AMI LabsLLM 회의론이 10억 달러 규모의 대안 노선 베팅으로 자본화
Saroj Mishra 외에이전틱 RAG의 첫 체계적 분류. 후속 연구의 기준점
Zadouri·Shah·Thakkar·Dao 외커널 계보의 최신 세대, MLSys 2026 정식 게재
Chen Yueh-Han·Robert McCarthCoT를 안전 감시 수단으로 쓰자는 Monitorability 제안의 전제를 직접 시험한 후속
삼성전자국내 최대 수요기업의 방향성 신호. 다만 전부 2030년 목표이고 현재 배치 성과 수치는 제시되지 않음
중국 정부오픈소스 개인 에이전트에 대한 국가 단위 사용 규제의 첫 사례
국가인공지능전략위원회 (한국)한국 첫 법정 AI 기본계획. 다만 정부 포털 게시본에는 GPU·예산 수치가 없고 첨부 PDF에만 존재
METR선택편향(AI 없이 일하기를 거부하는 참가자 증가)을 이유로 실험 재설계. 2025년 19% 결과를 철회하지는 않았으나 2026년 초 개발자는 더 빨라졌을 가능성이 높다고 밝히며 이를 very weak evidence로 명시
Anthropicv3.1은 RSP가 요구하지 않아도 개발 중단 조치를 취할 자유를 명문화. 현행 v3.4
OpenAI Frontier Evals감사 대상 문제의 최소 59.4%가 결함 테스트, 벤더가 벤치마크 하네스의 신호 오염을 인정
Anthropic증류 분쟁이 의혹에서 정량적 고발로. 소송이 아니라 탐지 공개와 산업 공동 대응을 택한 것이 법적 수단의 한계를 반영
Agility Robotics·Toyota Moto휴머노이드 구독형 상업 모델. 원문은 배치 예정 표현
Birgitta Böckeler (martinfowguides/sensors 곱하기 computational/inferential 프레임의 최초 제시
첫 회차는 1054개가 한 번에 들어와 200개까지만 보여요. 연도별 페이지에서 전부 볼 수 있어요.