추론 모델·AGI 논쟁DeepSeek
DeepSeek-R1
DeepSeek-R1 — 순수 RL로 추론 능력 창발
왜 중요한가
추론 능력이 폐쇄형 랩의 비밀 레시피가 아님을 증명, 자기검증·재검토·전략 전환이 창발. RLVR과 소형 모델로의 능력 이전 레시피도 같은 보고서에서 공개됐다
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
논문arxiv.orghttps://arxiv.org/abs/2501.129482026년 8월 24일에 더한 조각 · 그 주 보기
같은 주에 나온 조각01.23Operator 및 CUA 모델 공개공식 발표01.23Humanity's Last Exam 공개 (공개 릴리스 3,000문항)공식 발표01.23행정명령 14179 서명정부 기록01.23FrontierMath 제작·이용 관계 해명문 게시공식 발표