안전·정렬·해석가능성OpenAI (Guan·Wallace·Barak 외)
Deliberative Alignment
Deliberative Alignment
왜 중요한가
안전 규범을 CoT로 명시 추론하게 학습, 추론모델 정렬의 기본 레시피
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
논문arxiv.orghttps://arxiv.org/abs/2412.163392026년 8월 24일에 더한 조각 · 그 주 보기
같은 주에 나온 조각12.20Cache-Augmented Generation 발표논문12.20o3의 ARC-AGI 결과 공개공식 발표12.19Building Effective AI Agents공식 발표12.19Gemini 2.0 Flash Thinking Experimental보도