2022년 53개 조각
기록 53 · 정리 노트 0
2022 12월 6개
Anthropic (Bai 외)
사람 라벨 대신 명문화된 원칙과 AI 피드백으로 행동을 규율, 원칙 문서를 학습 신호로 승격
EU 이사회
EU 입법 3자협상의 이사회 측 입장이 고정된 날 — 이후 조문 변경은 이 문서를 기준으로 협상됐다
2022 11월 8개
Zhou 외
자동 생성 지시문이 24개 중 19개 태스크에서 사람 작성과 동등하거나 더 나음
2022 10월 6개
2022 9월 4개
Paulius Micikevicius 외 (NVID
3사 공동 제안으로 FP8이 사실상 표준 형식이 됨. 형식 파편화를 막은 규격 합의
2022 8월 2개
2022 7월 2개
2022 6월 5개
2022 5월 7개
Aditya Kusupati 외 (워싱턴대·Goog
임베딩 차원을 사후에 조절 가능하게 만든 기법
Takeshi Kojima 외 (도쿄대·Google
예시 없는 CoT. 이후 모든 zero-shot 추론 프롬프트의 원본
Denny Zhou 외 (Google)
분해·계획 계보(Plan-and-Solve, Self-Discover)의 원형
2022 3월 8개
Paul Barham, Jeff Dean 외 (Go
PaLM 급 학습을 가능케 한 오케스트레이션 계층이자 JAX/TPU 스택의 실행 기반
Xuezhi Wang 외 (Google Resear
test-time 샘플링·투표 계보의 시작. GSM8K +10%, MultiArith +24%
Greg Yang 외
소형 모델에서 튜닝한 하이퍼파라미터를 대형으로 zero-shot 전이해 한 번에 성공 관행을 가능케 함
OpenAI (Ouyang 외)
1.3B 출력이 175B GPT-3보다 선호됨을 보여 RLHF를 정렬의 표준 절차로 정착
2022 2월 1개
2022 1월 3개
Jason Wei 외 (Google Brain)
프롬프트만으로 추론 성능을 바꾼다는 계보 전체의 기점. CoT 예시 8개로 540B가 GSM8K SOTA