2024년 180개 조각
기록 180 · 정리 노트 0
2024 12월 18개
OpenAI (Guan·Wallace·Barak 외
안전 규범을 CoT로 명시 추론하게 학습, 추론모델 정렬의 기본 레시피
Meta (Pagnoni 외)
엔트로피 기반 동적 패치로 고정 어휘 없이 바이트를 직접 처리, 토크나이저 제거 노선의 최초 대규모 스케일링
2024 11월 12개
Tanishq Kumar 외 (하버드)
FP8/FP4가 되는가를 스케일링 법칙 수준에서 답한 검증 연구. 정밀도를 공짜 최적화가 아니라 용량 교환으로 재정의
2024 10월 20개
Anthropic (Benton 외)
모델이 인간의 감독·평가·의사결정을 방해하는 능력을 별도 위험 범주로 정식화
Xi Jiang, Jian Li, Chengjie
범용 멀티모달 LLM에 결함 판정을 직접 맡기는 구상의 상한선. 74.9%는 최종검사 판정으로 쓸 수 없는 수준
Wanchao Liang 외 (Meta)
Megatron-LM 대안으로 PyTorch 네이티브 학습 프레임워크가 성립한 시점. FSDP2·torch.compile·FP8이 한 스택으로 묶임
2024 9월 11개
Ant Group (Liang, Sun 외)
중국 빅테크가 GraphRAG 계보를 전문 도메인(금융·의료)용으로 산업화한 사례
2024 8월 14개
Peng, Zhu 외 (베이징대·앤트그룹 등)
난립하던 변종들을 하나의 분류 체계로 묶어 그래프 기반 RAG를 독립 연구 분야로 공식화
Snell 외
test-time compute가 파라미터 확대보다 효율적일 수 있음을 실증
2024 7월 13개
Meta (Llama 3 팀)
대규모 학습 내결함성 문제를 처음으로 정량 공개한 1차 자료. 체크포인팅·자동 복구가 필수임을 산업 전체에 확정
Andrej Karpathy
벤치마크 점수와 실사용 신뢰도의 괴리를 부를 이름을 만듦. Salesforce가 정식 연구 의제로 채택해 SIMPLE 벤치마크를 만들었고 Sundar Pichai는 AJI로 변주
인물·담론보도
Shumailov 외 (Nature)
Zhuowan Li 외 (Google DeepMin
롱컨텍스트 vs RAG 논쟁을 비용·성능 트레이드오프로 정리
Jay Shah 외 (Colfax·Together
커널이 특정 세대 실리콘에 맞춰 재작성되어야 함을 보인 사례. FP8 어텐션의 정확도 우려를 정량적으로 반박
켐니츠 공대·Voxar Labs(UFPE)
다이싱은 후공정 첫 공정. 소량 결함 이미지에 합성 증강만으로 23%p 향상은 신규 결함 클래스 초기 데이터 부족 구간에 직접 대응
2024 6월 19개
Hugging Face
LLM 분류기로 교육적 가치를 점수화한 부분집합이 원본보다 나은 모델을 만들어 model-based filtering을 표준화
Ilya Sutskever, Daniel Gross
제품 출시 없이 초지능만 직행한다는 조직 형태 자체가 하나의 주장. 상업화 압력과 안전을 분리할 수 있는가라는 논쟁을 촉발
인물·담론공식 발표
Pearce & Song
두 법칙의 충돌이 비임베딩 파라미터 카운팅과 소규모 분석에서 비롯됨을 규명
Sander Schulhoff 외 (메릴랜드대 외)
흩어져 있던 기법 계보를 단일 분류체계로 고정. v1 제목은 Survey of Prompting Techniques
Leopold Aschenbrenner
AGI 타임라인 논쟁을 정책·안보 의제로 밀어올림. 예측 자체보다 AGI 국유화 프레임을 도입한 효과가 컸고 동시에 가장 집중적으로 반박된 문서
인물·담론공식 발표
2024 5월 19개
Joonhyung Lee 외 (NAVER Cloud
FP8 학습 서사에 대한 정면 반박. 된다는 보고와 재현이 안 된다는 보고가 공존함을 문서화
2024 4월 16개
2024 3월 12개
일본 문화청 문화심의회 저작권분과회
일본은 AI 학습이 자유롭다고 국제적으로 인용되는 조항의 실제 한계선을 정부가 문서로 그은 사건. 작풍 모방 목적 파인튜닝은 면책되지 않는다
규제·법·거버넌스공식 발표
IEEE Spectrum (Dina Genkina)
프롬프트 엔지니어 직무 쇠퇴 서사의 초기 편집 매체 기록
Microsoft Research India (Ag
긴 프롬프트가 decode를 멈춰세우는 문제를 해소, vLLM 대비 서빙 용량 2.6~5.6배
2024 2월 14개
양즈린 (杨植麟, Moonshot AI)
롱컨텍스트를 AGI 경로의 핵심 축으로 선언한 중국 랩 창업자의 첫 체계적 진술. 2024년 중국 LLM 경쟁이 긴 문맥 경쟁으로 재편되는 언어를 제공
인물·담론보도
Xuezhi Wang 외 (Google DeepMi
CoT가 프롬프트가 아닌 디코딩 문제일 수 있음을 제시
UCL·NYU·Anthropic (Khan 외)
debate 기반 감독이 비전문가 심판의 정확도를 실제로 높인다는 첫 경험적 근거
Rick Battle 외 (VMware)
사람이 프롬프트를 손으로 다듬는 방식의 한계를 실증. 프롬프트 엔지니어링 쇠퇴 서사의 실증 근거
Zach Nussbaum 외 (Nomic AI)
학습 데이터까지 공개한 첫 경쟁력 있는 임베딩 모델. 재현 가능성을 임베딩 경쟁의 축으로 추가
2024 1월 11개
Trieu H. Trinh 외 (Google Dee
형식 검증 가능한 보상이 추론 학습을 이끈 초기 사례. 인간이 읽을 수 있는 증명 생성
ISO/IEC JTC 1/SC 42
검사 AI가 안전 인터록에 물릴 때 어느 유형인지 규정하는 것이 감사 대응의 출발점. 단 Technical Report이며 인증 근거가 되는 규범 표준이 아님
물리 세계·현실 영향공식 발표
2024년 1개
ASE Holdings
세계 1위 OSAT의 공개 범위가 곧 업계 상한선. FDC·RMS·이력추적이 AI의 전제 인프라로 먼저 깔려 있다는 순서가 중요 — 검사 모델보다 데이터 파이프라인이 먼저
물리 세계·현실 영향공식 발표