안전·정렬·해석가능성Zhenhua Zou 외
AgentKernel 공개
AgentKernel 공개 — 프롬프트 인젝션·메모리 오염처럼 신뢰할 수 없는 입력을 처리하면서 특권 연산을 수행하는 구조 자체를 문제로 보고, 우회 불가능한 필수 서비스로 OS 층을 세우자고 제안. 기둥 넷은 조직 간 협업을 위한 신원(identity), 단일 지점 방어를 단계적 여과로 대체하는 지각(perception), 정보흐름 제어를 적용한 기억 거버넌스(cognition), 의미 수준 요청을 커널 수준 권한으로 환원해 강제하는 실행(execution). 코드 수준 위협이 아니라 의미 수준 실패에 고전적 OS 보안 원리를 옮겨 적용한다
왜 중요한가
에이전트 프레임워크 아래에 빠져 있는 층을 지목한 설계 제안이다. 관찰 주제 「에이전트 보안·샌드박싱」이 이번 주에만 산업(NVIDIA)·학계(본 논문) 양쪽에서 같은 결론에 닿았다 — 방어는 모델이 아니라 모델 바깥에 두어야 한다는 것. 실측 평가보다 아키텍처 논증 중심이다
출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요
공식 발표huggingface.cohttps://huggingface.co/papers/2609.296472026년 9월 28일에 더한 조각 · 그 주 보기
같은 주에 나온 조각09.24바이러스 2,800종 이상의 단백질 복합체 3D 예측 구조를 AlphaFold Database 로 공개공식 발표09.23Agent-Editing World Model(AEWM) 공개공식 발표09.23월드모델의 대상영속성(object permanence) 학습 연구 공개공식 발표09.23ChatGPT Ads 를 인도네시아·말레이시아·필리핀·싱가포르·태국·베트남·대만으로 확대공식 발표