③4건
툴·에이전트
- 2026-09-18OpenClaw — 업데이트를 원자적(atomic)으로 바꿈 — 업데이트를 준비하는 동안 기존 게이트웨이를 살려 두고 실패하면 마지막으로 동작하던 구성으로 되돌려, 진단과 자가 복구를 할 에이전트가 항상 남아 있게 함(2026.9.1 → 2026.9.2). 설정 옵션이 수천 개라 사용자 구성 조합을 전부 시험할 수 없다는 진단에서 나왔고, 개발자에게는 고칠 코딩 에이전트가 따로 있지만 일반 사용자에게는 그 에이전트가 유일한 자동화 수단이라는 점을 설계 근거로 들었다. 출처에이전트를 상시 운영 인프라로 보면 업데이트 실패는 기능 하나의 문제가 아니라 복구 수단 자체의 상실이다. 무중단 배포의 원칙이 개인 에이전트 런타임으로 내려온 사례.
- 2026-09-17Run-Ze Fan 외 (Zoom 외) — 코딩 에이전트 하네스 설계의 실증 연구 — 모델 4종에 대해 하네스 구성 176가지를 평가함. ①토큰 예산이 줄수록 컨텍스트 관리가 결정적이며 주된 효과는 오버플로 실패 방지 ②규칙 기반 제거와 LLM 요약을 함께 쓰는 쪽이 가장 낫고 제거한 내용을 되찾게 해 주는 것은 이득이 거의 없음 ③플래닝은 약한 모델에선 정확도를, 강한 모델에선 주로 비용을 개선 ④약한 모델은 미리 정의된 도구 인터페이스가 유리하지만 강한 모델은 bash 만 주는 쪽이 성능·효율 모두 낫다(특히 터미널 중심 과제). 궤적 수준 분석으로 각 기전을 설명함. 출처'하네스는 모델이 강해질수록 얇아져야 한다'를 176개 구성의 실측으로 뒷받침. 축⑤ 루프·하네스 엔지니어링의 설계 지침이 경험칙에서 근거로 옮겨가는 지점이다.
- 2026-09-16Anthropic — Cowork 를 별도 제품에서 없애고 Claude 하나로 합침 — 채팅과 에이전트 작업 중 어디서 할지 사용자가 고르지 않게 하고 필요한 능력을 Claude 가 판단하게 함. 동시에 대화 안에서 문서를 만드는 Claude Docs, 슬라이드를 만들고 직접 편집·발표하며 PowerPoint/PDF 로 내보내는 Claude Slides 를 넣고 Claude Design 을 대화 안으로 통합함. Pro·Max 부터 수 주에 걸쳐 웹·데스크톱·모바일에 배포하고 Team·Free 가 뒤따르며 Enterprise 관리자에게는 30일 이상 사전 고지. 출처'에이전트 제품'을 따로 파는 단계가 1년도 못 가 닫혔다. 에이전트는 별도 앱이 아니라 채팅의 기본 동작이라는 판단이며, 산출물(문서·슬라이드)이 대화 안에 들어온 것이 그 판단의 형태다.
- 2026-09-16xAI — Grok Build 에 메모리를 추가함 — 턴이 끝날 때마다 백그라운드로 작업을 훑어 팀 코딩 관례·결정의 이유·프로젝트 인프라 사실을 주제별 마크다운 파일(testing.md, code-style.md 등)로 적어 두고, 관련 작업을 시작할 때 해당 주제를 먼저 읽는다. 워크스페이스 범위와 전역 범위를 분리하고 `/memory` 로 열람, `/dream` 으로 최근 메모를 주제별로 정리함. 과제 상태·잠정 결론·비밀·이미 저장소나 문서에 있는 것은 적지 않으며 현재 대화의 지시가 메모리보다 우선함. 출처에이전트 메모리를 벡터 저장소가 아니라 사람이 읽고 고칠 수 있는 파일로 두는 설계가 또 하나 늘었다 — 메모리의 정본을 어디에 둘 것인가에 대한 업계의 수렴 방향.