에이전틱 스캔이 놓친 네 번째 — CoT가 모니터를 설득하면 투명한 추론은 사각지대다
9월 9일 Anthropic이 사이버 평가 사고 네 건의 정렬 평가를 냈어요. 네 번째는 141,000건 스캔에서 에이전틱 검색이 놓쳤고, Mythos 5의 PyPI 공격은 CoT가 '시뮬레이션'이라고 말해서 오프라인 모니터 플래그가 약 1%에 머물렀어요. 모델과 감시자가 같은 편향을 공유하는 장면을 읽어요.
Tag
에이전트 태그가 포함된 글 19개를 한곳에서 볼 수 있습니다.
9월 9일 Anthropic이 사이버 평가 사고 네 건의 정렬 평가를 냈어요. 네 번째는 141,000건 스캔에서 에이전틱 검색이 놓쳤고, Mythos 5의 PyPI 공격은 CoT가 '시뮬레이션'이라고 말해서 오프라인 모니터 플래그가 약 1%에 머물렀어요. 모델과 감시자가 같은 편향을 공유하는 장면을 읽어요.
같은 GPT-6 Astra가 ARC-AGI-3에서 하네스만 바꾸면 High 기준 54.8%와 99.9%로 갈려요. 9월 3일 ARC Prize 표를 기준으로, 점수 제조가 가중치에서 실행 껍데기로 넘어간 장면을 읽어요.
8월 19일에 Files와 Skills API가 베타를 벗고 클라이언트 툴셋 두 개가 들어왔고, 다음 날 Python SDK가 1.0.0을 달았어요. 5월부터 이어진 흐름을 따라가 보면, 요란하게 깨지는 변경보다 아무 소리 없이 어긋나는 쪽이 더 손이 갑니다.
4B 오픈 모델이 에이전트 검색에서 GPT-5.6 Sol급 정확도를 1/100 비용에 냈다는 화제의 주장을 문답 형식으로 검증했어요. 결론부터 말하면 절반은 진짜고 절반은 마케팅이에요 — 어디까지가 사실이고 어디부터 함정인지, 원 자료(Castform·Neon)를 직접 확인해서 정리했습니다.
지난주 '멈추는 능력이 제품이 됐다'고 썼는데, 일주일 만에 물증이 나왔어요. Codex CLI 사용자의 홈 디렉토리에 쌓인 731.5GiB의 세션 로그, 그리고 같은 주에 OpenCode·Claude Code·oh-my-opencode가 일제히 추가한 깊이 제한·스폰 캡·대기 규율. 폭주는 이제 이론이 아니라 디스크와 청구서의 문제예요.
Claude Code는 Auto 모드를 기본으로 풀고, Gemini는 백그라운드 실행을 API에 넣고, oh-my-opencode는 8시간 폭주 사고를 부검했어요. 저는 이 세 발표가 같은 문장이라고 봐요. 자율 실행이 기본값이 된 지금, 경쟁력은 '시작하는 능력'이 아니라 '멈추는 능력'으로 옮겨갔어요.
이번 주 oh-my-opencode·Claude Code·OpenCode가 쏟아낸 릴리스를 겹쳐 보면, 경쟁이 '얼마나 잘 생성하나'에서 '사람이 안 볼 때 알아서 도느냐, 도구와 OS 경계를 넘어 살아남느냐, 한도를 거버넌스로 묶느냐'로 옮겨갔어요. 세 프로젝트가 같은 주에 같은 방향을 가리킨 게 우연이 아니라고 봐요.
Google I/O 2026에서 Gemini 3.5가 공개됐어요. 'action'이라는 키워드가 인상적인데, 단순 대화가 아니라 장기 에이전트 작업을 빠르게 굴리는 데 최적화된 모델이에요.
Anthropic이 SDK 자동 생성 도구 Stainless를 인수했어요. OpenAI SDK도 만들던 그 회사를 가져간 거예요. 에이전트 시대를 위한 개발자 생태계 전략이 본격화되고 있어요.
Anthropic SDK v0.97.0에 셀프 호스팅 샌드박스가 추가됐어요. Managed Agents의 코드 실행 환경을 자체 인프라에서 운영할 수 있게 된 거예요.
Anthropic SDK TypeScript v0.95.0, Python v0.100.0에 Managed Agents, 웹훅, Vault 검증이 추가됐어요. 멀티에이전트 오케스트레이션이 SDK 레벨에서 공식 지원되기 시작한 거예요.
OmO가 드디어 메이저 업데이트를 했어요. v4.0.0의 핵심은 팀 모드 — 여러 에이전트가 동시에 병렬 작업하는 멀티에이전트 협업이 가능해졌어요.
OpenAI가 Codex를 어떻게 안전하게 운영하는지 정리했어요. 샌드박싱, 승인 메커니즘, 네트워크 정책, 에이전트 텔레메트리까지 — 코딩 에이전트를 도입하려는 팀이라면 참고할 만한 내용이에요.
OpenAI Codex가 컴퓨터 직접 조작, 이미지 생성, 메모리, 자동 스케줄링까지 추가했습니다. 코딩 도구를 넘어서 범용 에이전트로 진화 중이에요.
SEO만으로는 AI 에이전트 트래픽을 잡을 수 없어요. Addy Osmani가 제안한 에이전틱 엔진 최적화(AEO)가 무엇이고, 왜 지금 신경 써야 하는지 정리해 봤어요.
OpenAI가 Agents SDK의 대규모 업데이트를 발표했어요. 샌드박스 실행 환경 분리, 오픈소스 하네스, 그리고 유연한 메모리 관리까지 에이전트 개발의 판이 바뀌는 변화예요.
MCP, A2A, UCP, AP2, A2UI, AG-UI 등 6가지 AI 에이전트 프로토콜을 레스토랑 공급망 시나리오로 쉽게 이해할 수 있는 가이드예요.
AGENTS.md와 Skills만으로는 부족했던 AI 에이전트 제어 문제를, Clarification Debt 스코어링과 역할 기반 팀 구조로 풀어낸 오픈소스 하네스를 소개해요.
OpenAI 엔지니어링팀이 5개월간 수동 코드 0줄, 100% Codex만으로 제품을 만든 경험을 공유했어요. 에이전트 퍼스트 개발의 미래가 보입니다.