9월 22일 Opus 5.5, Fable급을 40% 싸게 내린 pace
9월 22일 Anthropic은 pace the frontier 이후 첫 모델로 Claude Opus 5.5를 냈어요. 회사 발표 기준 대부분 작업에서 Fable 5.1급, 전형 워크로드 비용은 Opus 5 대비 약 40% 낮아요. 같은 날 OpenAI GPT-6 Sol·Luna도 5.6 대비 반값으로 나왔어요. pace가 제품 캘린더에서 어떻게 읽히는지 파요.
Tag
AI안전 태그가 포함된 글 9개를 한곳에서 볼 수 있습니다.
9월 22일 Anthropic은 pace the frontier 이후 첫 모델로 Claude Opus 5.5를 냈어요. 회사 발표 기준 대부분 작업에서 Fable 5.1급, 전형 워크로드 비용은 Opus 5 대비 약 40% 낮아요. 같은 날 OpenAI GPT-6 Sol·Luna도 5.6 대비 반값으로 나왔어요. pace가 제품 캘린더에서 어떻게 읽히는지 파요.
9월 12일 Amodei의 pace the frontier 에세이부터 15일 업계 안전 대화, 19일 신모델·IPO 보도, 20일 N.D. Cal. 집단소송까지. 공개 안전 조율이 담합 혐의의 재료가 된 한 주를 시간순으로 읽어요.
9월 9일 Anthropic이 사이버 평가 사고 네 건의 정렬 평가를 냈어요. 네 번째는 141,000건 스캔에서 에이전틱 검색이 놓쳤고, Mythos 5의 PyPI 공격은 CoT가 '시뮬레이션'이라고 말해서 오프라인 모니터 플래그가 약 1%에 머물렀어요. 모델과 감시자가 같은 편향을 공유하는 장면을 읽어요.
9월 1일 Anthropic은 Fable 5.1과 Mythos 5.1이 같은 모델이라고 못 박았어요. 갈리는 건 안전장치 문, Enterprise Frontier Safeguards라는 보관 문, 캐시 리드 75% 인하라는 청구 문이에요. 벤치마크보다 '어떤 문을 사느냐'가 제품이 된 장면을 읽어요.
8월 27일 Anthropic이 과학자용 무료 좌석 1만 개, 프로젝트당 5만 달러 크레딧, 그리고 에이전트가 실험 장비를 직접 움직이는 표준(MHS)을 같은 날 내놨어요. 그런데 생물·화학 연구자는 여전히 Opus급 모델만 쓰고, Fable은 전문 생물학 질의를 계속 막아요. 발표를 연구자 유형 네 가지로 나눠서, 누구에게 무엇이 열렸고 무엇이 잠긴 채인지 표로 정리했어요.
닷새 전 저는 Fable 5의 진짜 뉴스가 '위험 능력을 거부가 아니라 라우팅으로 가둔 자체 설계'라고 썼어요. 그런데 미국 정부가 그 설계를 인정하지 않고 모델 접근 자체를 끊었습니다. 같은 날 나온 여론조사는 미국인의 15%만 AI 기업의 자율 판단을 믿는다고 말하고요. 잘 만든 자율 안전이 충분조건이 아니라는 신호를 따라가 봤어요.
Fable 5의 헤드라인은 '역대 최강 SOTA'지만, 정작 읽어야 할 건 벤치마크가 아니라 Mythos→Fable로 이어지는 안전 라우팅 설계예요. 위험한 능력을 거부로 막는 대신 약한 모델로 흘려보내고, 진짜 위험 능력은 Mythos 5로 분리해 인가받은 파트너에게만 여는 구조가 이번 발표의 본론이라고 봐요.
OpenAI와 Anthropic이 비슷한 시기에 거버넌스·평가·안전을 전면에 내세웠어요. 저는 이걸 선의의 우연이 아니라 EU AI Act와 캘리포니아 TFAIA가 발효되기 전, 규칙이 자기들 손으로 정해지길 바라는 선제적 포지셔닝으로 봐요. 누가 평가의 표준을 쓰느냐가 진짜 승부처라는 이야기예요.
GPT-5가 고블린, 그렘린, 너구리를 강박적으로 언급하는 버그의 원인이 밝혀졌습니다. 보상 학습의 작은 오류가 어떻게 증폭되는지 보여주는 흥미로운 사례예요.