Anthropic이 과학자에게 연 것과 잠근 것 — 1만 석, 장비 표준, 5만 달러 크레딧, 그리고 Opus급에 묶인 생물학

Anthropic이 과학자에게 연 것과 잠근 것 — 1만 석, 장비 표준, 5만 달러 크레딧, 그리고 Opus급에 묶인 생물학

16분 읽기원문 보기

한줄평

같은 날 발표를 연구자별로 나누면 답이 갈려요. 물리·수학·재료 연구자에게는 좌석·크레딧·장비 표준이 전부 열렸고, 생물·화학 PI는 좌석은 받지만 모델은 Opus급에 묶이고, 신약·바이러스학 전문가의 길은 미 정부와 함께 운영하는 Mythos급 프로그램 하나예요. 실험실 자동화 담당에게 MHS는 가장 실질적인 발표지만 신청제 프리뷰이고 오픈소스 시점은 없어요. 6월에 제기한 '조용한 라우팅' 문제는 1만 석 앞에서 규모가 커졌어요.

8월 27일 하루에 Anthropic 뉴스룸에 글이 두 개 올라왔어요. 하나는 과학자 지원 확대, 하나는 Model Hardware Standard 연구 프리뷰. 8월 7일의 Fable 5 생물학 안전장치 개선과 8월 25일의 웰빙 평가 연구 지원금까지 넣으면 한 달 안에 네 건이에요. 발표문은 전부 "더 많은 과학자에게 더 많이"라는 방향으로 쓰여 있는데, 받는 사람 쪽에서 보면 열린 정도가 분야마다 달라요. 그래서 이 글은 연구자 유형 네 가지를 축으로 잡고, 각 유형에 무엇이 열렸고 무엇이 잠긴 채인지 나눠 봤어요.

먼저 표 하나

연구자 유형좌석·크레딧쓸 수 있는 모델장비 자동화 (MHS)남아 있는 제약
물리·수학·재료·계산과학1만 석(무료 / 프리미엄 월 $15), 크레딧 최대 $50,000 — 이번에 새로 대상이 됨Fable 포함 전 라인프리뷰 신청 가능 (QuEra·CMU 사례)좌석은 PI 인증, 프리뷰는 신청제
생물·화학 (대학·비영리 PI)동일Opus급 한정프리뷰 신청 가능 (Genentech·UW 사례)전문 생물학·신약 질의는 Fable에서 Opus 5로 폴백
신약·바이러스학·독성학 (산업)크레딧은 "모든 연구자" 대상, 좌석은 학술·비영리만Fable 차단 유지, Mythos급은 미 정부 협력 프로그램동일프로그램 자격·일정·미국 외 접근 미공개
실험실 자동화·장비 엔지니어해당 없음모델 무관 (model-agnostic)핵심 대상 — 표준 드라이버, MCP·CLI·코드 세 경로오픈소스 시점 미정, 사람 감독 필요를 명시

아래는 각 줄의 근거예요.

물리학자와 수학자: 가장 많이 열린 쪽

좌석 조건은 이래요. 전 세계 과학자에게 1만 석을 열고, 표준 좌석은 1년 무료(정가 월 $20), 5배 한도의 프리미엄 좌석은 월 $15(정가 월 $100). 신청은 대학이나 비영리 연구기관의 책임연구자(PI) 또는 그에 준하는 사람만 할 수 있고, 인증되면 연구실 구성원을 최대 25석까지 추가해요. 표준 좌석에도 Claude Science·Code·Cowork가 들어가요. Anthropic은 "초기 1만 석을 훨씬 넘어 확대할 계획"이라고 썼어요.

크레딧은 더 큰 변화예요. AI for Science 프로그램은 2025년 5월에 생물·생명과학 중심으로 시작했고, 6월 Claude Science 출시 때 프로젝트당 상한이 3만 달러였어요. 이번에 상한이 프로젝트당 5만 달러로 올랐고, 대상이 넓어졌어요. 원문은 "지금까지 주로 생물과학 연구자를 지원했는데, 이제 다른 과학 분야, 특히 야심 있고 연산 집약적인 연구를 하는 연구자에게도 크레딧을 제공하려 한다"고 쓰고, 예시로 리만 제타 함수 연구와 단백질 설계를 들었어요. 물리·수학·재료·계산과학 연구실은 이번에 처음으로 정식 대상이 된 셈이에요.

그리고 이 유형에는 모델 등급 제약이 없어요. Fable을 그대로 써요. 장비까지 있으면 MHS도 해당돼요. 퀀텀 컴퓨팅 회사 QuEra의 사례가 대표적인데, 레이저 재고정(relock) 스크립트를 사람이 짠 버전은 성공률 58%에 150초 걸렸고, 에이전트가 만든 버전은 6초에 96%, 블라인드 700회 시험에서 695회 성공(99.3%)이었다고 해요. 16시간 무인 실험 363회로 PID 튜닝을 15.7mV에서 1.55mV로 낮췄고, 19시간 연속 운전에서 잠금 해제가 한 번도 없었다고요(전문가 운전은 시간당 약 1.6회). 카네기멜런 사례는 용량-반응 실험을 약 3배 빠르게, 셋업을 수 주 대신 8시간에 끝냈고, 의도적으로 넣은 고장 6건을 장비가 움직이기 전에 전부 차단했다고 적었어요. 이 수치들은 전부 파트너가 보고한 값이에요. 독립 검증은 없고, 원문도 "Claude의 공간·물리 추론에는 여전히 전문가 감독이 필요한 한계가 있다"고 썼어요.

생물학·화학 PI: 좌석은 열리고 모델은 닫힌 채

같은 발표문 아래쪽에 이 문장이 있어요. "당분간 생물학과 화학 연구자는 우리의 Opus급 모델로 제한된다. Claude Fable 모델은 이중 용도 위험 때문에 전문 생물학 및 신약 개발 질의를 계속 차단할 것이다."

'계속'이라는 단어가 8월 7일 글로 링크돼 있어요. 그 글이 차단의 작동 방식을 설명해요. 작은 분류기 모델이 요청을 보고, 위험하다고 판단하면 요청을 Opus 5로 재라우팅해요. Fable 5는 출시 때 "거의 모든 생물학 질의를 의도적으로 차단"한 상태였고, 그렇게 하지 않으면 일반 공개가 몇 주에서 몇 달 늦어졌을 거라고 Anthropic은 설명했어요. 8월 7일 개선은 분류기의 규칙 문서(constitution)를 다시 쓰고 학습 데이터를 다시 만들어 재학습한 것이고, 그 결과 생물학 관련 폴백이 제품 전반에서 약 85% 줄었어요. 각주의 전체 폴백 감소율은 Claude.ai 67%, Cowork 55%, Claude Code 17%, Claude Platform 7%예요. 검사 결과 해석, 증상 이해, 생물학 학습 같은 일상 질의와 의료진의 임상 업무는 이제 대부분 Fable이 답해요.

그래도 남는 게 있어요. 원문 그대로, "Fable은 바이러스학, 독성학, 분자 설계를 포함해 우리가 이중 용도로 간주하는 요청에 대해서는 여전히 Opus 5로 폴백하므로, 전문 생물학 연구와 신약 개발에는 아직 쓸 수 없다." Anthropic은 "매우 아마 무해한" 내용도 일부 막히는 안전 여유(safety margin)를 의도적으로 남겼고, 오탐은 불가피하게 남는다고 인정했어요. 이유는 Fable 5가 일부 고난도 생물학 과제에서 전문가를 능가하기 때문이고, 근거로 미국 정보공동체의 2026년 연례 위협 평가를 들었어요.

6월에 Fable 5를 다룰 때 이 블로그가 걱정한 게 정확히 이 지점이었어요. 조용한 라우팅은 품질 저하를 숨기고, 걸러진 5%에 멀쩡한 생물학 수업 질문이 섞이면 그 사람은 이유도 모른 채 더 약한 답을 받는다고요. 그때는 5% 미만의 세션 얘기였어요. 지금은 1만 석이에요. 이 프로그램은 1년 넘게 생물과학 중심이었고, Claude Science의 스킬 60여 개는 7월에 정리했듯 유전체학·단일세포 분석·프로테오믹스·구조생물학용이에요. 좌석 신청자의 상당수가 생물학자일 거라는 건 발표 구조 자체에서 나와요. 그 사람들이 받는 건 Claude Science라는 작업대와, 핵심 업무에서는 그 아래의 Opus 5예요. Opus 5가 그 일에 충분한지에 대한 자료는 어느 발표에도 없어요. 7월 글에 기록한 GeneBench-Pro 점수(Opus 4.8 16.0%)가 공개된 유일한 숫자인데, 그건 다른 걸 측정한 벤치마크예요.

한 가지 더 눈에 띄는 대비가 있어요. MHS 사례 중 Genentech은 액체 핸들러와 로봇 팔로 단백질 정량 분석(BCA assay)을 돌리는 신약 개발 워크플로우예요. 장비는 움직이고, 같은 회사 연구자가 분자 설계를 물으면 Fable은 답을 Opus 5로 넘겨요. 두 발표가 같은 날 나왔고, 둘 다 사실이에요.

신약·바이러스학 전문가: 하나뿐인 길

산업계 생명과학 연구자에게 열린 문은 한 문장이에요. "우리는 생명과학 전문가가 Mythos급 모델을 생명과학 연구개발에 쓸 수 있도록 미국 정부와 협력해 접근 프로그램을 만들고 있다. 첫 참가자들이 등록했고, 곧 더 공유하고 접근을 늘릴 것이다." 자격, 일정, 인원, 미국 외 접근 여부는 전부 미공개예요. 크레딧은 "모든 연구자가 신청할 수 있다"고 되어 있지만 좌석은 학술·비영리 한정이고, 크레딧을 받아도 모델 등급 문제는 그대로예요.

6월에 예고된 대로 가고 있는 거예요. Fable 5 출시 때 Anthropic은 일부 바이오 연구자에게 Mythos를 곧 열되 바이오 안전장치만 풀고 사이버는 잠가 두겠다고 했고, 닷새 뒤 미국 정부가 접근을 중단시켰어요. 두 달 반이 지난 지금, 그 정부가 접근 프로그램의 공동 운영자로 문장 안에 들어와 있어요. 국내 제약·바이오 연구자 입장에서는 현재 시점에 길이 없다고 보는 게 정확해요. Anthropic이 서울 오피스를 두고 있어 기관 단위 문의 경로는 있지만, 프로그램 자체가 미국 정부와의 협력으로 정의돼 있어서 국내 기관이 언제 대상이 될지는 아무 데도 적혀 있지 않아요.

장비를 다루는 사람: 가장 실질적인 발표

네 유형 중 MHS가 직접 겨냥한 건 이 사람들이에요. 발표문이 설명하는 구조는 이래요. 실험실 장비마다 제조사 프로그램이 따로 있고 서로 통신하지 않아서, 연구실이 장비를 통합하는 데 보통 몇 주에서 몇 달이 걸려요. MHS는 표준 드라이버를 둬요. 운영체제와 장비 사이에서 번역하는 소프트웨어인데, "온도 읽기" 같은 read와 "온도 설정" 같은 write 프리미티브로 모든 장비를 같은 방식으로 다루게 해요. 장비는 표준 형식으로 검색 가능해져서 네트워크 너머의 에이전트가 찾을 수 있고, 드라이버는 장비가 측정할 수 있는 것, 조정할 수 있는 것, 강제되는 안전 한계를 담은 참조 파일을 자동으로 만들어요. 로봇 팔의 무게 같은 암묵지는 자연어 태그로 적고, 태그는 에이전트가 사용자를 인터뷰해서 채울 수도 있어요. 에이전트가 장비에 닿는 경로는 세 가지, MCP·명령줄·코드 파일이에요. 프로그래밍 인터페이스가 있는 장비면 뭐든 되고 모델은 가리지 않는다고 하지만, 인터페이스 없는 장비는 아직 안 돼요.

숫자는 이래요. 워싱턴대 베이커 랩은 장비 6대를 연결하는 데 드라이버 작성 시간까지 포함해 일주일이 안 걸렸고, HHMI 자넬리아는 제조사 프로그램 7개가 돌던 장비에 카메라를 추가하는 일이 며칠에서 몇 분으로 줄었대요. Tetsuwan Scientific은 분주 9,143회를 자동화해 제조사 스펙보다 약 12% 높은 정밀도 모델을 만들었다고요. 반대 방향의 기록도 원문에 있어요. Genentech 사례에서 기포가 생겼을 때 "Claude의 기본 본능은 그냥 재시도였고, 우리가 안내해야 했다"는 문장, QuEra 사례의 "Claude가 종종 멈춰서 사람의 확인을 기다렸다"는 문장이에요.

참여 조건은 신청제예요. 과학·로봇·전자·제조 분야 파트너에게 초기 버전을 먼저 공유하고, 파트너와 안전 평가를 만든 뒤 오픈소스로 공개한다는데, 날짜는 없어요. 생태계 목록에 Universal Robots, Tecan, QIAGEN, AWS(Strands Robots), Hugging Face(LeRobot), Raspberry Pi와 함께 두산로보틱스가 들어가 있어요. 국내 장비 회사가 초기 파트너 명단에 있다는 건 국내 연구실이 MHS 드라이버를 만날 경로가 제조사 쪽에서 먼저 열릴 수 있다는 뜻이에요.

평가를 안에 두는 것과 밖에 내놓는 것

네 발표를 같이 읽으면 평가의 위치가 갈려요. 생물학 분류기의 규칙 문서는 Anthropic이 안에서 다시 썼어요. 내외부 전문가 피드백을 받았다고는 하지만 최종 판단은 회사 것이에요. MHS의 안전 평가는 출시 파트너와 함께 만들고, 프리뷰 결과를 배포 가이드로 공개하겠다고 했어요. 웰빙 쪽은 가장 멀리 나갔어요. 500만 달러를 독립 연구자에게 주고, 수혜자는 "완전히 독립적으로" 일하며 결과를 오픈소스로 내요. 평가가 갖춰야 할 조건도 다섯 가지로 적어 뒀어요. 무엇을 측정하는지 명시할 것, 임상·주제 전문가를 설계와 검증에 넣을 것, 과잉 순응과 과잉 거부 양쪽을 시험할 것, 위험이 단계적으로 커지는 다회차 대화를 반영할 것, 채점기를 실제 전문가와 대조할 것. 접수는 9월 21일 마감, 전체 제안서 제출 대상은 10월 5일까지 통보예요.

7월에 Anthropic의 기관형 신호를 정리할 때 캐나다 연구기관 1,000만 달러 기부를 하나로 꼽으면서 "전부 자기 설계 장치"라는 한계를 같이 적었어요. 이번 500만 달러는 독립성 조항을 명문화했다는 점에서 한 걸음 나갔고, 그 독립 연구자를 고르고 평가 기준을 쓴 쪽이 Anthropic이라는 점에서 같은 자리에 있어요. 다만 생물학 분류기만은 밖으로 내놓지 않았어요. 가장 큰 위험이라고 스스로 규정한 영역의 판정 기준을 회사가 쥐고 있는 건, 제가 보기엔 안전 논리로도 사업 논리로도 일관된 선택이에요. 그 일관성이 생물학자에게는 문이 반만 열린 이유가 되는 것이고요.

그래서 누가 무엇을 하면 되나

물리·수학·재료·계산과학 연구실이라면 지금 신청하는 게 맞아요. PI 인증만 통과하면 좌석은 1년 무료고, 연산 집약적 프로젝트는 5만 달러 크레딧의 첫 정식 대상이에요. 장비가 있으면 MHS 프리뷰도 같은 창구에서 신청할 수 있어요.

생물·화학 PI라면 좌석은 받을 가치가 있어요. Claude Science라는 도구와 Opus 5는 그대로 쓸 수 있으니까요. 다만 분자 설계·바이러스학·독성학 질의가 Fable에서 Opus 5로 넘어간다는 걸 알고 시작해야 하고, 연구실의 실제 업무에서 Opus 5가 충분한지는 스스로 재봐야 해요. 그 비교를 공개한 곳이 아직 없어요. Anthropic이 말한 "신뢰 기반 접근 경로"가 학술 PI에게도 열리는지가 다음에 볼 지점이에요.

산업계 신약·생명과학 연구자라면 현재로선 Fable을 계획에 넣지 않는 게 안전해요. 크레딧 신청은 열려 있지만 모델 등급은 같고, Mythos급 프로그램은 미국 정부와의 협력으로만 정의돼 있어요.

장비를 다루는 엔지니어라면 두 가지 선택이 있어요. 프리뷰를 신청해서 드라이버를 지금 써보는 것, 아니면 오픈소스 공개와 배포 가이드를 기다리는 것. API·SDK·GUI 중 하나라도 있는 장비면 통합 대상이고, 두산로보틱스가 명단에 있으니 국내 로봇 팔은 제조사 드라이버가 먼저 나올 가능성을 지켜볼 만해요.


근거가 된 소식: Expanding our support for scientists (Anthropic, 8/27), Previewing the Model Hardware Standard (Anthropic, 8/27), Improving Fable 5's biology safeguards (Anthropic, 8/7), Funding better evaluations of AI's impact on wellbeing (Anthropic, 8/25), Claude team plan for scientists 가격 페이지. MHS 사례의 수치는 파트너 보고값이며 독립 검증은 확인되지 않았어요.

광고

T
TomAI 코딩 도구를 매일 쓰는 개발자

Claude Code, OpenCode 같은 AI 코딩 도구를 직접 쓰면서 AI 업계의 변화를 개발자 관점에서 기록합니다. 단순 번역이 아니라 써본 경험과 해석을 함께 남기려고 해요.

AI 소식칼럼

같은 주에 '과학용 작업대'와 '과학 시험지'가 나왔다 — 그리고 시험지는 아직 못 푼다고 답했다

Anthropic은 과학자용 워크벤치 Claude Science를, OpenAI는 유전체학 벤치마크 GeneBench-Pro를 거의 같은 시점에 내놨어요. 한쪽은 'AI로 과학하는 도구'를, 다른 쪽은 'AI가 과학을 하는가'를 측정해요. 그리고 그 측정값(최고 31.5%)이 지금 우리가 어디쯤 있는지 냉정하게 말해줘요.

AI 소식칼럼

내가 칭찬한 그 안전 설계를, 정부가 닷새 만에 막았다 — Fable 5 접근 중단이 말하는 것

닷새 전 저는 Fable 5의 진짜 뉴스가 '위험 능력을 거부가 아니라 라우팅으로 가둔 자체 설계'라고 썼어요. 그런데 미국 정부가 그 설계를 인정하지 않고 모델 접근 자체를 끊었습니다. 같은 날 나온 여론조사는 미국인의 15%만 AI 기업의 자율 판단을 믿는다고 말하고요. 잘 만든 자율 안전이 충분조건이 아니라는 신호를 따라가 봤어요.

AI 소식칼럼

Claude Fable 5: '가장 센 모델'보다 '위험을 가두는 방식'이 진짜 뉴스

Fable 5의 헤드라인은 '역대 최강 SOTA'지만, 정작 읽어야 할 건 벤치마크가 아니라 Mythos→Fable로 이어지는 안전 라우팅 설계예요. 위험한 능력을 거부로 막는 대신 약한 모델로 흘려보내고, 진짜 위험 능력은 Mythos 5로 분리해 인가받은 파트너에게만 여는 구조가 이번 발표의 본론이라고 봐요.