무료 사용자에겐 광고를, 기업 고객에겐 무보존을 — OpenAI가 파는 두 개의 서로 다른 프라이버시
OpenAI가 며칠 사이에 상반돼 보이는 발표 두 개를 냈어요. 유럽 31개국에 ChatGPT 광고를 깔면서, 동시에 기업 API에는 데이터를 안 남기는 안전 처리를 내놨죠. 모순이 아니라 설계예요 — 누가 돈을 내느냐에 따라 프라이버시의 등급이 갈리는 구조를, 애드센스 다는 블로거 입장에서 읽어봤어요.
Category
AI 소식 카테고리의 글 106개를 한곳에서 볼 수 있습니다.
AI 소식 카테고리에서는 AI 뉴스, 개발 도구 업데이트, 실사용 분석처럼 서로 연결된 글을 한곳에서 탐색할 수 있습니다. 검색엔진과 사용자 모두 주제별 맥락을 쉽게 파악할 수 있도록 관련 포스트를 모았습니다.
OpenAI가 며칠 사이에 상반돼 보이는 발표 두 개를 냈어요. 유럽 31개국에 ChatGPT 광고를 깔면서, 동시에 기업 API에는 데이터를 안 남기는 안전 처리를 내놨죠. 모순이 아니라 설계예요 — 누가 돈을 내느냐에 따라 프라이버시의 등급이 갈리는 구조를, 애드센스 다는 블로거 입장에서 읽어봤어요.
Anthropic이 Claude 텍스트 워터마크의 작동 방식을 공개했어요. 단어 선택에 보이지 않는 패턴을 심는 방식인데, 하나의 질문을 끝까지 파봤습니다 — 이걸로 'AI가 쓴 글'을 정말 걸러낼 수 있나? Anthropic 자신의 설명과 학계 연구를 겹쳐 보면, 답은 '거의 못 한다'에 가까워요.
애플이 전직 직원을 통한 영업비밀 절취를 이유로 OpenAI를 제소했어요. OpenAI의 반박은 소장이 아니라 공개 블로그였고요. 두 회사가 하드웨어를 두고 정면충돌하는 이 사건을, 누가 옳은지가 아니라 '왜 블로그로 싸우는가'라는 각도에서 읽어봤어요.
50개사 서명에서 빠졌던 Anthropic이 사흘 만에 아모데이 단독 명의로 입장문을 냈어요. 골자는 이분법 거부 — 오픈 웨이트 금지가 아니라, 개방·폐쇄 가리지 않는 의무 안전 테스트를 요구합니다. 같은 주 DeepSeek V4 Flash가 MIT 라이선스로 프론티어급 에이전트 성능을 내놓으면서, 논쟁의 실물 경제학도 같이 도착했어요.
Anthropic의 SI 파트너 발표가 넉 달 만에 문법을 바꿨어요. TCS·DXC·UST가 '훈련하겠다'였다면, Cognizant는 '3만 명 훈련 완료 + 고객 성과 3건'을 들고 왔어요. 같은 주 OpenAI는 네덜란드 보험사 Univé의 97% 활성화 사례를 냈고요. 채널 전쟁이 약속 경쟁에서 실적 경쟁으로 넘어가는 지점을 짚습니다.
Anthropic이 Opus 5를 냈어요. 가격은 Opus 4.8 그대로($5/$25)인데 Fable 5에 근접한 성능, 1M 컨텍스트는 베타 딱지 없이 표준이에요. 저는 이 발표를 7/3 Sonnet 5 때 쓴 '가격 곡선 붕괴'의 2단계로 읽어요 — 이제 Anthropic 라인업 전체가 '한 단계 위 성능을 한 단계 아래 가격에'로 재편됐거든요.
NVIDIA가 주도한 'Open Weights and American AI Leadership' 성명에 Microsoft·Meta·Google, 그리고 OpenAI까지 50개사가 서명했어요. 빠진 건 Amazon과 Anthropic뿐. 같은 주에 2.8조 파라미터 오픈 모델 Kimi K3가 코딩 하네스들의 1군에 편입됐고요. 오픈 웨이트는 이제 이념 논쟁이 아니라 산업 연합이에요.
OpenAI가 한 주에 컨택센터 플랫폼(Presence), 의료기록 연동(Health in ChatGPT), 국가 과학 프로그램(Genesis Mission 지원)을 쏟아냈어요. 공통점은 모델 판매가 아니라 업종 안으로 직접 들어간다는 것 — 그것도 자사 엔지니어가 배포를 이끄는 컨설팅 방식으로요. 지난주 채점표 칼럼의 후속이자, SI 채널 전쟁의 OpenAI식 답변입니다.
지난주 '멈추는 능력이 제품이 됐다'고 썼는데, 일주일 만에 물증이 나왔어요. Codex CLI 사용자의 홈 디렉토리에 쌓인 731.5GiB의 세션 로그, 그리고 같은 주에 OpenCode·Claude Code·oh-my-opencode가 일제히 추가한 깊이 제한·스폰 캡·대기 규율. 폭주는 이제 이론이 아니라 디스크와 청구서의 문제예요.
OpenAI CFO 사라 프라이어가 'AI 시대의 채점표'를 공개했어요. 유용한 작업, 성공 작업당 비용, 신뢰성, 컴퓨트 수익률 — 4개 문항으로 AI ROI를 재자는 제안이에요. 5월 졸업, 6월 재배치, 7월 기본값화에 이어, 저는 이걸 시리즈 4막 '채점'으로 읽습니다. 단, 채점 기준을 벤더가 만들었다는 점까지 같이 봐야 해요.
OpenAI가 캘리포니아 SB 53, 뉴욕 RAISE, 일리노이 SB 315를 묶어 '주(州)가 먼저, 연방이 따라오는' 역연방주의 전략을 공식화했어요. 자동 레드티밍 GPT-Red와 청소년 보호 발표까지 같은 주에 겹쳐 놓으면, 지난주 Anthropic의 기관화와 정확히 대칭인 신뢰 전략이 보입니다. 같은 목표, 다른 문법이에요.
벤 버냉키의 LTBT 합류, 캐나다 연구기관 1,000만 달러 기부, 대중의 어려운 질문을 공개 추적하겠다는 약속, 사용 절제 도구까지 — 일주일 사이 Anthropic이 쌓은 신호 4개를 겹치면 은행이 하는 일과 구조가 똑같아요. 저는 이걸 S-1 제출 이후의 신뢰 자본 축적으로 읽습니다.
Claude Code는 Auto 모드를 기본으로 풀고, Gemini는 백그라운드 실행을 API에 넣고, oh-my-opencode는 8시간 폭주 사고를 부검했어요. 저는 이 세 발표가 같은 문장이라고 봐요. 자율 실행이 기본값이 된 지금, 경쟁력은 '시작하는 능력'이 아니라 '멈추는 능력'으로 옮겨갔어요.
GPT-5.6은 M365 Copilot이 알아서 골라 쓰는 기본 모델이 됐고, 도이치텔레콤은 업무 자체를 AI 전제로 재설계하고 있고, UST는 반도체 검증 플랫폼에 Claude를 내장했어요. 셋의 공통점은 사용자가 AI를 '선택'하는 단계가 사라지고 있다는 거예요. 5월의 졸업, 6월의 재배치에 이어 7월은 기본값화예요.
Anthropic은 과학자용 워크벤치 Claude Science를, OpenAI는 유전체학 벤치마크 GeneBench-Pro를 거의 같은 시점에 내놨어요. 한쪽은 'AI로 과학하는 도구'를, 다른 쪽은 'AI가 과학을 하는가'를 측정해요. 그리고 그 측정값(최고 31.5%)이 지금 우리가 어디쯤 있는지 냉정하게 말해줘요.
Claude Code v2.1.198에서 서브에이전트가 기본으로 백그라운드에서 돌아요. 옵션이 아니라 기본값이 됐다는 게 핵심이에요. 여기에 worktree 작업이 끝나면 알아서 커밋·푸시·드래프트 PR까지 여는 변화가 붙으면서, 에이전트를 쓰는 멘탈 모델 자체가 '기다리는 채팅'에서 '보내 놓고 알림 받는 동료'로 넘어가요.
Sonnet 5가 Opus 4.8에 근접한 성능을 프로모션 기준 입력 100만 토큰당 $2에 내놨어요. 저는 이번 발표의 진짜 뉴스가 성능 곡선이 아니라 가격 곡선이라고 봐요. 'Opus급 지능'의 값이 무너지는 중이고, 그건 우리가 기본으로 어떤 모델을 켜 둘지를 바꿔요.
OpenAI가 18년 묵은 libunwind 레이스 버그를 잡은 방법이 흥미로워요. 개별 크래시를 파고든 게 아니라, 1년치 코어덤프 전체를 인구집단처럼 분석해 하나로 보이던 미스터리를 하드웨어 결함과 소프트웨어 버그 둘로 갈라냈어요. 그리고 이 이야기에서 AI는 주인공이 아니라 도구였어요. 저는 그게 오히려 지금 AI가 개발에 기여하는 방식의 정직한 그림이라고 봐요.
이번 주 OpenAI와 Google에서 나온 의료·과학 발표 세 건을 겹쳐 보면 공통점이 보여요. 셋 다 벤치마크 점수 자랑이 아니라, 사람이 실제 랩과 임상에서 검증한 결과예요. 그리고 검증 방식이 똑같아요. AI가 가설을 내고, 사람이 현실에서 확인합니다.
이번 달 Anthropic은 서울에 사무실을 열고 정부와 MOU를 맺었고, 삼성전자는 OpenAI의 ChatGPT Enterprise와 Codex를 전사에 깔았어요. 따로 보면 흔한 뉴스지만, 겹쳐 보면 한국이 'AI 데모 시장'에서 '본사가 직접 영업소를 차리는 시장'으로 승격된 신호예요. 그 상징이 삼성을 둘러싼 양쪽의 동시 공략이고요.
이번 주 Anthropic은 TCS와 DXC를 같은 패턴으로 끌어들였어요. 개발자에게 직접 파는 게 아니라, 규제산업을 이미 점유한 시스템 통합업체(SI)를 채널로 삼는 거예요. OpenAI도 같은 주에 컨설팅 파트너망을 모집했고요. 엔터프라이즈 AI의 경쟁축이 모델 성능에서 '누가 규제산업의 배관을 깔아주느냐'로 옮겨가는 흐름을 짚었어요.
이번 주 oh-my-opencode·Claude Code·OpenCode가 쏟아낸 릴리스를 겹쳐 보면, 경쟁이 '얼마나 잘 생성하나'에서 '사람이 안 볼 때 알아서 도느냐, 도구와 OS 경계를 넘어 살아남느냐, 한도를 거버넌스로 묶느냐'로 옮겨갔어요. 세 프로젝트가 같은 주에 같은 방향을 가리킨 게 우연이 아니라고 봐요.
닷새 전 저는 Fable 5의 진짜 뉴스가 '위험 능력을 거부가 아니라 라우팅으로 가둔 자체 설계'라고 썼어요. 그런데 미국 정부가 그 설계를 인정하지 않고 모델 접근 자체를 끊었습니다. 같은 날 나온 여론조사는 미국인의 15%만 AI 기업의 자율 판단을 믿는다고 말하고요. 잘 만든 자율 안전이 충분조건이 아니라는 신호를 따라가 봤어요.
AI는 공격을 더 정교하게 만드는 게 아니라, 덜 숙련된 사람도 정교한 공격을 하게 만들어요. 그래서 공격자의 스킬로 위험을 가늠하던 MITRE ATT&CK 프레임이 흔들리고 있어요. 진짜 빈틈은 모델이 공격 단계를 스스로 잇는 agentic orchestration인데, ATT&CK에는 그 칸이 아예 없다는 게 Anthropic 분석의 핵심이에요.
Fable 5의 헤드라인은 '역대 최강 SOTA'지만, 정작 읽어야 할 건 벤치마크가 아니라 Mythos→Fable로 이어지는 안전 라우팅 설계예요. 위험한 능력을 거부로 막는 대신 약한 모델로 흘려보내고, 진짜 위험 능력은 Mythos 5로 분리해 인가받은 파트너에게만 여는 구조가 이번 발표의 본론이라고 봐요.
지난주에 저는 엔터프라이즈가 AI 코딩 '파일럿을 졸업했다'고 썼어요. 6월 사례들을 보니 이건 도입 선언이 아니라 그다음 단계, 즉 개발 생산성을 어디에 쓸지를 다시 배치하는 이야기예요. Notion·Nextdoor·LSEG가 서로 다른 자리에서 같은 변화를 가리킨다고 봅니다.
한 주 사이에 Anthropic에 이어 OpenAI도 비공개 S-1을 냈어요. 저는 이걸 'OpenAI도 IPO 준비' 한 줄로 읽으면 핵심을 놓친다고 봐요. AGI 경쟁의 무대가 연구실에서 자본시장으로 옮겨갔다는 신호이고, 두 회사의 지배구조가 상장 과정에서 시험대에 오른다는 게 진짜 쟁점이에요.
AI 코딩의 경쟁축이 '얼마나 빨리 만드나'에서 '얼마나 안 낭비하나'로 옮겨가고 있어요. 토큰의 2%만 실제 코드에 쓰인다는 측정, 유지보수 부담만 남은 바이브코딩, 그리고 손이 아닌 안목을 말하는 장인정신 논의가 같은 방향을 가리킵니다. 결과물 양이 아니라 효율과 지속가능성이 진짜 지표예요.
Anthropic이 Series H 직후 SEC에 비공개 S-1을 제출했어요. 단순 'IPO 추진' 뉴스로 읽으면 절반만 보는 거예요. 자금·모델·인프라·시장 확장을 한 흐름으로 놓고, 이게 Claude에 기대는 개발자에게 뭘 뜻하는지 따져봤어요.
한 달 동안 쏟아진 대기업 AI 도입 발표를 한 줄로 요약하면, 더 이상 '실험'이 아니라는 거예요. 빌드 파이프라인, 27만 명의 워크플로우, 세무 신고처럼 틀리면 책임이 따르는 핵심 업무로 AI가 들어가기 시작했어요. 저는 이걸 파일럿의 졸업, 즉 도입 단계가 한 칸 넘어간 변곡점으로 봅니다.
OpenAI와 Anthropic이 비슷한 시기에 거버넌스·평가·안전을 전면에 내세웠어요. 저는 이걸 선의의 우연이 아니라 EU AI Act와 캘리포니아 TFAIA가 발효되기 전, 규칙이 자기들 손으로 정해지길 바라는 선제적 포지셔닝으로 봐요. 누가 평가의 표준을 쓰느냐가 진짜 승부처라는 이야기예요.
Anthropic이 서울 오피스 개설을 앞두고 최기영 한국 대표를 선임했어요. 한국은 인구 대비 Claude 사용률이 3.5배 높은 시장이에요. 글로벌 영문 매체가 잘 안 다루는 이 소식을 한국 개발자 관점에서 정리했어요.
Anthropic이 650억 달러 규모의 Series H를 마감했어요. 기업가치는 9650억 달러, 런레이트 매출은 470억 달러를 넘었어요. 이 돈이 어디로 가는지, 그리고 Opus 4.8 출시와 같은 날 나온 의미를 짚어봤어요.
Anthropic이 Opus 4.8을 내놨어요. 가격은 그대로지만 코드 신뢰성이 4배 좋아졌고, Fast 모드 비용이 3배 내려갔어요. 매일 Claude Code를 쓰는 입장에서 체감 포인트를 정리했어요.
Google I/O 2026에서 Gemini Omni와 Gemini 3.5 Flash가 공개됐어요. 하나는 어떤 입력이든 영상으로 만들어내는 모델, 하나는 에이전트와 코딩에 초점을 맞춘 모델이에요. 9개 데모로 본 두 모델의 방향을 정리했어요.
이번 릴리스에서 /usage가 한도 사용량을 스킬·서브에이전트·플러그인·MCP 서버별로 쪼개 보여줘요. 한도 관리에 직접 도움 되는 업데이트라 정리해 봤어요.
Virgin Atlantic이 휴가 시즌이라는 절대 마감일에 맞춰 모바일 앱을 재출시했어요. Codex를 어떻게 활용해서 near-total 테스트 커버리지와 P1 0건을 달성했는지 정리해 봤어요.
Google I/O 2026에서 Gemini 3.5가 공개됐어요. 'action'이라는 키워드가 인상적인데, 단순 대화가 아니라 장기 에이전트 작업을 빠르게 굴리는 데 최적화된 모델이에요.
OpenAI 모델이 이산기하학의 핵심 추측 중 하나인 unit distance problem 관련 추측을 반증했어요. AI가 단순 보조자가 아니라 새로운 수학적 발견의 주체가 됐다는 의미라 임팩트가 큰 소식이에요.
Anthropic이 SDK 자동 생성 도구 Stainless를 인수했어요. OpenAI SDK도 만들던 그 회사를 가져간 거예요. 에이전트 시대를 위한 개발자 생태계 전략이 본격화되고 있어요.
Anthropic SDK v0.97.0에 셀프 호스팅 샌드박스가 추가됐어요. Managed Agents의 코드 실행 환경을 자체 인프라에서 운영할 수 있게 된 거예요.
Claude Code가 일주일 사이에 세 번이나 업데이트됐어요. claude agents 플래그 추가, 플러그인 의존성 관리, 백그라운드 세션 /resume까지 — 에이전트 기능이 빠르게 성숙해지고 있어요.
OmO v4.2.0은 '안정성 기초 공사' 릴리스예요. 세션 API 레이스 컨디션 해결, LSP에서 MCP로 전환, 1M 컨텍스트 해제까지 — 357개 커밋이 담긴 대규모 패치예요.
OpenAI와 Dell이 Codex를 하이브리드/온프레미스 환경에 배포하는 파트너십을 맺었어요. 코딩 에이전트가 클라우드를 넘어 기업 내부로 들어가는 본격적인 신호예요.
Anthropic SDK TypeScript v0.95.0, Python v0.100.0에 Managed Agents, 웹훅, Vault 검증이 추가됐어요. 멀티에이전트 오케스트레이션이 SDK 레벨에서 공식 지원되기 시작한 거예요.
Anthropic이 Claude Code 사용량을 두 배로 늘리고, 피크 시간대 제한도 해제했어요. 여기에 SpaceX Colossus 1 데이터센터와 컴퓨팅 파트너십까지 — GPU 22만 개가 추가되는 거예요.
OpenAI가 보안 연구자 전용 GPT-5.5-Cyber를 공개했어요. Trusted Access 프로그램 확대와 함께, 취약점 연구를 가속화하는 AI 모델이 등장한 거죠.
OmO가 드디어 메이저 업데이트를 했어요. v4.0.0의 핵심은 팀 모드 — 여러 에이전트가 동시에 병렬 작업하는 멀티에이전트 협업이 가능해졌어요.
OpenAI가 Codex를 어떻게 안전하게 운영하는지 정리했어요. 샌드박싱, 승인 메커니즘, 네트워크 정책, 에이전트 텔레메트리까지 — 코딩 에이전트를 도입하려는 팀이라면 참고할 만한 내용이에요.
코딩 에이전트의 생산성 효과는 K자형으로 갈라집니다. 코드 줄 수가 아닌 제품 개선 속도가 진짜 지표라는 이야기에 깊이 공감했어요.
Claude Code가 4개 버전을 릴리스했습니다. 플러그인 URL 설치, /color 랜덤, /mcp 도구 수 표시, VS Code Windows 수정 등. 안정성 중심 업데이트예요.
AI가 추천한 사이트에서 '로봇 아님' 인증을 하다가 악성 스크립트에 감염된 사례입니다. curl|bash 공격 체인이 정교하더라고요.
Google이 Gemma 4에서 MTP 기능을 공개 모델에서 제거했다가 커뮤니티 리버스 엔지니어링으로 발각됐습니다. 오픈소스 신뢰에 대한 중요한 사건이에요.
OpenAI가 GPT-5.5 Instant를 ChatGPT 기본 모델로 교체했습니다. 환각 52.5% 감소, 장황함 제거, 메모리 소스 추적까지. 체감 차이가 큰 업데이트예요.
GPT-5가 고블린, 그렘린, 너구리를 강박적으로 언급하는 버그의 원인이 밝혀졌습니다. 보상 학습의 작은 오류가 어떻게 증폭되는지 보여주는 흥미로운 사례예요.
OpenAI와 Microsoft가 파트너십을 대폭 수정했습니다. IP 라이선스 비독점 전환, 매출 공유 캡 설정, 멀티 클라우드 개방까지. AI 업계 판도에 영향을 줄 변화예요.
Mixture of Experts 아키텍처를 쉽게 풀어봤습니다. 1.6조 파라미터 중 490억만 활성화하는 구조가 어떻게 가격 대비 성능 3~5배 개선을 만드는지 알아봤어요.
OpenAI도 SWE-bench Verified 점수 보고를 중단했습니다. 138개 문제 중 59.4%에 결함이 있고, 데이터 오염까지. AI 코딩 평가의 다음 단계를 살펴봤어요.
Anthropic Labs에서 Claude Design을 리서치 프리뷰로 공개했습니다. 디자인 시스템 통합부터 Claude Code 핸드오프까지, 개발자에게도 의미 있는 도구예요.
Anthropic이 Opus 4.7을 출시했습니다. 비전 해상도 3배 증가, 코딩 성능 13% 향상과 함께, 시스템 프롬프트 변경 사항을 분석해봤어요.
OpenAI Codex가 컴퓨터 직접 조작, 이미지 생성, 메모리, 자동 스케줄링까지 추가했습니다. 코딩 도구를 넘어서 범용 에이전트로 진화 중이에요.
Google Cloud AI 디렉터 Addy Osmani가 JS Nation US에서 밝힌 AI 시대 시니어 개발자의 역할 변화. '이해도 부채' 개념이 인상적이었어요.
SEO만으로는 AI 에이전트 트래픽을 잡을 수 없어요. Addy Osmani가 제안한 에이전틱 엔진 최적화(AEO)가 무엇이고, 왜 지금 신경 써야 하는지 정리해 봤어요.
Google이 텍스트-음성 변환 모델 Gemini 3.1 Flash TTS를 공개했어요. 오디오 태그로 음색, 속도, 감정까지 세밀하게 조절할 수 있고, 70개 이상 언어를 지원해요.
Anthropic의 비공개 LLM Mythos가 32단계 기업 네트워크 공격 시뮬레이션을 완주했어요. 보안이 토큰 투입량 경쟁, 즉 작업증명(Proof of Work) 구조로 변하고 있다는 분석이에요.
OpenAI가 Agents SDK의 대규모 업데이트를 발표했어요. 샌드박스 실행 환경 분리, 오픈소스 하네스, 그리고 유연한 메모리 관리까지 에이전트 개발의 판이 바뀌는 변화예요.
Claude Code v2.1.94에서 Amazon Bedrock Mantle 지원과 CJK 텍스트 깨짐 수정이 들어왔고, v2.1.97은 NO_FLICKER 포커스 뷰와 MCP 메모리 누수 수정, v2.1.101은 /team-onboarding과 OS CA 인증서 자동 신뢰까지 추가됐어요.
GitHub 공동창업자이자 Pro Git 저자인 Scott Chacon이 AI 시대에 맞는 새로운 Git 클라이언트를 만들었어요. a16z로부터 $1,700만 투자까지 유치한 GitButler, 뭐가 다른지 정리해 봤어요.
Meta가 Scale AI 인수 후 Alexandr Wang 주도로 개발 중인 새 AI 모델 패밀리를 공개할 예정이에요. Llama와는 다른 '부분 오픈소스' 전략이 무엇을 의미하는지 정리해 봤어요.
AI가 너무 빠르게 발전하면서 개발자들 사이에 퍼진 불안과 우울감, '클로드 블루'라는 신조어에 대해 이야기해요. 두렵다면, 그건 아마 자연스러운 감정이에요.
ChatGPT에 글을 쓰기 전, Cloudflare Turnstile이 브라우저 지문 28개, 네트워크 정보 5개, React 앱 상태 3개까지 총 55개 속성을 수집하고 있었어요. 보안 연구자가 377개 프로그램을 복호화해서 밝혀낸 내용을 정리했어요.
삼체 문제의 '암흑의 숲' 이론을 AI 시대에 적용한 에세이를 소개해요. 아이디어를 공유하는 게 오히려 불리해지는 구조, 그리고 우리는 어떻게 대응해야 할지 생각해 봤어요.
MCP, A2A, UCP, AP2, A2UI, AG-UI 등 6가지 AI 에이전트 프로토콜을 레스토랑 공급망 시나리오로 쉽게 이해할 수 있는 가이드예요.
Claude Code에서 Skills는 단순 마크다운이 아니라 폴더 구조의 강력한 확장 포인트예요. Anthropic 내부에서 수백 개의 스킬을 운용하며 축적한 실전 노하우를 정리했어요.
Claude Code 세 버전을 한 번에 정리해요. Opus 4.6 기본 토큰 64k 확대, 메모리 최적화, Console 인증 플래그 등 알찬 업데이트가 가득해요.
Google Labs가 공개한 Stitch는 자연어를 고품질 UI 디자인으로 변환하는 AI 네이티브 캔버스예요. 와이어프레임 없이 비즈니스 목표만 설명하면 디자인이 생성돼요.
OpenAI가 GPT-5.4의 경량 버전인 mini와 nano를 출시했어요. 코딩, 도구 사용, 멀티모달 추론에 최적화된 빠르고 저렴한 모델이에요.
MCP 서버 대신 Python CLI 하나로 Linear API 전체를 감싼 Agent Skill을 만든 프로젝트예요. 토큰 소모 45% 절감에 설정도 간단해요.
OpenAI가 Python 개발 도구 Astral(uv, ruff)을 인수했어요. Codex 성장 가속화를 위한 전략적 인수인데, Python 생태계에 어떤 변화가 올지 정리했어요.
Claude Code 세 버전의 릴리스를 한 번에 정리해요. MCP 서버가 대화 중 입력을 요청하는 Elicitation, 작업 강도 조절 /effort 커맨드, 그리고 메모리 릭 수정까지.
Sebastian Raschka가 정리한 LLM 아키텍처 갤러리를 소개해요. Dense, MoE, Hybrid 구조의 진화를 182메가픽셀 고해상도 도식으로 한눈에 확인할 수 있어요.
AGENTS.md와 Skills만으로는 부족했던 AI 에이전트 제어 문제를, Clarification Debt 스코어링과 역할 기반 팀 구조로 풀어낸 오픈소스 하네스를 소개해요.
OpenCode의 최신 릴리스 v1.2.27을 정리해요. VCS watcher 버그 수정, 레거시 권한 모듈 제거, chunk timeout 증가 등 안정성 중심의 업데이트예요.
비전 모델 없이 CDP와 DOM 압축만으로 웹 탐색 에이전트를 구현한 TideSurf. GitHub 페이지 기준 84K→2.5K 토큰, 32배 압축률의 놀라운 결과를 소개해요.
Claude Code의 최신 두 릴리스를 정리합니다. 반복 실행을 위한 /loop 커맨드, tool search 프록시 개선, 그리고 수십 개의 안정성 개선.
OpenAI의 Codex Security가 리서치 프리뷰로 공개됐습니다. 프로젝트 컨텍스트를 깊이 분석해 복잡한 취약점을 탐지하고, 검증하고, 패치까지 제안하는 AI 보안 에이전트.
Google이 Gemini in Sheets의 SpreadsheetBench 벤치마크에서 70.48%로 SOTA를 달성했습니다. 인간 전문가 수준에 근접한 스프레드시트 AI의 현재.
OpenAI의 가장 강력한 프론티어 모델 GPT-5.4가 출시됐습니다. 네이티브 컴퓨터 사용, 1M 토큰 컨텍스트, Tool Search, 그리고 SOTA 코딩 성능까지.
OpenAI가 AI 보안 플랫폼 Promptfoo를 인수합니다. Fortune 500 기업의 25% 이상이 사용하는 오픈소스 AI 보안 테스트 도구가 OpenAI Frontier에 통합됩니다.
Anthropic이 AI 비전 및 인터랙션 전문 스타트업 Vercept를 인수했습니다. Claude의 컴퓨터 사용 기능이 15%에서 72.5%로 향상된 비결과 앞으로의 계획.
입력 $0.25/1M 토큰, 출력 $1.50/1M 토큰. 2.5 Flash보다 2.5배 빠른 TTFT, 45% 빠른 출력 속도. 대규모 워크로드를 위한 Google의 새 AI 모델.
GPT-5.3 Instant는 불필요한 거부를 26.8% 줄이고, 오버형(cringe) 톤을 개선하며, 환각을 22.5% 감소시켰습니다. 벤치마크가 아닌 실제 사용 경험에 집중한 업데이트.
Node.js + Playwright를 버리고 Rust 바이너리가 직접 CDP를 제어합니다. 메모리 사용량 감소, 속도 향상, AI 에이전트를 위한 최적화된 헤드리스 브라우저 CLI.
Claude Code가 HTTP Hook 기능을 추가했습니다. 커맨드 훅보다 쉽고 안전하게, 웹앱으로 AI 에이전트의 상태를 보고 권한을 관리할 수 있습니다.
Rate limit에 걸려도 멈추지 않게 하려면? OpenAI가 실시간 크레딧 시스템과 사용량 추적을 결합해 만든 혁신적인 액세스 엔진의 아키텍처를 살펴봅니다.
Claude, ChatGPT, Gemini가 생성한 비밀번호는 겉보기엔 강력해 보이지만 실제로는 몇 초 만에 뚫릴 수 있습니다. AI 코딩 에이전트가 하드코딩한 비밀번호가 더 위험한 이유.
게임 컨트롤러로 로봇청소기를 조종하려다 24개국 7천 대 기기의 카메라, 마이크, 지도 데이터에 접근하게 된 엔지니어. AI 코딩 도구가 드러낸 스마트홈 보안의 허점.
OpenAI가 ChatGPT에 Lockdown Mode와 Elevated Risk 라벨을 도입했어요. 프롬프트 인젝션과 데이터 유출을 방어하는 엔터프라이즈급 보안 기능입니다.
Anthropic이 Claude Sonnet 4.6을 출시했어요. 코딩, 컴퓨터 사용, 장문 맥락 추론 등 전방위 업그레이드된 중급 모델입니다.
Google DeepMind의 Lyria 3가 Gemini 앱에 탑재됐어요. 텍스트나 사진만으로 30초 고품질 음악을 만들 수 있습니다.
Anthropic이 $30B(약 43조원) 시리즈 G 펀딩을 받았어요. $380B 밸류에이션, 연매출 $14B, Claude Code만 $2.5B — 숫자가 경이롭습니다.
Anthropic이 Claude Opus 4.6을 출시했습니다. 코딩, 추론, 장문 컨텍스트 등 거의 모든 영역에서 업계 최고 수준의 성능을 보여주는 모델입니다.
OpenAI가 ChatGPT에 광고 테스트를 시작했어요. 무료 접근을 지원하기 위한 것이라고 하지만, AI 어시스턴트에 광고라니 복잡한 심정입니다.
OpenAI 엔지니어링팀이 5개월간 수동 코드 0줄, 100% Codex만으로 제품을 만든 경험을 공유했어요. 에이전트 퍼스트 개발의 미래가 보입니다.
Apple Xcode 26.3이 Claude Agent SDK를 네이티브로 지원합니다. SwiftUI Preview를 보면서 UI를 개선하고, 프로젝트 전체를 이해하며, 자율적으로 작업을 완수합니다.
Anthropic AI for Science 프로그램 연구자들이 Claude를 활용해 수개월 걸리던 분석을 몇 시간으로 단축하고 새로운 발견을 이끌어내는 방법.