Claude가 쓴 글에 워터마크가 박힌다 — 그런데 이게 정말 AI 감별에 쓸 수 있을까
Anthropic이 Claude 텍스트 워터마크의 작동 방식을 공개했어요. 단어 선택에 보이지 않는 패턴을 심는 방식인데, 하나의 질문을 끝까지 파봤습니다 — 이걸로 'AI가 쓴 글'을 정말 걸러낼 수 있나? Anthropic 자신의 설명과 학계 연구를 겹쳐 보면, 답은 '거의 못 한다'에 가까워요.
AnthropicAI 보안
Tag
AI 보안 태그가 포함된 글 2개를 한곳에서 볼 수 있습니다.
Anthropic이 Claude 텍스트 워터마크의 작동 방식을 공개했어요. 단어 선택에 보이지 않는 패턴을 심는 방식인데, 하나의 질문을 끝까지 파봤습니다 — 이걸로 'AI가 쓴 글'을 정말 걸러낼 수 있나? Anthropic 자신의 설명과 학계 연구를 겹쳐 보면, 답은 '거의 못 한다'에 가까워요.
OpenAI가 AI 보안 플랫폼 Promptfoo를 인수합니다. Fortune 500 기업의 25% 이상이 사용하는 오픈소스 AI 보안 테스트 도구가 OpenAI Frontier에 통합됩니다.