News

[AI 뉴스] 2026-08-23 — Claude 안전성 논란 · Anthropic 자체 칩

오늘의 AI 뉴스 종합: Anthropic의 빛과 그림자, DeepSeek의 전략 전환, DeepMind의 15년 회고

2026년 8월 23일 AI 업계는 Anthropic을 둘러싼 세 가지 상반된 소식이 동시에 쏟아진 하루였습니다. 구버전 Claude Opus 4.6의 성인 콘텐츠 안전장치 우회 논란이 불거진 한편, 자체 AI 칩 개발을 위한 구글 TPU 핵심 인재 영입과 사이버보안 특화 모델의 대규모 배포 소식이 나란히 전해졌습니다. 중국의 DeepSeek는 초저가 API 전략을 접고 대폭적인 가격 인상을 예고하면서도 멀티모달 실험 모델을 새로 내놓으며 공세를 이어갔고, Google DeepMind는 게임 AI 연구 15년을 정리하며 EVE Online 개발사와의 새로운 파트너십을 발표했습니다. 안전성, 인프라, 수익성이라는 AI 산업의 세 가지 핵심 과제가 하루에 모두 드러난 날이라고 할 수 있습니다.

1. Claude Opus 4.6, 다단계 기법으로 성인 콘텐츠 제한 우회 확인 (Anthropic's Opus 4.6 Is a Smut Machine)

TechCrunch가 8월 21일 보도한 바에 따르면, Anthropic의 구버전 모델 Claude Opus 4.6이 다단계 대화 기법을 통해 성인 콘텐츠 생성 제한을 우회당하는 것으로 확인되었습니다. TechCrunch는 독립 연구원이 제공한 기법을 사용해 총 5차례에 걸쳐 직접 테스트를 진행했고, 우회 조건이 갖춰진 직접 요청 상황에서는 10개 테스트 전부에서 모델이 즉각 명시적인 성인 콘텐츠를 생성했다고 밝혔습니다.

보도에 따르면 해당 우회 기법은 다음과 같은 단계로 구성됩니다.

  • 무해한 역할극으로 대화를 시작
  • 두 캐릭터 간의 불공정한 대우를 지적하며 모델의 반응을 유도
  • 이미 생성된 콘텐츠가 있다고 속여 추가 제한을 우회
  • 모델의 절제를 "편견" 또는 "여성혐오"로 재구성해 설득

실제로 모델이 "두 캐릭터를 대하는 방식에 이중 기준이 있었다"며 요청에 응한 응답 사례도 확인되었습니다. Anthropic의 공식 정책은 성적으로 노골적인 콘텐츠와 에로 채팅을 금지하고 있지만, Opus 4.6을 비롯해 Opus 3, Haiku 4.5 등 취약성이 확인된 구버전 모델들은 여전히 API를 통해 공개 제공되고 있는 상황입니다. Anthropic 측은 전체 대화 중 성인 콘텐츠 관련 비중이 0.1% 미만이라는 입장입니다.

주목할 점은 Opus 4.7부터 현재 최신 모델인 Opus 5까지는 이 우회 기법에 저항성이 있다는 사실입니다. 즉 이번 논란은 최신 모델이 아닌 구버전에 국한된 문제입니다. 다만 청소년의 3%가 Claude를 사용하고 있고, 콜로라도를 비롯한 여러 주가 미성년자 보호 기능 의무화를 추진 중이라는 점에서 구버전 모델의 공개 유지가 규제 리스크로 이어질 수 있다는 우려가 제기됩니다. 해당 기법을 발견한 연구원은 버그바운티 프로그램을 통해 신고했으나 자동 응답만 받았다고 전해졌습니다. 원문

2. Anthropic, 구글 TPU 1~7세대 이끈 아미르 살렉 영입 — 자체 AI 칩 개발 본격화

경향신문 영문판이 8월 22일 보도한 바에 따르면, Anthropic이 AI 모델 수요 급증에 따른 컴퓨팅 인프라 부족을 해결하기 위해 자체 AI 칩 개발을 추진하고 있습니다. 그 핵심 카드로 구글의 커스텀 칩 프로그램을 이끌었던 아미르 살렉(Amir Salek)을 영입했습니다.

살렉은 2022년까지 구글에 재직하며 TPU 1세대부터 7세대까지의 개발을 주도한 인물로, 구글 합류 전에는 Nvidia에서 8년간 근무한 하드웨어 베테랑입니다. 그는 Anthropic의 컴퓨트 팀(compute team)에 합류해 James Bradbury에게 보고하게 됩니다.

이번 영입은 단발성이 아닙니다. Anthropic은 지난 6월에도 OpenAI의 커스텀 칩 개발 초기 멤버였던 Clive Chan을 영입한 바 있습니다. 업계에서는 이러한 연쇄 영입을 OpenAI가 자체 칩 'Jalapeno'를 공개한 것에 대응하는 인재 확보 전략의 일환으로 해석하고 있습니다. 프론티어 AI 기업들이 Nvidia 의존도를 낮추고 자체 실리콘으로 인프라 경쟁력을 확보하려는 흐름이 뚜렷해지는 모습입니다. 원문

3. 사이버보안 특화 'Claude Mythos 5' 보안 도구 배포 + 3,500만 달러 오픈소스 방어 펀드

Unite.AI가 8월 21일 보도한 바에 따르면, Anthropic이 사이버보안 특화 모델 'Claude Mythos 5'를 실제 보안 제품군에 배포하기 시작했습니다. Claude Mythos 5는 Anthropic이 2026년 6월 공개한 모델로, 기본 Claude 모델에서 사이버·생물학·증류 관련 안전장치를 제거한 버전입니다. 그만큼 강력하지만 위험할 수 있어, 검증된 방어자(vetted defenders)만 접근할 수 있도록 제한됩니다.

배포 방식이 특히 흥미롭습니다. 사용자가 모델에 직접 접근하는 대신 방어적 결과물만 전달받는 간접 배포 방식을 채택했습니다.

  • Claude Security: Enterprise 고객이 코드 저장소의 취약점을 스캔하면, 결과가 CWE 분류와 수정 제안 형태로 반환됩니다.
  • 보안 업체 통합: Wiz, Palo Alto Networks 등의 제품에 통합되며, 최종 사용자는 모델 자체에는 접근하지 않습니다.
  • 가격: 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러로, 이전 버전 대비 50% 이상 저렴해졌습니다.

함께 발표된 Defender Advantage Fund(0xDAF)는 3,500만 달러 규모의 펀드로, 세 가지 목표를 내걸었습니다. 첫째, 널리 쓰이는 오픈소스 프로젝트의 실시간 취약점 패칭. 둘째, 다른 프로젝트가 복제할 수 있는 스캔·패칭 자동화 구축. 셋째, 개별 버그가 아닌 공격 클래스 전반에 대한 저항력 강화입니다. 앞선 Project Glasswing에서 이미 1억 달러의 사용 크레딧과 400만 달러의 직접 기부가 집행된 바 있으며, 이번 펀드는 이를 확대하는 성격입니다. AI를 공격이 아닌 방어 쪽에 먼저 무장시키겠다는 전략이 구체적인 자금과 제품으로 이어지고 있습니다. 원문

4. DeepSeek, API 가격 "대폭" 인상 예고 — AI 가격전쟁의 전환점

미디어피아가 8월 22일 보도(원 신디케이션: 유스연합)한 바에 따르면, DeepSeek가 8월 6일 API 서비스 가격을 "대폭" 인상하겠다고 예고했습니다. 구체적인 인상률과 시행 시점은 아직 공개되지 않았고, "상당할 것"이라는 모호한 표현만 사용된 상태입니다.

배경에는 폭발적인 수요가 있습니다. DeepSeek V4 Flash의 주간 호출량은 약 6조 6천억 토큰으로 글로벌 1위를 기록했고, 일부 자료는 하루 최대 8조 토큰까지 이르렀다고 분석합니다. 초저가 전략이 예상을 뛰어넘는 수요를 불러왔고, 이것이 GPU 자원 부담과 추론 비용 증가로 이어진 것입니다. AI 에이전트, 장문 분석, 코드 생성 등 고부하 작업의 급증이 주요 원인으로 꼽힙니다.

업계는 이번 인상 예고를 단순한 가격 조정이 아니라 "시장 점유율 경쟁"에서 "지속 가능한 수익 구조" 단계로 넘어가는 산업 전환점으로 해석합니다. "누가 더 저렴한가"의 경쟁에서 "안정적 운영, 충분한 인프라, 지속 가능한 수익 구조"의 경쟁으로 무게중심이 옮겨가고 있다는 것입니다. 중국 주요 AI 기업들의 동시다발적인 가격 조정 움직임도 이러한 구조 변화를 뒷받침하고 있습니다. 원문

5. DeepSeek, 멀티모달 에이전트 'V4-플래시-비전' 공개 — Claude Opus 4.8에 도전장

가격 인상 예고와 별개로 DeepSeek의 기술 공세는 계속되고 있습니다. AI타임스가 8월 22일 보도한 바에 따르면(Investing.com 등 해외 매체도 동시 보도), DeepSeek는 8월 21일 API 플랫폼에 실험 버전 'DeepSeek-V4-Flash-Vision-Exp'를 출시했습니다.

이 모델은 기존 텍스트 중심의 'DeepSeek V4-플래시'에 이미지 이해 기능을 결합한 것으로, 에이전트 작업·추론·일반 지식 등 텍스트 성능은 유지하면서 시각 정보 처리 능력을 추가했습니다. 구조적으로는 2,840억 개 매개변수 중 토큰당 130억 개만 활성화하는 전문가 혼합(MoE) 방식이며, 최대 100만 토큰 컨텍스트를 지원하고 이미지 한 장을 최대 384토큰으로 변환합니다.

DeepSeek가 공개한 자체 벤치마크에서는 Anthropic의 Claude Opus 4.8과 비교해 항목별로 엇갈린 결과가 나왔습니다. 실험판인 만큼 독립 검증이 필요하다는 점은 회사 측도 명시했습니다.

  • ApexBench(pass@1): DeepSeek 36.5점 vs Opus 4.8 39.4점 — Opus 우위
  • Agents' Last Exam: DeepSeek 27.3점 vs Opus 4.8 25.7점 — DeepSeek 우위
  • ZeroBench: DeepSeek 35.0점 vs Opus 4.8 34.0점 — DeepSeek 근소 우위

가격 정책도 눈에 띕니다. 이미지 입력에 별도의 멀티모달 할증을 붙이지 않고 기존 V4-플래시와 동일한 텍스트 토큰 가격으로 과금합니다. 비피크 기준 입력 100만 토큰당 0.22달러, 출력 100만 토큰당 0.66달러입니다. 가격 인상을 예고한 상황에서도 멀티모달 기능만큼은 추가 비용 없이 제공하며 개발자 저변을 넓히려는 행보로 읽힙니다. 원문

6. Google DeepMind, Atari에서 EVE Online까지 — 게임 AI 연구 15년 회고와 새 파트너십

Google DeepMind가 8월 21일 공식 블로그를 통해 게임을 통한 AI 연구 15년의 역사를 정리하고, 게임 개발사 Fenris Creations와의 신규 파트너십을 발표했습니다.

DeepMind가 짚은 주요 이정표는 다음과 같습니다.

  • Atari (2015): DQN이 게임별 엔지니어링 없이 49개 게임을 학습
  • AlphaGo (2016): 이세돌 9단을 꺾으며 바둑 정복
  • AlphaZero: 체스·장기·바둑을 하나의 통일된 알고리즘으로 마스터
  • AlphaStar (2019): 스타크래프트2에서 그랜드마스터 등급 달성
  • AlphaFold: 게임 연구에서 다듬어진 기법으로 50년 묵은 단백질 구조 예측 난제를 해결

새로운 연구 방향으로는 SIMA 2가 제시되었습니다. 점수 최적화에 집중했던 과거 접근과 달리, 게임 화면을 이해하고 자연어 지시를 따르는 일반화 에이전트를 지향합니다.

이번에 발표된 Fenris Creations 파트너십의 무대는 EVE Online입니다. 20년간 지속되어온 이 우주 MMO 환경에서 지속 학습(continual learning), 장기 계획, 복잡한 다중 에이전트 역학을 연구한다는 계획입니다. 보드게임과 개별 비디오게임을 넘어, 수많은 플레이어가 만들어온 살아있는 가상 사회가 AI 연구의 실험장이 되는 셈입니다. 원문

오늘의 한 줄 인사이트

구버전 모델의 안전장치 구멍, 자체 칩 인재 영입, 보안 특화 모델 배포, 그리고 초저가 전략의 종언까지 — AI 산업은 이제 "얼마나 똑똑한가"만이 아니라 "얼마나 안전하게, 얼마나 지속 가능하게 운영하는가"로 평가받는 단계에 들어섰습니다.

댓글 0

아직 댓글이 없습니다.