News

[AI 뉴스] 2026-10-08 — Claude Haiku 5.5 · GPT-6 전체 공개 · DeepSeek 격차 3%

10월 둘째 주 AI 업계는 모델 성능 경쟁을 넘어 “어떻게 실제 업무와 서비스에 꽂아 넣느냐”로 전선이 옮겨가는 모습이 뚜렷했다. Anthropic은 소형 모델 가격을 다시 낮추고 Google Workspace 안으로 들어갔고, OpenAI는 GPT-6를 전체 사용자에게 열며 챗봇 화면 자체를 바꾸는 실험을 시작했다. 한편 중국 DeepSeek은 모델 성능 격차를 바짝 좁히는 동시에 보안 위협으로도 이름이 오르내렸고, 프랑스 Mistral AI와 구글은 각각 1조 파라미터 모델과 노코드 게임 플랫폼으로 존재감을 드러냈다.

Anthropic, 소형 모델부터 업무 생산성까지 전방위 확장

  • Claude Haiku 5.5 공개 (Claude Haiku 5.5 Release) — Anthropic이 Claude 5.5 패밀리의 세 번째 모델인 Haiku 5.5를 출시했다. 10만 토큰 이하 입력 기준 백만 토큰당 입력 0.10달러, 출력 0.50달러로, 10만 토큰을 넘으면 입력 0.50달러, 출력 2.50달러로 책정됐다. 이는 전작 Haiku 4.5 대비 평균 75% 비용 절감이며, 짧은 요청에서는 최대 90%까지 가격이 내려간 셈이다. 고객 테스트에서는 작업 완료 지연 시간이 30% 줄고 추론 속도는 최대 2.5배 빨라졌다는 결과가 나왔고, 악의적인 컴퓨터 사용 요청에 대한 거부율도 58.93%에서 82.59%로 높아졌다. Anthropic은 분류, 요약, 추출, 서브에이전트 작업, 브라우저 자동화처럼 호출 빈도가 높은 작업에 이 모델이 적합하다고 설명했다. 기사 보기
  • Claude Sonnet 5.5, 개발자 도구에 반영 (Claude Sonnet 5.5 in llm-anthropic 0.30) — 개발자 Simon Willison이 자신이 만든 llm-anthropic 플러그인을 0.30 버전으로 올리며 Claude Sonnet 5.5 지원을 추가했다고 밝혔다. 이번 업데이트로 llm anthropic refresh 명령으로 Anthropic API에서 최신 모델 목록을 바로 가져올 수 있고, llm anthropic count 명령으로 실제 호출 전에 토큰 수를 무료로 미리 계산할 수 있게 됐다. Claude 5.5 패밀리의 두 번째 모델인 Sonnet 5.5는 전작 Sonnet 5보다 30% 이상 빠르고 대부분의 작업에서 비용도 최대 30% 낮다. 에이전틱 코딩 능력을 보는 Terminal-Bench 4.0 벤치마크에서 Sonnet 5.5는 70.6%를 기록해 Sonnet 5의 10.3%를 크게 앞질렀다. 가격은 입력 백만 토큰당 2달러, 출력 10달러다. 기사 보기
  • Claude for Google Workspace 베타 출시 (Claude for Google Workspace Public Beta) — Anthropic이 Claude를 Google Docs, Sheets, Slides 사이드바에 통합하는 애드온의 퍼블릭 베타를 시작했다. Docs에서는 문장이나 제목을 다듬으면서 기존 서식을 유지하고, 큰 폭의 수정은 승인하거나 거부할 수 있는 카드 형태로 제시된다. Sheets에서는 수식, 피벗테이블, 차트 생성과 새 탭 추가는 물론 Python 기반 데이터 클리닝까지 지원하며, Slides에서는 기존 레이아웃과 테마를 유지한 채 슬라이드를 만들고 요소가 슬라이드 밖으로 나가거나 서로 겹치는지 자동으로 감지한다. 사용자는 “편집 전 질문” 또는 “모든 편집 자동 승인” 모드를 고를 수 있고, Pro·Max·Team·Enterprise 등 모든 유료 플랜에서 Google Workspace Marketplace를 통해 이용 가능하며 관리자는 Google Admin 콘솔로 조직 전체에 배포할 수 있다. 같은 베타에 Google Docs·Sheets·Slides 커넥터도 포함돼 Claude 채팅에서 바로 구글 파일을 생성·수정할 수 있다. 기사 보기

중국 AI의 추격과 보안 리스크: DeepSeek을 둘러싼 두 얼굴

  • DeepSeek, ‘하네스’ 신설팀 대규모 채용 (DeepSeek's New Harness Team Hiring Spree) — 중국 DeepSeek이 AI 에이전트 시장 공략을 위해 신설한 ‘하네스(Harness)’ 부서에서 연구원, 소프트웨어 엔지니어, 제품 관리자 등을 대규모로 모집하고 있다. 팀 리더 추이톈은 매일 지원자를 면접하며 여러 채용 플랫폼에 동시에 공고를 내고 있다고 밝혔다. 하네스는 기초 모델과 외부 도구, 실행 환경을 연결해 모델이 자율적으로 업무를 수행할 수 있게 하는 소프트웨어 계층을 뜻한다. DeepSeek은 채용 공고에서 “모델+하네스=에이전트”라는 개념을 내세우며, 모델 성능뿐 아니라 이를 둘러싼 실행 시스템이 시장 경쟁력을 가른다는 인식을 드러냈다. 기사 보기
  • 금융권 해킹 도구 ‘아르텍스’, 딥시크 연동 확인 (ARTEX Hacking Tool's DeepSeek Integration) — 국내 금융권을 겨냥한 해킹에 쓰인 AI 침투 도구 아르텍스가 중국 딥시크와 연동되는 기능을 갖춘 것으로 확인됐다. 아르텍스는 LLM 다중 에이전트를 기반으로 한 자율 침투 시스템으로, 오픈AI나 Anthropic 등 여러 LLM을 ‘두뇌’로 연결해 여러 AI 에이전트가 공격 목표를 분석하고 침투 경로를 계획한 뒤 명령 실행과 HTTP 통신까지 자동으로 수행한다. 9월 13일 공개된 0.3.10 버전에서 딥시크 기반 웹 검색 기능이 추가됐지만, 이번 국내 금융권 해킹에 딥시크가 실제로 쓰였는지는 아직 확인되지 않았다. 보안업계는 AI 모델의 출처만 볼 게 아니라 어떤 시스템과 연결되고 어떤 명령까지 실행할 수 있는지를 함께 통제해야 한다고 지적했다. 기사 보기
  • 반도체 규제 속 미·중 AI 격차 3%까지 좁혀 (US-China AI Gap Narrows to 3%) — 블룸버그 인텔리전스 분석에 따르면 중국 최상위 AI 모델과 미국 경쟁 모델의 벤치마크 성능 격차가 연초 15%에서 현재 약 3%까지 줄었다. 평가 플랫폼 LiveBench에서 DeepSeek V4.1 Flash는 81.1점으로 세계 6위에 올랐고, 이는 현재 Anthropic 최고 모델의 83.4점과 불과 2.3점 차이다. DeepSeek V4.1 Flash는 전체 파라미터 중 일부만 선택적으로 사용하는 MoE(전문가 혼합) 구조로 효율을 높였으며, 약 600만 달러의 예산과 2개월이라는 짧은 기간에 개발됐다. DeepSeek은 화웨이와 협력해 자체 AI 칩 생태계 구축도 함께 가속화하고 있다. 기사 보기

Mistral AI, 1조 파라미터 모델로 유럽의 반격

  • Mistral Large 4(Le Chonk) 공개 (Mistral Large 4 'Le Chonk' Unveiled) — 프랑스 Mistral AI가 새 오픈웨이트 모델 Mistral Large 4를 10월 6일 프리뷰로 공개했고, 실제 모델 가중치는 10월 27일 공개될 예정이다. MoE 구조 기반 멀티모달 모델로 전체 1조 파라미터 중 490억 개만 활성화해 연산 효율을 끌어올렸으며, 160여 개 언어를 지원하고 코딩·금융·지리공간 분석·제조·제품설계 같은 기업용 활용을 목표로 삼았다. CEO 아르튀르 멍슈는 사이버 분야 등 일부 영역에서 중국 모델보다 앞선다며 “유럽이 AI 경쟁에서 밀린다는 얘기는 사실이 아니다”라고 강조했다. 공개 전 사이버보안 전문가와 정부기관에 모델을 제공해 안전성을 검증하고 탈출 시도 차단 테스트도 거쳤다. 지난달 시리즈D에서 30억 유로를 조달한 Mistral은 유럽 데이터센터 확대와 후속 모델 개발에 이 자금을 투입할 계획이며, 금융·제조·공공 고객이 데이터를 외부로 내보내지 않고 자체 인프라에서 모델을 온프레미스로 운영할 수 있다는 점도 함께 내세우고 있다. 기사 보기

OpenAI, GPT-6 전면 확대와 생활 밀착형 서비스 공세

  • GPT-6와 'Intelligent UI' 전체 공개 (GPT-6 and Intelligent UI for Everyone) — OpenAI가 주간 사용자 12억 명을 대상으로 GPT-6를 ChatGPT에 확대 적용한다고 발표했다. 신기능인 ‘Intelligent UI’는 ChatGPT가 텍스트 대신 그래픽, 차트, 버튼, 양식 같은 인터랙티브 요소를 조합해 답을 구성하는 기능으로, 지도에 표시되는 여행 경로, 복잡한 개념을 풀어주는 인터랙티브 설명, 은퇴자금 계산기, 더치페이 계산기, 간단한 게임 등이 예시로 제시됐다. Plus·Pro·Business·Enterprise 사용자에게는 'GPT-6 Sol' 모델 기반으로 즉시 적용되고, Free·Go 사용자에게는 'GPT-6 Luna' 모델 기반으로 다음날부터 순차 적용된다. 기사 보기
  • ChatGPT for Teens, 대학 지원 플래너 추가 (College Planner Added to ChatGPT for Teens) — OpenAI가 18세 미만 기본 경험인 ChatGPT for Teens에 ‘College Planner’를 추가했다. 여러 대학에 지원하는 학생이 지원요건, 마감일, 할일, 학자금 지원 절차를 한곳에서 관리하고 타임라인으로 진행 상황을 추적할 수 있다. 미국 10~12학년 중 4년제 대학 지원을 희망하는 고교생을 우선 대상으로 하며, 추후 다른 국가와 2년제·기술대학 지원으로 범위를 넓힐 계획이다. 플래시카드, 인터랙티브 퀴즈, 노트 업로드 같은 학습 도구도 함께 추가됐는데, 이미 미국에서 수십만 명의 teen 사용자가 매주 대학 지원 계획에 ChatGPT를 활용하고 있다고 OpenAI는 밝혔다. 기사 보기
  • Radisson, ChatGPT 안에서 호텔 탐색 서비스 출시 (Radisson Launches In-ChatGPT Hotel Discovery) — Radisson Hotel Group이 Accenture Song, OpenAI와 협력해 ChatGPT 안에서 작동하는 호텔 탐색 앱 @RadissonHotels를 출시했다. 100개국 1,000개 이상 호텔의 실시간 가용성, 요금, 상세 설명, 인터랙티브 지도를 ChatGPT에서 바로 확인할 수 있고, “암스테르담에서 가족 친화적인 주말 숙소” 같은 자연어 질문으로도 추천을 받을 수 있다. Accenture의 AI Merchant Center 내 MCP 가속기를 활용해 호텔의 콘텐츠·재고·요금·예약 신호를 AI가 찾기 쉬운 형태로 구조화했으며, 초기 결과 이 채널의 예약 전환율이 Radisson 자체 오가닉 검색 대비 약 1.5배 높게 나타났다. 기사 보기

구글, 프롬프트만으로 게임을 만드는 'Playground' 출시

  • Google Playground, 노코드 게임 제작 플랫폼 공개 (Google's Experimental Gaming Platform 'Playground') — 구글이 코딩 지식 없이 텍스트 프롬프트만으로 커스텀 게임을 만들고 플레이·공유할 수 있는 실험적 플랫폼 Playground를 공개했다. 게임 아이디어를 프롬프트로 설명하면 물리엔진, 규칙, 캐릭터, 환경을 자유롭게 조정할 수 있고, 브라우저 기반이라 폰이나 노트북에서 바로 즐길 수 있다. 친구에게 공유 링크로 도전장을 보내거나 Playground 갤러리에 공개로 게시할 수 있으며, 게임 내 순위표와 멀티플레이도 지원한다. Play Games 프로필로 핸들을 만들어 게임을 즐겨찾기하거나 창작자를 팔로우하는 기능도 있다. 2026년 10월 7일 미국에서 18세 이상을 대상으로 공식 출시됐으며 playground.google에서 이용 가능하고, 앞으로 Unity Spark와 통합해 전문가 수준의 3D 게임 제작 기능도 추가할 계획이다. 기사 보기

오늘의 한 줄 인사이트

이번 주 흐름을 한 줄로 요약하면, 모델 벤치마크 점수 경쟁은 미·중 간 격차가 3%까지 좁혀지며 변별력을 잃어가는 반면, 승부처는 “모델을 어떤 실행 환경(하네스)과 어떤 업무 화면(Workspace, Intelligent UI, 여행·교육 서비스)에 꽂아 넣느냐”로 완전히 옮겨가고 있다는 점이다. 동시에 아르텍스 사례처럼 그 실행 능력이 공격 도구로도 똑같이 활용될 수 있다는 경고도 함께 던져졌다.

댓글 0

아직 댓글이 없습니다.