2026.09.10 (목)

  • 흐림동두천 16.7℃
  • 흐림강릉 17.0℃
  • 흐림서울 18.1℃
  • 흐림대전 20.0℃
  • 구름많음대구 19.6℃
  • 구름많음울산 21.8℃
  • 구름많음광주 22.2℃
  • 맑음부산 23.8℃
  • 구름많음고창 20.4℃
  • 구름많음제주 24.2℃
  • 흐림강화 16.8℃
  • 구름많음보은 16.7℃
  • 흐림금산 19.0℃
  • 맑음강진군 22.3℃
  • 구름많음경주시 21.5℃
  • 구름많음거제 21.4℃
기상청 제공

빅테크

[빅테크칼럼] “성능은 올리고 단가는 내렸다”…앤트로픽, ‘클로드 페이블 5.1’ 공개로 AI 에이전트 가격전쟁 점화

 

[뉴스스페이스=김정영 기자] 앤트로픽이 공개한 ‘클로드 페이블(Fable) 5.1’과 ‘클로드 미토스(Mythos) 5.1’의 핵심은 새 모델 2종의 경쟁이 아니라, 동일한 기반 모델을 접근 권한과 안전장치 수준에 따라 분리한 상용화 전략이다.

 

일반 이용자와 기업은 페이블 5.1을 쓰고, 사이버보안·생명과학처럼 이중용도 위험이 큰 영역의 검증된 기관은 완화된 안전장치를 적용한 미토스 5.1에 접근하는 구조다. 앤트로픽은 캐시 재사용 단가를 75% 낮추면서 일반 작업의 비용을 약 25%, 장시간 자율작업형 AI 에이전트 업무의 비용을 최대 약 45% 낮출 수 있다고 제시했다.

 

‘두 모델’ 아닌 하나의 엔진


앤트로픽은 9월 1일(현지시간) ‘클로드 페이블 5.1’과 ‘클로드 미토스 5.1’을 발표했다. 다만 회사의 공식 설명에 따르면 두 제품은 모델 성능 자체가 다른 별도 계열이 아니라 같은 모델에 서로 다른 안전 통제 체계를 적용한 버전이다.

 

페이블 5.1은 일반 공개형이다. 코딩, 문서작성, 자료조사, 스프레드시트 분석, 프레젠테이션 제작 등 지식노동 전반에 투입할 수 있으며, 클로드 API와 앤트로픽의 서비스, 아마존웹서비스(AWS), 구글 클라우드, 마이크로소프트 애저에서 이용할 수 있다. API 모델 식별자는 claude-fable-5-1이다.

 

반면 미토스 5.1은 사이버보안과 생명과학 분야의 전문 연구·방어 업무를 겨냥한 제한 접근형이다. 일반 이용자가 챗봇에서 자유롭게 선택하는 제품이 아니라, 앤트로픽의 사이버 검증 프로그램(CVP)과 생명과학 검증 프로그램(LSVP) 등 신뢰 접근 프로그램을 통해 검증된 사용자와 기관에 제공된다. 앤트로픽은 현 시점에서 미토스 5.1의 접근 대상을 미국 내 일부 조직으로 제한하고, 미국 정부와 협력해 국내외 대상 확대를 추진하고 있다고 밝혔다.

 

즉, “글쓰기용 페이블, 추론용 미토스”라는 구분은 정확하지 않다. 기능적 지능의 등급 차이라기보다, 보안 취약점 탐색과 생명과학 연구처럼 오·남용 위험도 높은 작업을 어디까지 허용할 것인가의 차이에 가깝다. 앤트로픽도 미토스 5.1을 “페이블 5.1과 동일한 모델이지만, 검증된 이용자에게 더 허용적인 안전장치를 제공하는 버전”이라고 규정했다.

 

숫자로 본 성능 향상


앤트로픽이 공개한 자체 벤치마크 결과는 특히 장기 실행형 코딩, 과학 조사, 복합 업무 자동화에서 전작 대비 큰 개선 폭을 제시한다.

 

가장 눈에 띄는 지표는 과학 조사형 에이전트 성능이다. 앤트로픽은 페이블 5.1이 Terminal-Bench-Science 0.1에서 52.6%를 기록해 전작 페이블 5의 24.7%보다 27.9%포인트 높았다고 발표했다. 단순 비율로 계산하면 점수가 약 2.1배 수준으로 상승한 셈이다. 다만 이 벤치마크는 표준오차 범위가 ±3.5~4.5%포인트여서, 미세한 모델 간 우열보다는 전작 대비 큰 폭의 변화 여부에 주목하는 편이 타당하다.

 

개발자와 기업 사용자에게 실질적인 의미가 큰 지표는 업무 자동화다. AutomationBench 점수는 17.1%에서 31.4%로 상승했다. 여전히 모든 복합 업무를 안정적으로 완전 자동화할 수준이라고 단정하기에는 낮은 성공률이지만, AI가 단발성 답변 도구를 넘어 여러 단계의 업무를 수행하고 검증하는 ‘에이전트’로 이동하고 있음을 보여주는 수치다.

 

앤트로픽은 고객사 평가 사례도 공개했다. 투자회사 Millennium은 수년간 원인을 찾지 못한 약 100만 회 실행당 한 번꼴의 희귀 시스템 충돌을 페이블 5.1이 외부 벤더 라이브러리 분석과 코어덤프 대조를 통해 원인 규명했다고 주장했다. 그러나 이는 해당 기업이 제공한 사례 평가이며, 모든 환경에서 재현 가능한 객관적 성능 수치로 일반화하기는 어렵다.

 

진짜 승부처는 ‘입력 토큰’이 아니라 캐시


이번 출시에서 기업 고객이 더 민감하게 볼 대목은 모델의 기본 가격 인하가 아니라 반복 작업 비용을 낮추는 캐시 읽기(cache read) 가격이다. 캐시는 이미 처리한 긴 문서, 코드베이스, 사내 규정, 대화 맥락 등을 다시 사용할 때 모델이 이를 재처리하지 않고 참조하도록 하는 방식이다. 대규모 문서나 코드 컨텍스트를 반복적으로 불러오는 AI 에이전트일수록 비용 절감 효과가 커질 수 있다.

 

기존 캐시 읽기 가격이 100만 토큰당 1달러였다면, 새 가격은 0.25달러다. 입력·출력 토큰 가격은 각각 100만 토큰당 10달러와 50달러로 유지된다. 따라서 짧은 질의응답을 가끔 하는 일반 이용자가 체감할 직접적 가격 인하 폭은 제한적일 수 있다. 반대로 사내 데이터베이스, 대형 코드 저장소, 장문 보고서와 규정집을 지속적으로 참조하는 기업용 AI 에이전트는 캐시 비중이 높아 비용 절감 폭이 커질 가능성이 있다.

 

예컨대 100만 토큰의 사전 처리된 문서를 100회 재활용하는 작업을 가정하면, 캐시 읽기 비용만 단순 계산으로 기존 100달러에서 25달러로 감소한다. 다만 실제 총비용은 새 입력, 새 출력, 캐시 쓰기, 도구 호출량, 작업 방식에 따라 달라지므로 이것은 캐시 단가 변화만 보여주는 예시다. 앤트로픽이 말한 ‘일반 업무 약 25%, 고도 에이전트 업무 최대 약 45%’ 절감은 회사 추정치이지 모든 고객에게 보장되는 할인율은 아니다.

 

이 변화는 생성형 AI 경쟁의 초점이 모델 이름과 추론 점수뿐 아니라, 기업이 실제로 부담하는 작업당 비용(cost per task) 으로 옮겨가고 있음을 시사한다. 대형언어모델은 긴 문맥을 반복 참조할수록 비용 부담이 커진다. 앤트로픽은 이 구간의 단가를 낮춤으로써 코드 리뷰, 보안 점검, 고객 응대 분석, 계약서 검토, 리서치 자동화 등 장시간·반복형 업무를 겨냥했다.

 

안전은 ‘차단’에서 ‘선별 허용’으로


이번 발표의 또 다른 축은 안전정책의 정밀화다. 앤트로픽은 페이블 5.1에서 방어 목적의 소프트웨어 취약점 탐색을 허용하되, 익스플로잇 개발 등 공격적 활용 가능성이 높은 요청은 제한한다고 설명했다. 그 결과 사이버보안 안전장치가 무해한 요청을 잘못 차단하는 ‘오탐(false positive)’이 이전보다 약 60% 줄었다고 밝혔다.

 

생물학·의학 관련 무해한 기초 질문에 대해서는 안전장치가 발동하는 빈도가 기존 페이블 5 출시 당시보다 85% 낮아졌다고도 발표했다. 다만 연구개발 수준의 생명과학 요청은 여전히 더 엄격한 통제를 받으며, 미토스 5.1의 접근 프로그램을 통해 전문 연구자에게 제한적으로 제공한다는 방침이다.

 

기업 데이터 보호 장치도 전면에 내세웠다. 앤트로픽은 ‘엔터프라이즈 프런티어 세이프가드(EFS)’를 통해 고객 데이터가 앤트로픽 인프라가 아니라 고객이 통제하는 클라우드 환경에 저장되도록 하고, 오·남용 감지와 대응은 유지하면서도 사실상 ‘제로 데이터 보존’ 수준의 프라이버시를 제공하겠다고 밝혔다. 회사는 금융, 의료, 제조, 통신, 법률, 유통, 공공 부문 등 100곳 이상의 고객 및 AWS·구글 클라우드·마이크로소프트 애저와 공동 개발했다고 설명했다. EFS는 단계적으로 도입될 예정이며, 전면적 일반 제공 시점은 발표문상 확정되지 않았다.

 

유럽연합(EU) AI법 대응도 눈여겨볼 부분이다. 앤트로픽은 2026년 8월 2일 이후 출시한 모델 출력물에 AI 생성 개입 가능성을 판단할 수 있는 보이지 않는 워터마크를 적용했다고 밝혔다. 워터마크 탐지 API는 현재 규제기관, 법집행기관, 언론사, 팩트체커, 연구기관, 교육기관, EU 시민사회단체 등 적격 조직을 대상으로 비공개 시험 제공 단계다. 회사는 해당 워터마크가 사용자·기업·대화 내용에 관한 정보를 담지 않는다고 설명했다.

 

결국 앤트로픽의 신모델은 ‘누가 더 높은 벤치마크 점수를 받느냐’의 경쟁을 넘어, 고성능 AI를 장시간 업무에 투입할 때의 단가와 안전한 배포 구조를 동시에 겨냥한 카드다. 소비자에게는 더 복잡한 작업을 처리하는 AI 비서가 가까워지는 변화이고, 기업에는 AI 전환의 판단 기준이 모델 지능에서 보안·데이터 통제·업무당 비용으로 확장되고 있다는 신호다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


“가동 전 풀케파” 테일러의 역전승?…삼성전자 2나노, 수주와 수율이 맞물리기 시작했다

[뉴스스페이스=김희선 기자] 삼성전자 미국 텍사스주 테일러 파운드리 1공장이 시험 가동을 앞두고 2나노미터(㎚) 예정 생산물량을 사실상 채웠다는 업계 보도가 나왔다. 삼성전자가 고객별 수주, 공장별 생산능력 배정, 수율을 공식적으로 확인한 것은 아니지만, 선단공정 수주 확대와 미국 현지 공급망 수요가 맞물리며 삼성 파운드리의 회복 기대를 키우는 신호로 해석된다. 문화일보는 8일 업계 취재를 인용해 테일러 팹이 이르면 9월 말 시범 가동에 돌입하며, 테슬라의 AI5 칩, 브로드컴의 차세대 통신용 반도체, Arm의 AI 칩 관련 수요가 이어져 2나노 생산예정 물량이 ‘풀케파’ 수준에 도달했다고 보도했다. 시장조사업체 트렌드포스도 같은 내용을 인용 보도했다. 다만 삼성전자는 테일러 공장에 배정된 고객과 제품, 계약 물량을 공식 발표하지 않았다. 테일러 1공장은 2027년 고객사 대상 양산을 목표로 준비 중이다. 월 웨이퍼 투입능력 5만 장, 9월 말~10월 초 시험 가동 등의 수치와 일정은 업계 보도에 기반한 전망치로, 실제 상업 생산 시점과 생산성은 고객 인증 및 수율 안정화 과정에서 달라질 수 있다. 테일러 공장은 삼성전자가 2022년부터 총 370억 달러를

[빅테크칼럼] 이재명·마크롱, AI·방산·원전으로 넓어진 韓佛 동맹…삼성은 왜 미스트랄에 30억유로를 베팅했나

[뉴스스페이스=김정영 기자] 삼성전자가 프랑스 생성형 인공지능(AI) 기업 미스트랄 AI의 30억유로 규모 시리즈D 투자 라운드를 주도하며 전략적 투자자로 참여했다. 단순한 재무투자를 넘어 반도체 설계·공정·제조 노하우를 외부 유출 위험에서 보호할 수 있는 ‘삼성 전용’ AI 모델을 공동 개발한다는 점에서, 이번 거래는 글로벌 AI 경쟁이 범용 챗봇 경쟁에서 산업 데이터와 제조 지식을 둘러싼 AI 주권 경쟁으로 옮겨가고 있음을 보여준다. 이재명 대통령과 에마뉘엘 마크롱 프랑스 대통령이 8일(현지시간) 파리 엘리제궁 정상회담을 계기로 인공지능(AI), 반도체, 양자기술, 방산, 우주, 원자력 등 전략산업 전반을 아우르는 16건의 협력 문서를 채택했다. 두 정상 참석 아래 교환된 문서는 9건이며, 정부·기관·기업 차원에서 별도로 체결된 문서까지 합쳐 총 16건으로 집계됐다. 이번 정상외교의 최대 경제·산업 성과는 삼성전자와 프랑스 AI 스타트업 미스트랄 AI 간 전략적 투자 협약이다. 삼성전자는 미스트랄의 전략적 투자자로 참여하는 동시에, 자사의 핵심 반도체 기술과 제조 노하우를 보호할 수 있는 삼성전자 전용 내부 AI 모델 개발에 협력하기로 했다. 청와대와 연