2026.07.21 (화)

  • 구름많음동두천 25.0℃
  • 구름많음강릉 26.9℃
  • 흐림서울 25.3℃
  • 구름많음대전 29.1℃
  • 맑음대구 33.7℃
  • 맑음울산 30.7℃
  • 구름많음광주 30.4℃
  • 맑음부산 28.9℃
  • 맑음고창 30.3℃
  • 구름많음제주 30.0℃
  • 구름많음강화 24.0℃
  • 구름많음보은 28.1℃
  • 구름많음금산 29.4℃
  • 맑음강진군 29.8℃
  • 맑음경주시 32.4℃
  • 맑음거제 27.6℃
기상청 제공

빅테크

[빅테크칼럼] 중국 AI 스타트업 문샷AI, 1조 파라미터 오픈소스 모델 ‘Kimi K2 Thinking’ 출시…GPT-5 능가하며 AI시장 흔들다

 

[뉴스스페이스=이종화 기자] 중국 AI 스타트업 문샷(Moonshot) AI가 1조개의 매개변수를 가진 최신 오픈소스 대형 언어모델 ‘Kimi K2 Thinking’을 공개하며, 오픈AI의 GPT-5를 비롯한 서구의 최첨단 독점 AI 모델들을 성능 면에서 뛰어넘었다고 공식 발표했다.

 

CNBC, VentureBeat, Cybernews에 따르면, Kimi K2 Thinking은 합리적 추론, 웹 기반 에이전트 임무, 코딩 등 다양한 벤치마크에서 높은 점수를 기록하며 AI 능력의 새로운 기준을 제시했다.

 

특히, 2500개 전문가 검증 문제로 구성된 Humanity’s Last Exam(HLE)에서 K2 Thinking은 44.9%의 점수를 획득해 GPT-5(41.7%)를 웃돌았고, 실제 웹 탐색과 정보 연산 능력을 측정하는 BrowseComp에서는 60.2%를 기록하며 GPT-5(54.9%) 대비 우위를 점했다.

 

소프트웨어 개발 능력을 평가하는 SWE-Bench Verified에서도 71.3%를 나타내 AI 활용의 핵심 영역에서 모두 탁월한 성능을 보여줬다. 특히, 200~300단계 연속 도구 호출과 자율적인 문제 해결 능력도 입증되어 복잡한 에이전트형 작업에서 인간의 개입 없이도 높은 완성도를 자랑한다.​

 

비용 측면에서도 Kimi K2 Thinking은 강력한 경쟁력을 보인다. 모델을 운용하는 API 가격은 100만 토큰당 출력 기준 $2.50로, GPT-5의 $10과 비교 시 4배 저렴하며, 입력 토큰 비용 역시 크게 낮은 편이다. 훈련 비용은 CNBC가 인용한 바에 따르면 약 460만 달러로, 수십억 달러를 투입하는 미 AI 대형 연구소 대비 극히 저렴한 셈이다. 저비용 고효율 구조는 INT4 양자화 기술과 MoE(전문가 혼합) 아키텍처를 도입해 가능해졌다.​

 

Moonshot AI는 해당 모델을 수정된 MIT 라이선스로 공개해 개발자 누구나 상업적 이용 및 파생 개발을 자유롭게 할 수 있도록 했으나, 월간 활성 사용자 100만명 이상이거나 월매출 2000만 달러를 초과하는 서비스에서는 ‘Kimi K2’ 브랜드 표기를 의무화했다. 이 접근법은 AI 생태계의 개방성과 브랜드 가시성을 동시에 확보하는 전략으로 보인다. 모델은 플랫폼 플랫폼.moonshot.ai 및 kimi.com을 통해 접근 가능하다.​

 

한편, 이번 발표는 엔비디아 CEO 젠슨 황이 최근 “중국이 AI 기술에서 미국과 나노초 간극을 보이고 있다”며 미국 내 개발 가속화를 촉구한 시점과 맞물려 의미심장하다. 중국의 AI 스타트업들, 특히 알리바바와 텐센트가 대규모 투자한 Moonshot AI는 지난해 25억 달러 기업가치를 인정받았으며, 올해 추가 3억 달러 이상을 유치하며 공격적인 성장세를 이어가고 있다. 이처럼 중국은 자국 내 AI 경쟁력 확보를 위한 대규모 자본 투입과 개방형 모델 출시에 박차를 가하는 중이다.​

 

글로벌 AI 시장에 미칠 영향은 크다. 오픈소스 모델이 독점적 AI를 성능과 운영비용에서 위협하며, 기업 고객과 개발자 커뮤니티에 새로운 대안이 나타난 것이다. 이미 에어비앤비 등 혁신 기업들이 알리바바 Qwen 모델을 고객 서비스에 적극 도입하며 비용 효율과 속도를 경험하는 등, 중국산 AI 기술의 국제적 위상에도 변화를 예고한다.​

 

전문가들은 "Moonshot AI의 Kimi K2 Thinking은 단순한 기술 시연을 넘어 중국의 AI 기술 독립과 글로벌 대등 경쟁을 상징한다"며 "앞으로 AI 경쟁 구도가 더욱 다원화될 가능성을 보여준다"고 평가한다. 다만 미래 검증과 시장 수용성은 여전히 지켜봐야 하는 변동 요소다.

배너
배너
배너

관련기사

60건의 관련기사 더보기


[이슈&논란] 미국, 삼성전자·SK하이닉스에 반도체 이익 배분 요구…"초과이익 나눠 갖자" 너도나도 숟가락 얹기

[뉴스스페이스=김정영 기자] 미국 정부가 삼성전자와 SK하이닉스를 향해 반도체 '초과이익'의 일부를 미국 측에 배분하라는 새로운 요구를 제기한 것으로 확인됐다. 코리아타임스는 18일(현지시간 기준) 업계 소식통을 인용해, 릭 스위처 미국 무역대표부(USTR) 부대표가 지난달 여한구 통상교섭본부장과의 회의에서 이같은 입장을 전달했다고 보도했다. 한국 정부의 한 고위 관계자도 미국 측이 실제로 이러한 주장을 했다고 별도로 확인했다. 논리의 뼈대는 2023년 초과이익 공유제 미국 측의 논거는 "미국 기업들이 한국산 반도체를 대량 구매함으로써 한국 기업의 수익 창출에 기여했으므로, 한국 하청업체가 수익 일부를 받는다면 미국 파트너도 마찬가지 자격이 있다"는 것이다. 이는 2023년 조 바이든 행정부가 반도체과학법(CHIPS Act) 보조금 지급 조건으로 도입한 '초과이익 공유제'와 궤를 같이한다. 당시 미 상무부는 1억5000만 달러 이상 보조금을 받는 기업이 예상보다 많은 수익을 낼 경우, 지원금의 최대 75%까지 미 정부와 나누도록 규정했다. 이번 요구는 보조금 수급 여부와 무관하게 '구매자'라는 지위만으로 이익 배분을 주장하는 것이어서, 과거보다 한층 확장된

[빅테크칼럼] "STEM 아는 자가 AI 10배 더 잘 쓴다"… 딥마인드 하사비스, 전 세계 학생들에게 던진 '경고장'

[뉴스스페이스=이종화 기자] 구글 딥마인드 CEO 데미스 하사비스(Demis Hassabis)가 AI 시대에도 STEM(과학·기술·공학·수학) 교육의 가치가 오히려 커지고 있다고 재차 강조하면서, 그의 발언이 전 세계 교육·산업계에 파장을 일으키고 있다. "10배 효과" 발언의 맥락 7월 14일(현지시간) 공개된 런던 비즈니스 콘퍼런스 인터뷰 영상에서 하사비스는 "깊은 기술적 이해를 갖춘 사람들은 그렇지 않은 사람들보다 AI 도구를 10배 더 효과적으로 활용할 수 있을 것"이라고 밝혔다. 그는 프로그래밍의 역사를 "기계어→C언어→파이썬으로 이어지는 진화 과정"으로 설명하며, "미래의 프로그래밍 언어는 영어 자체가 될 수도 있지만 아키텍처 설계와 소프트웨어 엔지니어링 모범 사례에 대한 이해는 여전히 필수"라고 못박았다. 이 같은 발언은 처음이 아니다. 하사비스는 지난해 6월 SXSW 런던 행사에서도 "지금 학생이라면 수학, 물리, 컴퓨터 과학 같은 STEM 과목을 공부하겠다"고 밝힌 바 있으며, 지난 9월 와이어드(Wired)와의 인터뷰에서는 "이런 도구에 네이티브한 사람들은 10배 더 생산적일 수 있다"고 언급하며 같은 논리를 반복해왔다. 특히 지난 4월 2

[빅테크칼럼] "질문언어에 따라 대답·성격 달랐다" 힌디어·아랍어 '공손·위로', 영어·러시아 '깐깐·엄밀', 한국어 '솔직·간결'…앤트로픽, AI 가치관의 언어편차 '실증'

[뉴스스페이스=이종화 기자] 앤트로픽(Anthropic)이 7월 13일(현지시간) 자사 챗봇 '클로드'가 사용 모델과 대화 언어에 따라 서로 다른 가치관을 드러낸다는 연구 결과를 공개했다. 전 세계 수백만 명이 이용하는 AI 시스템의 일관성과 편향성 문제를 정면으로 겨냥한 첫 대규모 실증 연구다. 31만 건 대화 해부한 4개 가치 축 앤트로픽 공식자료와 인디아투데이 보도에 따르면, 앤트로픽 사회적 영향(Societal Impacts) 팀은 2026년 5월 2주간 클로드.ai에서 수집된 실제 익명 대화 30만9,815건을 분석했다. 대상은 소넷 4.6, 오퍼스 4.6, 오퍼스 4.7 등 3개 모델과 한국어를 포함한 사용량 상위 20개 언어였으며, 기존에 파악된 3,000개 이상의 가치를 ▲수용성-신중함 ▲따뜻함-엄밀함 ▲깊이-간결함 ▲솔직함-실행력이라는 4개 해석 가능한 축으로 압축했다. 다만 이 4개 축이 실제 대화에서 나타난 가치 표현 차이를 설명하는 비율은 약 15%에 그쳐, 여전히 상당 부분이 미해명 상태로 남아 있다는 점은 눈여겨볼 대목이다. 힌디어·아랍어는 "위로형", 영어·러시아어는 "따박따박형" 가장 큰 변동폭을 보인 축은 '따뜻함 대 엄밀함'이