2026.07.21 (화)

  • 흐림동두천 24.5℃
  • 흐림강릉 23.0℃
  • 서울 25.0℃
  • 구름많음대전 25.4℃
  • 맑음대구 25.5℃
  • 맑음울산 25.7℃
  • 구름많음광주 27.2℃
  • 맑음부산 25.8℃
  • 구름많음고창 27.0℃
  • 맑음제주 27.9℃
  • 흐림강화 25.6℃
  • 구름많음보은 24.0℃
  • 구름많음금산 26.7℃
  • 구름많음강진군 26.0℃
  • 맑음경주시 23.2℃
  • 맑음거제 26.2℃
기상청 제공

빅테크

[빅테크칼럼] 머스크의 'xAI 그록5, AGI 현실화' 선언...인공지능 대전환점 될까

 

[뉴스스페이스=윤슬 기자] 일론 머스크가 자신의 AI 벤처 xAI가 올해 말 출시 예정인 그록5(Grok 5)로 인공일반지능(AGI) 달성 가능성을 언급하면서 AI 업계에 파장이 일고 있다. 현재 그록4가 ARC-AGI 벤치마크에서 기록적 성과를 거두며 경쟁사를 제치고 1위를 차지한 가운데, 머스크의 이번 발언은 AGI 경쟁에서 새로운 전환점을 시사하는 것으로 해석되고 있다.

 

NextTech Today, TESLARATI, India Today, THE-DECODER에 따르면, 일론 머스크는 9월 16일(현지시간) 늦게 자신의 X 계정에 "xAI가 그록5로 AGI에 도달할 가능성이 있다고 생각한다"며 "이전에는 그럴 수 있다고 생각해본 적이 없었다"고 밝혔다.

 

이는 그록4가 ARC-AGI 추론 벤치마크에서 15.9%의 점수로 최고 자리에 오른 직후 나온 발언으로, 오픈AI의 GPT-5(9.9%)와 클로드 4 오푸스(8.6%)를 크게 앞선 성과가 뒷받침됐다.

 

ARC-AGI 벤치마크, AI의 '지능 측정 기준'으로 부상


ARC-AGI(Abstraction and Reasoning Corpus for Artificial General Intelligence)는 AI가 이전에 학습하지 않은 새로운 문제를 해결하는 능력을 측정하는 벤치마크로, 현재 AGI 달성도를 가늠하는 가장 중요한 지표로 인정받고 있다. 이 테스트는 단순히 기억된 정보에 의존하는 것이 아니라 추상적 사고와 일반화 능력을 평가한다는 점에서 진정한 '지능'을 측정하는 도구로 여겨진다.

 

그록4가 ARC-AGI-2에서 15.9%를 기록한 것은 작업당 2-4달러의 비용이 들었지만, GPT-5의 9.9%(작업당 0.73달러)보다 현저히 높은 성과다. 더 쉬운 ARC-AGI-1에서도 그록4는 68%를 기록해 GPT-5의 65.7%를 앞섰다. ARC Prize 재단의 그레고리 캄랏 회장은 "그록4를 사용한 두 건의 최고 제출물이 나왔으며, 작성자들이 '테스트에서 사용한 최고의 모델이었다'고 말했다"고 전했다.

 

20만 GPU 콜로서스 슈퍼컴퓨터, 그록5 훈련 뒷받침

 

xAI는 그록5 훈련을 위해 세계 최대 규모의 AI 슈퍼컴퓨터 '콜로서스(Colossus)'를 운영하고 있다. 테네시주 멤피스에 위치한 이 시설은 현재 10만개의 엔비디아 H100 GPU로 시작해 20만개로 확장됐으며, 향후 100만개까지 늘릴 계획이다. 시스템 구축에는 불과 122일이 소요됐으며, 첫 랙 설치 후 19일 만에 훈련을 시작하는 기록적인 속도를 보였다.

 

콜로서스는 42-56메가와트의 전력을 소비하며, 향후 150메가와트까지 확장될 예정이다. 엔비디아의 스펙트럼-X 이더넷 네트워킹 플랫폼을 활용해 95%의 데이터 처리량을 달성했으며, 애플리케이션 지연이나 패킷 손실 없이 운영되고 있다고 발표됐다.

 

내부 혼란 속 20세 대학생이 핵심팀 리더로


그록5 개발을 앞두고 xAI 내부에는 큰 변화가 일어나고 있다. 회사는 지난주 데이터 주석(annotation) 팀에서 500명 이상을 해고했으며, 이는 전체 1500명 규모 팀의 3분의 1에 해당한다. 해고 과정에서 20세 대학생 디에고 파시니(Diego Pasini)가 그록의 학습 데이터 라벨링을 담당하는 핵심 팀의 새로운 리더로 임명됐다.

 

펜실베이니아 대학 와튼스쿨에 휴학 중인 파시니는 올해 1월 xAI에 입사한 후 8개월 만에 이 중요한 역할을 맡게 됐다. 그는 직원들을 대상으로 STEM, 코딩, 금융, 의학뿐만 아니라 그록의 '성격' 및 '안전성'까지 다루는 다양한 평가를 실시했다. 이러한 인사 변동은 xAI가 일반적인 AI 튜터보다 전문 분야별 특화 AI 튜터 개발에 집중하겠다는 전략 전환의 일환으로 해석된다.

 

테슬라와의 시너지, FSD·로보틱스 혁신 기대


머스크는 xAI와 테슬라 간 잠재적 통합 가능성을 시사해 왔다. 테슬라는 지난 7월 xAI에 50억 달러 투자를 검토한다고 발표했으며, 이는 그록의 고급 추론 능력을 테슬라의 완전자율주행(FSD) 및 로보틱스 프로그램에 통합하기 위한 전략으로 분석된다.

 

테슬라의 FSD v12는 이미 엔드투엔드(end-to-end) 신경망 아키텍처로 전환해 카메라 입력을 직접 운전 제어 명령으로 변환하고 있다. 여기에 그록의 실시간 데이터 처리 및 추론 능력이 결합되면, 복잡한 엣지 케이스 처리에서 획기적 개선이 가능할 것으로 전망된다. 또한 휴머노이드 로봇 옵티머스(Optimus) 개발에도 같은 AI 기술이 활용될 예정이어서 상당한 시너지 효과가 예상된다.

 

AGI 경쟁 가속화, 업계 판도 변화 예고


현재 AGI에 대한 명확한 정의는 없지만, 일반적으로 인간 수준의 인지 능력을 모든 영역에서 발휘할 수 있는 AI 시스템을 의미한다. 머스크의 그록5 AGI 가능성 언급은 오픈AI, 구글, 안트로픽 등 주요 AI 기업들과의 경쟁을 더욱 치열하게 만들 전망이다.

 

특히 오픈AI의 o3 모델이 ARC-AGI-1에서 75.7%의 높은 점수를 기록했지만 작업당 200달러라는 높은 비용이 문제가 되고 있어, xAI의 효율성 중심 접근법이 주목받고 있다. 그록4는 비슷한 성능을 훨씬 낮은 비용으로 달성했으며, 이는 상업적 활용 가능성 측면에서 중요한 의미를 갖는다.

 

올해 말 출시, AI 역사의 분수령 될까


머스크는 그록5 훈련이 "몇 주 후 시작되며 올해 말 출시될 것"이라고 확인했다. 업계 관측통들은 새로운 모델이 멀티모달 입력과 환각(hallucination)을 줄이면서 컨텍스트 윈도우를 확장하는 개선된 '사고' 아키텍처를 도입할 것으로 예상한다고 전했다.

 

만약 그록5가 실제로 AGI에 근접한 성능을 보인다면, 이는 AI 발전사에서 중요한 전환점이 될 가능성이 높다. 다만 전문가들은 AGI 달성 주장에 대해서는 신중한 검증이 필요하다고 지적하고 있으며, 특히 안전성과 윤리적 측면에서의 준비가 선행되어야 한다고 강조하고 있다.

 

현재 투자자와 연구자들은 그록5의 실제 훈련 결과가 머스크의 대담한 예측을 현실로 바꿀 수 있을지 주목하고 있다. 그 결과는 단순히 xAI의 성공을 넘어 인류의 AGI 도달 시점을 가늠하는 중요한 지표가 될 전망이다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[이슈&논란] 미국, 삼성전자·SK하이닉스에 반도체 이익 배분 요구…"초과이익 나눠 갖자" 너도나도 숟가락 얹기

[뉴스스페이스=김정영 기자] 미국 정부가 삼성전자와 SK하이닉스를 향해 반도체 '초과이익'의 일부를 미국 측에 배분하라는 새로운 요구를 제기한 것으로 확인됐다. 코리아타임스는 18일(현지시간 기준) 업계 소식통을 인용해, 릭 스위처 미국 무역대표부(USTR) 부대표가 지난달 여한구 통상교섭본부장과의 회의에서 이같은 입장을 전달했다고 보도했다. 한국 정부의 한 고위 관계자도 미국 측이 실제로 이러한 주장을 했다고 별도로 확인했다. 논리의 뼈대는 2023년 초과이익 공유제 미국 측의 논거는 "미국 기업들이 한국산 반도체를 대량 구매함으로써 한국 기업의 수익 창출에 기여했으므로, 한국 하청업체가 수익 일부를 받는다면 미국 파트너도 마찬가지 자격이 있다"는 것이다. 이는 2023년 조 바이든 행정부가 반도체과학법(CHIPS Act) 보조금 지급 조건으로 도입한 '초과이익 공유제'와 궤를 같이한다. 당시 미 상무부는 1억5000만 달러 이상 보조금을 받는 기업이 예상보다 많은 수익을 낼 경우, 지원금의 최대 75%까지 미 정부와 나누도록 규정했다. 이번 요구는 보조금 수급 여부와 무관하게 '구매자'라는 지위만으로 이익 배분을 주장하는 것이어서, 과거보다 한층 확장된

[빅테크칼럼] "STEM 아는 자가 AI 10배 더 잘 쓴다"… 딥마인드 하사비스, 전 세계 학생들에게 던진 '경고장'

[뉴스스페이스=이종화 기자] 구글 딥마인드 CEO 데미스 하사비스(Demis Hassabis)가 AI 시대에도 STEM(과학·기술·공학·수학) 교육의 가치가 오히려 커지고 있다고 재차 강조하면서, 그의 발언이 전 세계 교육·산업계에 파장을 일으키고 있다. "10배 효과" 발언의 맥락 7월 14일(현지시간) 공개된 런던 비즈니스 콘퍼런스 인터뷰 영상에서 하사비스는 "깊은 기술적 이해를 갖춘 사람들은 그렇지 않은 사람들보다 AI 도구를 10배 더 효과적으로 활용할 수 있을 것"이라고 밝혔다. 그는 프로그래밍의 역사를 "기계어→C언어→파이썬으로 이어지는 진화 과정"으로 설명하며, "미래의 프로그래밍 언어는 영어 자체가 될 수도 있지만 아키텍처 설계와 소프트웨어 엔지니어링 모범 사례에 대한 이해는 여전히 필수"라고 못박았다. 이 같은 발언은 처음이 아니다. 하사비스는 지난해 6월 SXSW 런던 행사에서도 "지금 학생이라면 수학, 물리, 컴퓨터 과학 같은 STEM 과목을 공부하겠다"고 밝힌 바 있으며, 지난 9월 와이어드(Wired)와의 인터뷰에서는 "이런 도구에 네이티브한 사람들은 10배 더 생산적일 수 있다"고 언급하며 같은 논리를 반복해왔다. 특히 지난 4월 2

[빅테크칼럼] "질문언어에 따라 대답·성격 달랐다" 힌디어·아랍어 '공손·위로', 영어·러시아 '깐깐·엄밀', 한국어 '솔직·간결'…앤트로픽, AI 가치관의 언어편차 '실증'

[뉴스스페이스=이종화 기자] 앤트로픽(Anthropic)이 7월 13일(현지시간) 자사 챗봇 '클로드'가 사용 모델과 대화 언어에 따라 서로 다른 가치관을 드러낸다는 연구 결과를 공개했다. 전 세계 수백만 명이 이용하는 AI 시스템의 일관성과 편향성 문제를 정면으로 겨냥한 첫 대규모 실증 연구다. 31만 건 대화 해부한 4개 가치 축 앤트로픽 공식자료와 인디아투데이 보도에 따르면, 앤트로픽 사회적 영향(Societal Impacts) 팀은 2026년 5월 2주간 클로드.ai에서 수집된 실제 익명 대화 30만9,815건을 분석했다. 대상은 소넷 4.6, 오퍼스 4.6, 오퍼스 4.7 등 3개 모델과 한국어를 포함한 사용량 상위 20개 언어였으며, 기존에 파악된 3,000개 이상의 가치를 ▲수용성-신중함 ▲따뜻함-엄밀함 ▲깊이-간결함 ▲솔직함-실행력이라는 4개 해석 가능한 축으로 압축했다. 다만 이 4개 축이 실제 대화에서 나타난 가치 표현 차이를 설명하는 비율은 약 15%에 그쳐, 여전히 상당 부분이 미해명 상태로 남아 있다는 점은 눈여겨볼 대목이다. 힌디어·아랍어는 "위로형", 영어·러시아어는 "따박따박형" 가장 큰 변동폭을 보인 축은 '따뜻함 대 엄밀함'이