2026.07.20 (월)

  • 흐림동두천 24.2℃
  • 구름많음강릉 25.2℃
  • 구름많음서울 24.4℃
  • 구름많음대전 28.3℃
  • 맑음대구 31.2℃
  • 맑음울산 29.7℃
  • 맑음광주 29.9℃
  • 맑음부산 28.1℃
  • 맑음고창 29.3℃
  • 맑음제주 30.5℃
  • 흐림강화 23.3℃
  • 구름많음보은 25.7℃
  • 맑음금산 30.4℃
  • 맑음강진군 29.1℃
  • 맑음경주시 25.7℃
  • 맑음거제 27.2℃
기상청 제공

빅테크

AI가 푸는 판도라의 상자?…오픈AI 챗GPT 에이전트, 세계 최초 '고위험 생물무기' 경고와 함께 등장

 

[뉴스스페이스=김정영 기자] 오픈AI가 2025년 7월 '챗GPT Agent'를 전 세계에 공개하며 유례없는 수준의 생물학·화학적 위험 가능성을 공식 경고했다.

 

이 제품은 오픈AI가 자사 모델 중 처음으로 '높은(bio-high)' 위험 등급을 매긴 인공지능으로, 실제로 '초보' 수준의 사용자가 알려진 생화학 무기를 모방·제작하는 데 의미 있는 도움을 줄 수 있다는 점이 공식화됐다.

 

오픈AI CEO 샘 올트먼은 "(챗GPT Agent는) 여전히 실험적 기술이며, 악의적 행위자가 AI를 속여 사적인 정보를 유출하게 하거나 예측하기 어려운 형태로 해를 끼칠 위험이 있다"고 경고했다. 실제로 챗GPT Agent는 사용자의 가상 컴퓨터를 제어해 파일 탐색, 데이터 분석, 프레젠테이션 생성, 심지어 웹 브라우저와 애플리케이션을 능동적으로 조작할 수 있는, 기존 챗봇과는 차원이 다른 '에이전트형 AI'다.

 

기존 모델 넘는 '생물무기 위험', 첫 공식 고위험 등급 지정

 

오픈AI가 마련한 'Preparedness Framework(대비 프레임워크)'에 의해, 이번 챗GPT Agent는 그 위험성을 근거로 최대 수준의 보안 장치를 적용받았다. 실제로 올해 발표된 국제 AI 안전보고서에 따르면, 최신 LLM(대형언어모델)의 생물학 및 화학 무기 조작성 응답 능력이 1년 만에 80% 가까이 상승한 것으로 평가됐다.

 

오픈AI 내부 및 외부 전문가 평가는 이 모델이 "기존 인터넷 검색만으로는 접근이 어려운 핵심정보를 제공해 줄 수 있다"고 결론냈다.

 

SecureBio AI 그룹 실험에서 챗GPT Agent는 'World-Class Biology' 평가에서 기존 모델(o3)의 정답률(1.5/10)보다 두 배 넘는 4/10을 기록했다. 병원체 획득 시나리오 평가에서도 기존 AI가 흔히 범하는 오류를 챗GPT Agent가 우회하는 데 성공했다는 사실이 공개됐다.

 

오픈AI의 내부 적색팀은 110개의 공격 시도(프롬프트 인젝션, 생물 정보 추출 등) 중 16개가 내부 위험 기준치를 넘었다고 밝혔으며, Agent 전용 95% 대응 방어 체계를 도입했다.

 

"AI로 초보자도 생물무기 설계 곧 가능"…국가·사회적 대응 시급


기존 생물무기의 현실적 위협을 높였던 것은 문턱 높은 전문지식, 실험실 접근, 실질적 합성기술 부족 등이었다. 그러나 전문가들은 "AI 기반 도구가 생물학 연구의 '설계-테스트-수정' 루프를 수 시간 만에 재현해, 초보자도 그 간극을 좁힐 수 있게 만든다"고 경고한다.

 

오픈AI는 "아직 완전히 새로운 생화학 위협을 만들어내는 단계는 아니다"라고 강조했지만, '노비스 업리프트(Novice Uplift, 비전문가로 하여금 실질적 위해를 실현하도록 돕는 AI의 능력)'이 곧 현실화될 것으로 보인다.

 

국제기구 보고서는 AI 기반 바이오테러 공격 실행 지침 정확도가 2024년 한 해 동안 80% 가까이 향상됐다고 밝히며, 이 위험성을 특히 강조했다.

 

오픈AI는 전 세계 4억명 이상이 주간 단위로 챗GPT에 접속하고, 300만명 이상의 개발자가 API를 활용 중이라고 설명했다. 이처럼 대규모 배포 환경은 위험 시나리오의 현실화 확률도 높인다.

 

강화된 안전장치, 실제 효과는?


오픈AI는 초고위험 지정과 함께 다음과 같은 다층 보안책을 도입했다. 우선 생화학무기, 은행사기 등 위험성 프롬프트에 대해 학습 기반 즉시 거부 시스템인 거부 훈련(Refusal Training)을 적용했다. 둘째는 Agent가 수행하는 행동의 실시간 감시와 이상 징후 즉각 차단위한 상시 모니터링체제의 도입이다.

 

셋째는 실시간 사용자 승인, 메일 전송·은행 업무 등은 반드시 추가 확인하는 등 고위험 태스크의 경우 이중 확인을 일반화했다. 넷째는 생물안보 전문가·정부기관과 상시 고위험 시나리오를 점검하고, 외부 적색팀과 항시 테스트가 가능한 협력체계도 구축했다.

 

그러나 국제 보안 전문가들은 "오픈AI 등 일부 기업은 사회적 책임감을 가지고 (정보 제공) 차단책을 강화하고 있지만, 일부 신생 AI 업체는 아직도 VX·타분(TABUN) 등 치명적 물질 합성법을 AI가 직접 안내하는 사례가 있다"고 경고했다.

 

AI의 진화와 위험, 이제는 실질적인 대응이 필요하다


AI 사회 진입이 본격화되는 2025년, '인공지능판 판도라의 상자'가 실제 열리고 있다. 오픈AI는 이번 챗GPT Agent 출시와 함께 전례 없는 주의 경보를 발령했으나, model로서의 파급효과가 글로벌 모든 AI산업으로 빠르게 전이되고 있음을 널리 알렸다.

 

현실적으로 '노비스 업리프트' 현상, 즉 초보자의 고위험 악성 행위 실현력을 높여주는 AI의 시대가 임박하면서, 국가 및 산업계, 연구기관의 실질적 공조와 투명한 리스크 공개, 국제규범 제정이 시급함을 더욱 절감케 한다.

 

AI‧보안 전문가들은 "임계점이 도래한 AI 위험성 앞에, 결국 인류의 집단적 대응과 바이오안보 거버넌스가 절실하다"고 경고했다.

배너
배너
배너

관련기사

93건의 관련기사 더보기


[이슈&논란] 미국, 삼성전자·SK하이닉스에 반도체 이익 배분 요구…"초과이익 나눠 갖자" 너도나도 숟가락 얹기

[뉴스스페이스=김정영 기자] 미국 정부가 삼성전자와 SK하이닉스를 향해 반도체 '초과이익'의 일부를 미국 측에 배분하라는 새로운 요구를 제기한 것으로 확인됐다. 코리아타임스는 18일(현지시간 기준) 업계 소식통을 인용해, 릭 스위처 미국 무역대표부(USTR) 부대표가 지난달 여한구 통상교섭본부장과의 회의에서 이같은 입장을 전달했다고 보도했다. 한국 정부의 한 고위 관계자도 미국 측이 실제로 이러한 주장을 했다고 별도로 확인했다. 논리의 뼈대는 2023년 초과이익 공유제 미국 측의 논거는 "미국 기업들이 한국산 반도체를 대량 구매함으로써 한국 기업의 수익 창출에 기여했으므로, 한국 하청업체가 수익 일부를 받는다면 미국 파트너도 마찬가지 자격이 있다"는 것이다. 이는 2023년 조 바이든 행정부가 반도체과학법(CHIPS Act) 보조금 지급 조건으로 도입한 '초과이익 공유제'와 궤를 같이한다. 당시 미 상무부는 1억5000만 달러 이상 보조금을 받는 기업이 예상보다 많은 수익을 낼 경우, 지원금의 최대 75%까지 미 정부와 나누도록 규정했다. 이번 요구는 보조금 수급 여부와 무관하게 '구매자'라는 지위만으로 이익 배분을 주장하는 것이어서, 과거보다 한층 확장된

[빅테크칼럼] "STEM 아는 자가 AI 10배 더 잘 쓴다"… 딥마인드 하사비스, 전 세계 학생들에게 던진 '경고장'

[뉴스스페이스=이종화 기자] 구글 딥마인드 CEO 데미스 하사비스(Demis Hassabis)가 AI 시대에도 STEM(과학·기술·공학·수학) 교육의 가치가 오히려 커지고 있다고 재차 강조하면서, 그의 발언이 전 세계 교육·산업계에 파장을 일으키고 있다. "10배 효과" 발언의 맥락 7월 14일(현지시간) 공개된 런던 비즈니스 콘퍼런스 인터뷰 영상에서 하사비스는 "깊은 기술적 이해를 갖춘 사람들은 그렇지 않은 사람들보다 AI 도구를 10배 더 효과적으로 활용할 수 있을 것"이라고 밝혔다. 그는 프로그래밍의 역사를 "기계어→C언어→파이썬으로 이어지는 진화 과정"으로 설명하며, "미래의 프로그래밍 언어는 영어 자체가 될 수도 있지만 아키텍처 설계와 소프트웨어 엔지니어링 모범 사례에 대한 이해는 여전히 필수"라고 못박았다. 이 같은 발언은 처음이 아니다. 하사비스는 지난해 6월 SXSW 런던 행사에서도 "지금 학생이라면 수학, 물리, 컴퓨터 과학 같은 STEM 과목을 공부하겠다"고 밝힌 바 있으며, 지난 9월 와이어드(Wired)와의 인터뷰에서는 "이런 도구에 네이티브한 사람들은 10배 더 생산적일 수 있다"고 언급하며 같은 논리를 반복해왔다. 특히 지난 4월 2

[빅테크칼럼] "질문언어에 따라 대답·성격 달랐다" 힌디어·아랍어 '공손·위로', 영어·러시아 '깐깐·엄밀', 한국어 '솔직·간결'…앤트로픽, AI 가치관의 언어편차 '실증'

[뉴스스페이스=이종화 기자] 앤트로픽(Anthropic)이 7월 13일(현지시간) 자사 챗봇 '클로드'가 사용 모델과 대화 언어에 따라 서로 다른 가치관을 드러낸다는 연구 결과를 공개했다. 전 세계 수백만 명이 이용하는 AI 시스템의 일관성과 편향성 문제를 정면으로 겨냥한 첫 대규모 실증 연구다. 31만 건 대화 해부한 4개 가치 축 앤트로픽 공식자료와 인디아투데이 보도에 따르면, 앤트로픽 사회적 영향(Societal Impacts) 팀은 2026년 5월 2주간 클로드.ai에서 수집된 실제 익명 대화 30만9,815건을 분석했다. 대상은 소넷 4.6, 오퍼스 4.6, 오퍼스 4.7 등 3개 모델과 한국어를 포함한 사용량 상위 20개 언어였으며, 기존에 파악된 3,000개 이상의 가치를 ▲수용성-신중함 ▲따뜻함-엄밀함 ▲깊이-간결함 ▲솔직함-실행력이라는 4개 해석 가능한 축으로 압축했다. 다만 이 4개 축이 실제 대화에서 나타난 가치 표현 차이를 설명하는 비율은 약 15%에 그쳐, 여전히 상당 부분이 미해명 상태로 남아 있다는 점은 눈여겨볼 대목이다. 힌디어·아랍어는 "위로형", 영어·러시아어는 "따박따박형" 가장 큰 변동폭을 보인 축은 '따뜻함 대 엄밀함'이