KT, 한국적 AI ‘믿:음 2.0’ 오픈소스 공개…대한민국 AI 대중화 나선다

KT가 ‘한국적 AI’의 철학을 담아 자체 개발한 언어모델 ‘믿:음 2.0’의 오픈소스를 AI 개발자 플랫폼 허깅페이스를 통해 공개할 예정이라고 3일 밝혔다. 사진은 KT 기술혁신부문 연구원들이 서초구 KT 우면연구센터에서 믿:음 2.0을 테스트하고 있는 모습 / KT

[뉴스스페이스=조일섭 기자] KT(대표이사 김영섭)가 ‘한국적 AI’의 철학을 담아 자체 개발한 언어모델(LLM) ‘믿:음 2.0’의 오픈소스를 AI 개발자 플랫폼 허깅페이스(HuggingFace)를 통해 공개할 예정이라고 3일 밝혔다. 이 오픈소스는 기업과 개인, 공공 누구나 상업적으로 활용할 수 있도록 제약 없이 개방된다.

‘한국적 AI’는 KT의 AI 철학으로 한국의 정신과 방식, 지식을 기반으로 구현해 한국에 가장 잘 맞는 AI를 의미한다. 이를 위해 KT는 한국의 사회적 맥락과 같은 무형의 요소와 한국어 고유의 언어적·문화적 특성 등을 충분히 반영해 학습한 AI 모델을 개발하여 대한민국의 산업과 일상 속에서 AI가 자연스럽게 스며들어 대중화될 수 있도록 앞장서고 있다.

KT의 믿:음은 사전 학습부터 자체적으로 만든 한국적 독자 AI 모델로서 고품질 한국어 데이터를 준비하는 과정에서 모든 저작권을 확보하여 신뢰성을 높였다. 2023년 믿:음 1.0 버전의 Standard, Premium 2종을 출시한 이래 KT AICC(AI 고객센터), 지니TV, AI 전화, 100번 고객센터 등 다양한 서비스에 폭넓게 활용해 왔다.

이번에 KT가 한국적 AI라는 철학을 담아 새롭게 선보이는 믿:음 모델은 ▲115억 파라미터 규모의 ‘믿:음 2.0 Base’ ▲23억 파라미터 규모의 ‘믿:음 2.0 Mini’ 2종으로 모두 한국어와 영어를 지원한다. 믿:음 2.0 Base는 범용 서비스에 적합한 모델로 한국 특화 지식과 문서 기반의 질의 응답에서 강력한 성능을 나타낸다.

믿:음 2.0 Mini는 Base 모델에서 증류한 지식을 학습한 소형 모델이다. 110억 파라미터 이상의 한국어 범용 LLM을 누구나 상업적으로 활용할 수 있는 오픈소스로 공개한 것은 KT가 처음으로 국내 AI 생태계 활성화에 긍정적인 역할을 할 수 있을 것으로 기대된다.

믿:음 모델은 한국어와 한국 문화 및 사회 등의 전문 분야에서 기존의 국내외 주요 모델을 상회하는 이해력과 생성 성능을 입증했다. KT와 고려대학교가 공동 개발한 한국어 AI 역량 평가 지표인 ‘Ko-Sovereign(코-소버린)’ 벤치마크에서 유사 규모의 국내 기성 모델을 비롯해 글로벌 최고 수준의 오픈소스 모델을 능가하는 점수를 기록했다. Ko-Sovereign은 한국적 AI 성능을 종합적으로 평가할 수 있도록 언어, 문화, 사회, 역사 등의 한국적 맥락을 정밀하게 반영한 전문가 수준의 문항으로 구성됐다.

이와 함께 한국과 관련한 전문 지식의 이해도를 측정하는 대표적 벤치마크 ‘KMMLU’와 한국어 언어모델 평가 지표인 ‘HAERAE’에서도 믿:음은 국내외 주요 오픈소스 모델보다 더 우수한 성능을 기록했다.

KT는 국내 교육용 도서와 문학 작품 등의 발간물, 법률 및 특허 문서, 각종 사전 등 다양한 산업·공공·문화 영역에서 방대한 한국 특화 데이터를 확보해 믿:음 2.0 학습에 활용했다. 또 저작권 이슈가 있는 데이터는 모두 제거하는 등 KT의 Responsible AI 원칙에 따라 고품질 데이터를 선별하여 가공했다.

이외에도 한국어의 구조와 언어학적 특성을 반영한 토크나이저(Tokenizer)를 자체 개발하고, 필터링으로 줄어든 데이터 규모는 데이터 합성 방법론을 적용해 보완했다. 이를 통해 한국 사회 고유의 언어와 문화적 맥락을 정교하게 반영하여 한국어 사용자에 최적화된 언어 이해 능력과 정밀한 표현력을 지닌 모델로 구현했다. 고려대학교 민족문화연구원과의 산학 협력을 통해 ‘한국적 AI’로서 믿:음 2.0의 학술적 신뢰도도 확보했다.

특히 KT는 믿:음 2.0은 AI의 윤리성 및 신뢰성을 높이기 위해 국내외 정책과 가이드라인을 기반으로 전문가들과 함께 만든 ‘AI 영향 평가 체계’를 적용해 보다 안전하고 투명한 기술을 구현하는 데 힘썼다.

또 믿:음 개발 단계에서 리벨리온과 긴밀히 협력하며 국산 AI 반도체에서의 동작을 최적화했고, 프렌들리AI와 함께 사용자가 별도의 설치 과정 없이도 허깅페이스를 통해 무료로 편리하게 체험해볼 수 있는 환경도 한시적으로 제공한다.

KT는 믿:음 2.0을 공개하며 본격적으로 국내 AI 생태계에 ‘한국적 AI’ 확산 선도에 나선다. 마이크로소프트와의 협업으로 GPT-4에 한국적 사고를 추가 학습시키는 방식의 모델 또한 순차 공개할 예정이다.

앞서 KT는 자체 개발한 모델 ‘믿:음’, 글로벌 기업들의 SOTA(State of the Art, 현존 최고 수준 모델) 등을 두루 활용하여 한국의 특수성을 반영한 AI 모델에 집중 투자하고 국내 사용 환경에 특화한 AI의 대중화에 앞장서겠다고 밝혀온 바 있다. 국내 공공 및 민간 여러 분야에서 AI를 활용한 혁신을 주도하며 국가 AI 경쟁력 제고에 기여한다는 복안이다.

KT Gen AI Lab장(CAIO) 신동훈 상무는 “믿:음 2.0은 일반적인 생성 능력을 갖추면서도 한국의 문화와 언어를 깊이 이해하도록 고도화된 AI 모델”이라며, “이는 KT가 국내 사용자들에게 고성능 한국적 AI 모델에 대한 새로운 대안을 제시하는 한편 글로벌 경쟁력을 갖추게 될 중요한 발판이 될 것”이라고 말했다.

산업·유통

KT, 한국적 AI ‘믿:음 2.0’ 오픈소스 공개…대한민국 AI 대중화 나선다

관련기사

이 시각 추천뉴스

“월드콘 먹고 북중미 해외여행 가자”…롯데웰푸드, 월드콘 신제품 3종 출시하고 북중미 여행권 쏜다

"공기질 관리와 인테리어를 동시에"∙∙∙SK매직 ‘올클린 디 아트 공기청정기’ 인기

유니클로, LA다저스와 파트너십 체결…구장 명칭도 ‘유니클로 필드 앳 다저 스타디움’

'K-백신' 중남미 첫 허가로 글로벌 가속… GC녹십자 수두백신 ‘배리셀라주’, 과테말라 품목허가 획득

네이버 최수연 대표, 스포티파이와 콘텐츠 파트너십 협업 강화…"스포티파이 ‘네아로’ 적용 시작으로 가시적 협업 속도전"

[이슈&논란] 태광산업 “롯데홈쇼핑 경영진, 불법 내부거래”…이사회의 부결 이후 최대주주 롯데쇼핑 등 수십억 거래

농심, 아시아 최고 한국 레스토랑에 ‘신라면상’ 시상…‘아시아 50 베스트 레스토랑’ 행사 3년째 후원

동국제약 판시딜·마데카솔, 탈모치료제와 상처치료제 부문 1위 선정…'한국산업의 브랜드 파워’에서 8년 연속·5년 연속 1위

코오롱 이규호 부회장, 국제협력 무대서 바이오헬스케어 분야 리더십 강화… APEC 산하 ABAC 보건분야 민관협력 앞장

많이 본 뉴스

[이슈&논란] 삼성전자, 모바일사업부 위기 속 임원들 이코노미석 탑승 지시…메모리 쇼크 속 '긴축' 돌입

[이슈&논란] 獨 라인메탈 CEO "전 세계 방공 미사일 재고 거의 바닥" 경고…1년치 정밀무기 사용량, 단 4일만에 소진

[빅테크칼럼] 쥐 뇌활동으로 '영화관' 재현…UCL, 시각 피질 단일세포로 10초 영상 재구성 '성공'

[빅테크칼럼] 챗GPT '야한 대화' 모드 코드 유출…성인 콘텐츠 시대 본격 개막하나

[우주칼럼] 36년 만에 정월대보름과 겹친 개기월식, 3월 3일 저녁 전국서 관측…붉은 보름달의 귀환

[The Numbers] XRP '운명의 5주' 폭등 카운트다운?…머스크 X머니·日금리·리플 제휴 '초호재' 총출동

[The Numbers] 삼성전자·SK하이닉스, 주가 급락의 진짜 이유…구글 '터보퀀트' 쇼크, 메모리반도체 시장 재편 신호탄

[이슈&논란] 이란 초등학교 '폭격’으로 100명이상 사망…유네스코, ‘중대한 인도주의법 위반’이라 규정한 이유

[공간사회학] 이란공습 보복으로 아부다비 공항 사망자 발생

[빅테크칼럼] "월 10만원에 마케팅팀 통째로 고용"...Okara가 몰고 온 AI CMO '폭풍'

[빅테크칼럼] K배터리 LG엔솔·삼성SDI·SK온, 인터배터리 2026서 AI·ESS '전력 제국' 구축 선언

[빅테크칼럼] ‘트래픽 괴물’ 된 구글 제미나이…1년 새 643% 폭증, 챗GPT와의 성장 격차 벌렸다

[The Numbers] 'SK하이닉스 키오시아 베팅' 최태원 결단, 15조원 결실로…인텔·솔리다임 등 'SK 낸드제국 건설' 가속

[The Numbers] 메모리 호황, 전쟁에도 '불사조' 날개…삼성전자·SK하이닉스 "중동 위기, 반도체 호황 꺾지 못할 것"

[내궁내정] 이란, 중동 전역 공격 속 터키 제외한 이유…NATO 핵기지·외교 생명줄 지킨 '고차원 계산'

[The Numbers] 보스턴다이내믹스 100조 상장설, 정의선에 ‘20조 탄환’…현대차 순환출자 끊는 초대형 승계 시나리오

[빅테크칼럼] 머스크의 반도체공장 '테라팹 쇼크'…삼성, 165억 달러 '골든 파트너'서 라이벌?

[빅테크칼럼] AI 칩 열풍에 TSMC 최대고객 판도 대변혁…애플 제치고 엔비디아 '왕좌 등극'

[The Numbers] 코스닥 동전주, 폭탄 터지기 직전…K바이오 30곳, 퇴출·강등 위기, 어디?

[빅테크칼럼] AI 추론 시대, 낸드플래시 '황금알' 부화…삼성전자 영업익 14배 폭등 예고

[The Numbers] SK㈜ 5.1조 자사주 소각 폭탄, 최태원 지배력 '강화' 신호…SK하이닉스·SK스퀘어 '동반 랠리' 촉발하나

[빅테크칼럼] Grok AI, 美 이란 공습 정확한 날짜 맞췄다… 챗GPT·클로드·제미나이·Grok에게 물었더니

[The Numbers] AI 호황 타고 삼성전자·SK하이닉스, 법인세 8.5조로 국가재정 견인

[랭킹연구소] 상위 0.01% 기업 31곳 어디?…SKT·네이버클라우드·현대모비스 ‘급여·복지’ 최상위

[이슈&논란] 최태원 "SK하이닉스 美 ADR 상장 검토" 첫 언급…마이크론·TSMC와 같은 트랙에 선다

[내궁내정] '모텔 살인' 20대女, '사이코패스' 판정한 PCL-R검사…한국 사이코패스 범죄자 점수는?

[이슈&논란] 35분 조깅이 초래한 ‘프랑스 보물’…Strava 한 방에 노출된 핵추진 항공모함 '샤를 드골'

[빅테크칼럼] 테슬라 자율주행, 중동-유럽 동시 돌파… FSD 글로벌 130억km 누적

[랭킹연구소] 글로벌 자동차 판매 TOP10, 중국 BYD·SAIC·지리 '석권'…도요타>폭스바겐>현대차>GM>스텔란티스>BYD>SAIC>포드>지리>혼다 順

[The Numbers] 월가 절대권력 블랙록, 전주로 온 이유…국민연금 1000조원·블랙록 2경원의 포괄적 공조

[빅테크칼럼] 챗GPT 쇼핑 꿈 접은 오픈AI, 온라인여행사 12% 폭등, 왜?…익스피디아·부킹·트립, 디인터미디어션 위기해소에 '안도'

[CEO혜윰] 왜 머스크 측근들은 떠나는가…공동창업자 ‘집단이탈’의 본질과 조직운영의 '구조적 리스크'

[공간사회학] 미국, 이란 하르그섬 '군사 완파' 왜 중요한가…이란 석유 90% 동맥 절단·GDP 18% 타격

[랭킹연구소] 韓민주주의 세계 41위→22위 '껑충' · 美 24→51위 '추락’…덴마크>스웨덴>노르웨이>스위스>에스토니아>아일랜드 順

[빅테크칼럼] AI 수요 급증으로 TSMC, 8000명 채용 돌입…타이난 메가팹 착공 가속

[빅테크칼럼] ‘킬 체인’에 들어온 AI…미군, 이란서 6000곳 표적타격의 '민낯'

[The Numbers] 강남3구 보유세 급등 전망에 '한강벨트' 붕괴 위기…반포자이 84㎡ 보유세, 1275만원에서 1790만원 '쑥'

[우주칼럼] 아르테미스 2호, 54년 만의 유인 달 비행 '최종 카운트다운' 돌입

[우주칼럼] 중국 위성으로 포착된 미군 '이란 포위망'… F-22 11대 이스라엘 기지, 항모 2척 동시 배치

삼성전자, 오픈AI '타이탄' 뚫었다…HBM4 8억Gb 단독 공급으로 AI 패권 굳히기 "엔비디아·AMD 이어 세번째"