Cjournal
Cjournal
기업과산업  전자·전기·정보통신

KT 자체개발 AI모델 '믿:음 2.0' 오픈소스 공개, 한국적 데이터로 신뢰성 향상

조승리 기자 csr@businesspost.co.kr 2025-07-03 09:49:53
확대 축소
공유하기
페이스북 공유하기 X 공유하기 네이버 공유하기 카카오톡 공유하기 유튜브 공유하기 url 공유하기 인쇄하기

[비즈니스포스트] KT는 자체 개발한 언어모델(LLM) ‘믿:음 2.0’의 오픈소스를 인공지능(AI) 개발자 플랫폼 허깅페이스를 통해 공개할 예정이라고 3일 밝혔다. 

이 오픈소스는 기업과 개인, 공공 누구나 상업적으로 활용할 수 있도록 제약 없이 개방된다.
 
KT 자체개발 AI모델 '믿:음 2.0' 오픈소스 공개, 한국적 데이터로 신뢰성 향상
▲ KT가 '한국적 AI'의 철학을 담아 자체 개발한 언어모델 '믿:음 2.0'의 오픈소스를 AI 개발자 플랫폼 허깅페이스를 통해 공개할 예정이라고 3일 밝혔다. 사진은 KT 기술혁신부문 연구원들이 서초구 KT 우면연구센터에서 믿:음 2.0을 테스트하고 있는 모습. < KT >

믿:음은 사전 학습부터 자체적으로 만든 한국적 독자 AI 모델이다. 2023년 믿:음 1.0 버전의 스탠다드, 프리미엄 2종을 출시한 이래 KT AI 고객센터, 지니TV, AI 전화, 100번 고객센터 등에 활용해 왔다.

이번에 선보이는 믿:음 모델은 △115억 파라미터 규모의 ‘믿:음 2.0 베이스’ △23억 파라미터 규모의 ‘믿:음 2.0 미니’ 2종으로 모두 한국어와 영어를 지원한다. 

믿:음 2.0 베이스는 범용 서비스에 적합한 모델이다. 믿:음 2.0 미니는 베이스 모델에서 증류한 지식을 학습한 소형 모델이다. 

KT는 국내 교육용 도서와 문학 작품 등의 발간물, 법률 및 특허 문서, 각종 사전 등 다양한 산업·공공·문화 영역에서 한국 특화 데이터를 확보해 믿:음 2.0 학습에 활용했다.

이외에도 한국어의 구조와 언어학적 특성을 반영한 토크나이저를 자체 개발하고, 필터링으로 줄어든 데이터 규모는 데이터 합성 방법론을 적용해 보완했다. 

고려대학교 민족문화연구원과의 산학 협력을 통해 한국적 AI로서 믿:음 2.0의 학술적 신뢰도도 확보했다고 회사 측은 설명했다.

AI의 윤리성 및 신뢰성을 높이기 위해 국내외 정책과 가이드라인을 기반으로 전문가들과 함께 만든 ‘AI 영향 평가 체계’를 적용했다.

KT는 마이크로소프트(MS)와의 협업으로 GPT-4에 한국적 사고를 추가 학습시키는 방식의 모델도 순차적으로 공개한다.

신동훈 KT 생성형 AI 랩장은 “믿:음 2.0은 일반적 생성능력을 갖추면서도 한국의 문화와 언어를 깊이 이해하도록 고도화된 AI 모델”이라며 “이는 KT가 국내 사용자들에게 고성능 한국적 AI 모델에 대한 새로운 대안을 제시하는 한편 글로벌 경쟁력을 갖추게 될 중요한 발판이 될 것”이라고 말했다. 조승리 기자

최신기사

KAI 노조, 신임사장 후보 중 류광수 전 부사장·강은호 전 방사청장 반대 "문승욱 전..
키움증권 "롯데쇼핑, 차별화된 콘텐츠와 선진 시장 노하우로 베트남 시장 공략"
닛산 일본 자동차공장 폭스콘이 활용 논의, 구조조정에 폐쇄 대신 대안 찾는다
[서울아파트거래] '한강변 최고층' 래미안 첼리투스 39억2500만 원, 대출 규제 속..
BRICS 선진국들에 기후금융 지원 확대 요구, "개도국에 진 책임 다해야"
김상현 15년 만에 베트남으로 증권사 연구원 초청한 이유, 롯데쇼핑 '자부심' 알리고 싶다
IBK투자 "삼성바이오로직스 예상대로 순항 중, 가까워지는 6공장 증설"
하나증권 "대상 소재가 캐리, 하반기 라이신 시황이 실적 개선 열쇠"
주춤한 제주항공 턱밑까지 추격한 진에어, 박병률 공격경영으로 국내 LCC 1위 차지하나 
하나증권 "SK바이오팜 뇌전증 약 처방량 회복 확인, 신제품 도입할 시점"
Cjournal

댓글 (0)

  • - 200자까지 쓰실 수 있습니다. (현재 0 byte / 최대 400byte)
  • - 저작권 등 다른 사람의 권리를 침해하거나 명예를 훼손하는 댓글은 관련 법률에 의해 제재를 받을 수 있습니다.
  • - 타인에게 불쾌감을 주는 욕설 등 비하하는 단어가 내용에 포함되거나 인신공격성 글은 관리자의 판단에 의해 삭제 합니다.