SKT·KT, 한국 특화 'AI 오픈소스' 공개…"AI 대중화 나선다"

조인준 기자 / 기사승인 : 2025-07-03 11:02:52
  • -
  • +
  • 인쇄
▲A.X 4.0의 대규모 학습(CPT)을 진행한 SK텔레콤 자체 구축 슈퍼컴퓨터 '타이탄'(사진=SK텔레콤)

SK텔레콤과 KT가 자체 거대언어모델(LLM)을 오픈소스로 공개했다. 양사는 한국 특화형 LLM을 기업과 개인, 공공에 개방해 국내 인공지능(AI) 대중화에 기여할 방침이다.

SKT와 KT는 자체 개발 LLM인 '에이닷엑스(A.X) 4.0'과 '믿:음 2.0'을 오픈소스 AI 개발자 플랫폼 허깅페이스에 3일 각각 공개했다.

SKT의 A.X 4.0은 현존 LLM 중 최상급의 한국어 처리 효율성을 보이며 데이터 보안을 고려한 설계, 로컬 환경에서의 운영 가능성 등이 강점이다. SKT는 모델에 방대한 한국어 데이터를 추가로 학습시켜 국내 비즈니스 환경에 최적화시켰다.

A.X 4.0의 토크나이저를 자체 설계, 적용해 높은 수준의 한국어 처리 역량을 구현했다. 자체 테스트 결과 같은 한국어 문장을 입력했을 때 GPT-4o보다 A.X 4.0이 약 33% 가량 높은 효율을 기록하며, 다른 LLM 대비 높은 정보 처리용량에 비용 절감까지 가능한 경제성을 갖췄다.

또 대표적인 한국어 능력 평가 벤치마크인 KMMLU2에서 78.3점을 기록하고, 한국어 및 한국 문화 벤치마크인 CLIcK3에서도 83.5점을 획득하는 등 GPT-4o보다 우수한 한국 문화 이해도를 입증했다.

SKT는 A.X 4.0을 기업 내부 서버에 직접 설치해 사용할 수 있는 온프레미스 방식으로 제공할 방침이다. 표준 모델은 720억개, 경량 모델은 70억개의 매개변수를 갖추고 있어 이용자들이 목적에 맞춰 선택적으로 이용할 수 있도록 했다.

KT는 '한국적 AI' 철학을 담은 믿:음 2.0을 앞세워 국내 AI 생태계 활성화에 기여할 것이라고 밝혔다. 믿:음은 한국적 독자 AI 모델로서 고품질 한국어 데이터를 준비하는 과정에서 모든 저작권을 확보해 신뢰성을 높였다. 이번에 선보인 모델은 115억 파라미터 규모인 '믿:음 2.0 Base'와 23억 파라미터 규모의 '믿:음 2.0 Mini' 2종이다.

믿:음 모델은 한국어와 한국 문화 및 사회 등 전문 분야에서 기존의 국내외 주요 모델을 상회하는 이해력과 생성 성능을 입증했다. KT와 고려대학교가 공동 개발한 한국어 AI 역량 평가 지표 'Ko-Sovereign'(코-소버린) 벤치마크에서 글로벌 최고 수준의 오픈소스 모델을 능가하는 점수를 기록했다.

KT는 국내 교육용 도서와 문화 작품 등의 발간물, 법률 및 특허 문서, 각종 사전 등 다양한 산업·공공·문화 영역에서 방대한 한국 특화 데이터를 확보해 믿:음 2.0 학습에 활용했다.

KT는 "한국어의 구조와 언어학적 특성을 반영한 토크나이저를 자체 개발하고, 필터링으로 줄어든 데이터 규모는 데이터 합성 방법론을 적용해 보완했다"며 "이를 통해 한국 사회 고우의 언어와 문화적 맥락을 정교하게 반영, 한국어 사용자에 최적화된 언어 이해 능력과 정밀한 표현력을 지닌 모델로 구현했다"고 설명했다.

양사는 이번 오픈소스 공개를 시작으로 국내에 '한국적 AI' 확산을 통한 생태계 구성 선도에 나설 방침이다. SKT는 이달 내로 수학 문제 해결과 코드 개발 능력이 강화된 추론형 모델을 공개하고 이미지와 텍스트를 동시에 이해하고 처리할 수 있는 수준까지 모델을 업데이트할 계획이다. 또 후속 모델도 순차적으로 공개할 예정이다. KT는 마이크로소프트(MS)와 협업으로 GPT-4에 한국적 사고를 추가 학습시킨 모델을 공개할 계획이라 밝혔다.

Copyright @ NEWSTREE All rights reserved.

뉴스트리 SNS

  • 뉴스트리 네이버 블로그
  • 뉴스트리 네이버 포스트
  • 뉴스트리 유튜브
  • 뉴스트리 페이스북
  • 뉴스트리 인스타그램
  • 뉴스트리 트위터

핫이슈

+

Video

+

ESG

+

경기도 '기후테크 스타트업' 모집...기업당 4000만원 지원

경기도와 경기창조경제혁신센터가 기후테크 스타트업을 글로벌 유니콘기업으로 육성하기 위해 오는 2월 20일까지 '기후테크 스타트업 육성 3기' 34개사

LG U+, GS건설과 태양광 PPA 계약...年 7000톤 탄소절감 기대

LG유플러스는 GS건설과 데이터센터를 포함한 사옥의 탄소중립을 위한 재생에너지 계약을 체결했다고 30일 밝혔다. 이번 계약은 전력 소모가 큰 LG유플러

업스테이지, 포털 '다음' 인수한다...카카오와 지분 맞교환

인공지능(AI) 스타트업 업스테이지가 인터넷 포털 '다음'의 새 주인이 된다.다음 운영사인 에이엑스지(AXZ)의 모회사 카카오와 업스테이지는 29일 각각

여수, 유엔기후변화협약 기후주간 개최지 '확정'

전남 여수가 '유엔기후변화협약 기후주간'(UNFCCC Climate Week) 최종 개최지로 선정됐다.기후에너지환경부는 올해 아시아 지역 기후주간의 개최지로 우리

상법 개정이 지배구조에 미치는 영향..."올 주총시즌에 확인 가능"

2026년 정기주주총회 시즌은 지난해 두차례에 걸쳐 개정된 상법이 실제 기업 지배구조에서 어떻게 반영되는지 처음으로 확인할 수 있는 시기가 될 전망

산업계 '녹색전환' 시동...민관합동 'K-GX 추진단' 출범

'2035 국가 온실가스 감축목표(NDC)'를 경제 성장 기회로 활용하기 위한 산업계의 녹색전환 방안이 논의된다.정부는 28일 서울 중구 대한상공회의소에서

기후/환경

+

난립하는 美 데이터센터에...가스발전 설비 3배 늘었다

미국이 인공지능(AI)의 전력 수요를 충당하기 위해 가스발전량을 대폭 늘리면서, 전세계 신규 가스화력 발전소 건설이 사상 최대로 치솟고 있다. 이는

[팩트체크④] '초콜릿·커피' 생산량 늘어도 가격 내려가지 않는 이유

기후변화로 농작물 재배지가 북상하고 작물의 생산량이 줄면서 가격이 요동치고 있다. 하지만 농작물 가격인상이 오롯이 기후변화에서 기인한 것인지

[영상]주택 수십 채가 4km 절벽에 '와르르'...기후악재가 빚어낸 공포

이탈리아 시칠리아 고원지대에 있는 소도시에서 4km에 이르는 지반 붕괴로 주택들도 휩쓸려 매몰되는 사태가 발생했다. 시칠리아 당국은 추가 붕괴 위

[주말날씨] '한파' 서서히 풀린다...1일 중부지방 '눈발'

이번 주말부터 기온이 점진적으로 회복되겠지만 북극에서 찬공기가 여전히 유입되고 있어 아침기온은 여전히 춥다. 다만 낮기온은 영상권에 접어들

호주, 화석연료 기업에 '부담세' 부과 검토..."기후재난 책임져야"

호주에서 석탄·가스 등 화석연료 기업에게 오염유발에 대한 세금을 부과하는 방안이 논의되고 있다.28일(현지시간) 가디언에 따르면, 호주에서는

녹색전환으로 성장동력 만든다...기후부, 탈탄소 로드맵 '촘촘히'

정부가 기후위기를 성장기회로 활용하기 위해 올 상반기 내로 재정·세제·금융 등 지원방안을 담은 '대한민국 녹색전환(K-GX) 전략을 마련할

에너지

+

순환경제

+

오피니언

+