카카오, '카나나-2' 업데이트…모델 4종 오픈소스로 추가 공개

황성완 기자 / 기사승인 : 2026-01-20 10:13:41
  • -
  • +
  • 인쇄
'MoE' 아키텍처로 효율 혁신, 학습 단계 세분화…에이전틱 AI 구현 위한 성능도 대폭 향상

[메가경제=황성완 기자] 카카오는 자체 기술력을 기반으로 개발한 차세대 언어모델 ‘Kanana-2(카나나-2)’를 업데이트하고, 4종의 모델을 오픈소스로 추가 공개했다고 20일 밝혔다.

 

▲[사진=카카오]

카나나-2는 지난 12월 허깅페이스를 통해 오픈소스로 공개한 언어모델이다. 에이전틱(Agentic) AI 구현에 최적화된 고성능·고효율 기술 경쟁력을 입증한 카카오는 불과 한 달 여 만에 성능을 크게 업데이트한 4종의 모델을 오픈소스로 추가 공개했다.

 

이번에 공개한 4종의 모델은 고효율과 저비용의 성능 혁신은 물론, 실질적인 에이전틱 AI(Agentic AI)의 구현을 위한 도구 호출(Tool Calling) 능력을 대폭 강화한 것이 특징이다. 특히, 최신 초고가 인프라가 아닌 엔비디아 A100 수준의 범용 GPU(그래픽 처리 장치) 에서도 원활하게 구동되도록 최적화해 중소기업과 학계 연구자들도 비용 부담없이 고성능 AI를 활용할 수 있도록 실용성을 높였다는 것이 업체 측 설명이다.

 

Kanana-2 효율성의 핵심은 ‘전문가 혼합(MoE, Mixture of Experts)’ 아키텍처다. 전체 파라미터는 32B(320억개) 규모로 거대 모델의 높은 지능을 유지하면서도, 실제 추론 시에는 상황에 맞는 3B(30억개)의 파라미터만 활성화해 연산 효율을 획기적으로 높였다. 또한, MoE 모델의 학습에 필수적인 여러 커널을 직접 개발해 성능 손실 없이 학습 속도는 높이고, 메모리 사용량은 획기적으로 낮추는 성과를 거두기도 했다.

 

이러한 아키텍처 및 데이터의 고도화 뿐 아니라 데이터 학습 단계도 고도화했다. 사전 학습(Pre-training)과 사후 학습(Post-training) 사이에 ‘미드 트레이닝(Mid-training)’ 단계를 신설하고, AI 모델이 새로운 정보를 배울 때 기존 지식을 잊는 치명적 망각(Catastrophic Forgetting) 현상을 방지하기 위해 ‘리플레이(Replay)’ 기법을 도입했다. 이를 통해 새로운 추론 능력을 추가하면서도 기존 한국어 구사와 일반 상식 능력을 안정적으로 유지할 수 있었다.

 

카카오는 이러한 기술을 바탕으로 ▲기본(Base) 모델부터 ▲지시 이행(Instruct) 모델 ▲추론 특화(Thinking) 모델 ▲미드 트레이닝(Mid-training) 모델까지 총 4종의 모델을 허깅페이스에 추가로 공개했다. 연구 목적으로 활용도가 높은 미드 트레이닝 탐색용 기본 모델을 함께 제공해 오픈소스 생태계 기여도를 높였다.

 

새로운 Kanana-2 모델의 또 다른 차별점은 단순 대화형 AI를 넘어 실질적인 업무 수행이 가능한 에이전트 AI 구현에 특화됐다는 점이다.

 

고품질 멀티턴(Multi-turn) 도구 호출 데이터를 집중 학습시켜 지시 이행(Instruction Following)과 도구 호출(Tool Calling) 능력을 대폭 강화함으로써 복잡한 사용자 지시를 정확히 이해하고 적절한 도구를 스스로 선택 및 호출할 수 있도록 했다. 실제 성능 평가에서 동급 경쟁 모델인 ‘Qwen-30B-A3B-Instruct-2507’ 대비 ▲지시 이행 정확도, ▲ 멀티턴 도구 호출 성능, ▲ 한국어 능력 등에서 압도적인 우위를 기록했다.

 

김병학 카카오 카나나 성과리더는 “새로워진 Kanana-2는 ‘어떻게 하면 고가의 인프라 없이도 실용적인 에이전트 AI를 구현할 수 있을까’에 대해 치열하게 고민한 결과”라며 “보편적인 인프라 환경에서도 고효율을 내는 모델을 오픈소스로 공개함으로써, 국내 AI 연구 개발 생태계 발전과 기업들의 AI 도입의 새로운 대안이 될 수 있기를 기대한다”고 말했다.

 

한편, 카카오는 현재 MoE 구조를 기반으로 거대 스케일의 수천억 파라미터 모델 ‘Kanana-2-155b-a17b’의 개발을 위한 학습을 진행 중이다. 특히 중국의 인공지능 스타트업 지푸 AI(Zhipu AI)의 ‘GLM-4.5-Air-Base’ 모델 대비 40% 수준의 데이터로 학습했음에도, MMLU(모델의 일반 지능) 등 주요 벤치마크 성능 지표에서 유사한 성능을 보였다. 한국어 질의 응답과 수학 영역에서는 압도적 성능 우위를 기록하기도 했다. 이 밖에도 기존 LLM(Large Language Model) 학습의 표준인 32비트나 16비트를 대신해, 최신 Hopper GPU의 차세대 고효율 포맷인 8비트 방식을 도입해 학습 효율을 극대화하고 있다.

 

향후 카카오는 글로벌 최상위 수준의 성능을 목표로 하는 파운데이션 모델 개발을 이어가고, 더욱 복잡한 에이전트 시나리오에도 대응할 수 있는 고도화된 AI를 선보일 계획이다.

[저작권자ⓒ 메가경제. 무단전재-재배포 금지]

뉴스댓글 >

최신기사

1

이륜차 소음 '24시간 관리' 추진…박정 의원, 법적 근거 마련
[메가경제=이정우 기자] 심야 시간대 도심을 질주하는 이륜차(오토바이) 소음으로 인한 시민 불편이 커지는 가운데, 무인 단속 장비 운영의 법적 근거를 마련하는 법안이 국회에 발의됐다.국회 기후에너지환경노동위원회 소속 박정 의원(더불어민주당·파주시을)은 이륜차 배기 소음으로 인한 국민 불편을 줄이기 위해 '소음·진동관리법 일부개정법률안'을 대표

2

‘2026 대한민국 편지쓰기 공모전’ 수상작 발표…전국서 손편지 1만 1600여건 접수
[메가경제=이정우 기자] 디지털 매체를 통한 즉각적 소통이 일상화된 시대 속에서, 손편지로 마음과 온기를 나누는 국민적 관심이 한층 고조된 것으로 나타났다. 우정사업본부 우정인재개발원(원장 오형근)은 소통의 가치를 조명하고 손편지 쓰기 문화를 확산하기 위해 추진한 ‘2026 대한민국 편지쓰기 공모전’의 부문별 수상작을 최종 선정 및 발표했다고 23일 밝혔다

3

SK매직, 우리은행 전국 영업점에 공기청정기 공급…전국 관리 서비스까지 제공
[메가경제=심영범 기자]SK매직이 우리은행 전국 영업점에 공기청정기를 공급하며 B2B(기업 간 거래) 공조·환경가전 시장 확대에 나선다. SK인텔릭스는 헬스 플랫폼 브랜드 SK매직이 우리은행 전국 영업점에 공기청정기를 공급하는 계약을 체결했다고 23일 밝혔다. 이번 계약에 따라 SK매직은 제품 공급뿐 아니라 전국 단위 전문 서비스 인프라를 활용해 정기적인

HEADLINE

더보기

트렌드경제

더보기