grep

Engineering

더 똑똑해진 카카오의 언어모델 Kanana 1.5, 상업 활용 가능한 오픈소스 공개

Kanana카카오

2025년 5월 23일

원문에서 보기 ↗

성능은 더 강력하게, 사용은 더 자유롭게

카카오의 자체 언어모델 ‘Kanana(카나나)’가 첫 공개된 지 3개월 만에, 한층 업그레이드된 ‘Kanana 1.5’를 새롭게 선보입니다.

이번 연구 성과의 일환으로, 전체 언어모델 중 8B와 2.1B 두 모델을 상업적 활용까지 가능한 오픈소스로 공개 합니다. Apache 2.0 라이선스로 누구나 자유롭게 사용할 수 있습니다.

이번 공개는 단순한 기술 공개를 넘어, 국내 LLM 생태계의 활성화를 위해 열린 시도입니다. 연구자는 물론, 기업도 목적에 맞게 자유롭게 모델을 튜닝하고 활용할 수 있습니다. 복잡한 문제 해결부터 빠른 응답이 필요한 서비스까지, 다양한 분야에 즉시 적용 가능합니다.

상황추천 모델특징
복잡한 문서를 요약하거나, 코드를 작성하고 싶어요.Kanana-1.5-8b-instruct➊ 성능과 비용 효율의 균형을 고려해 설계된 중형 모델로, 다양한 AI 응용 서비스 구현에 최적화 ➋ 한국어와 영어 모두에서 강력한 성능을 보이는 범용 언어모델 ➌ 상대적으로 높은 연산력으로 고난이도 문제 해결 가능
빠른 응답이 중요한 Q&A 서비스를 만들고 싶어요.Kanana-1.5-2.1b-instruct➊ 경량 모델로 가볍고 빠른 응답 처리 ➋ 온 디바이스(On-device) 환경에 최적화
직접 특정 목적에 맞춘 모델을 튜닝하고 싶어요.Kanana-1.5-8b/2.1b-base➊ 사전 학습 모델로 커스터마이징 최적화 ➋ 다양한 도메인에 맞는 인스트럭션 튜닝(Instruction Tuning) 가능

Kanana 1.5, 어떻게 달라졌을까요?

이제 AI는 사용자의 명령 수행에서 더 나아가, 스스로 판단하고 행동하는 에이전트로 진화하고 있습니다. Kanana 1.5는 Agentic AI로 나아가기 위해 기존 모델 대비 수학과 코딩 능력을 크게 강화하고, 입력 길이(Context Length)를 확장했습니다. 또한, Function Calling 기능도 수행할 수 있도록 개선했습니다.

1. Agentic AI를 위한 성능 개선

Pre-training 단계에서부터 코딩 및 수학 데이터를 대폭 확대했고, 그 결과 글로벌 모델 대비 압도적인 한국어 성능은 물론, 코드 및 수학 문제 해결 능력에서 오픈소스 SOTA 모델에 견줄만 한 유의미한 수준의 성능 을 달성했습니다. 또한, 에이전트로서 기본적으로 요구하는 능력인 Function Call, 즉 외부 도구나 API를 호출해 실제 작업을 수행하는 능력도 고도화하였습니다.

이를 통해 Kanana 8B를 기준으로, 코딩과 수학 문제 해결, Function Calling 능력에서 이전 모델 대비 평균 1.5배의 성능 향상을 기록하였습니다.

Base ModelsMMLU (5-shot)KMMLU (5-shot)HAE-RAE (5-shot)HumanEval (0-shot)MBPP (3-shot)GSM8K (5-shot)
Kanana-1.5-8B64.2448.9482.7761.5957.8063.53
Kanana-8B64.2248.3083.4140.2451.4057.09
Kanana-1.5-2.1B56.3045.1077.4652.4447.0055.95
Kanana-Nano-2.1B54.8344.8077.0931.1046.2046.32

표1. Kanana 1.0 및 1.5 상세 성능 비교 (Base 모델 기준)

Instruct ModelsMT-BenchKoMT-BenchIFEvalHumanEval+MBPP+GSM8K (0-shot)MATHMMLU (0-shot, CoT)KMMLU (0-shot, CoT)FunctionChat Bench
Kanana-1.5-8B7.767.6380.1176.8367.9987.6467.5468.8248.2858.00
Kanana-8B7.136.9276.9162.2043.9279.2337.6866.5047.4317.37
Kanana-1.5-2.1B7.016.5468.6168.9065.0881.4360.6253.8732.9353.70
Kanana-Nano-2.1B6.405.9071.9763.4162.4372.3229.2652.4838.5126.10

표2. Kanana 1.0 및 1.5 상세 성능 비교 (Instruct 모델 기준)

Pre-training부터 Post-training까지, 카나나 언어모델 라인업 전체(Flag, Essence, Nano)의 자세한 1.5 개발과정과 상세 성능은 해당 링크를 통해 확인해 보세요!

2. 긴 문맥 이해와 간결한 답변으로 향상된 사용성

Kanana 1.5는 더 긴 입력을 안정적으로 처리하면서도, 더 짧고 정확한 답변을 제공합니다.

먼저 Context Length를 기존 8K에서 최대 128K까지 확장시켰습니다. 기존 1.0에서는 짧은 동화책 하나를 처리할 수 있었다면, 이제는 전공책 수준의 긴 입력도 처리할 수 있게 되었습니다.

또한, 같은 질문에 대해 더 빠르고 정확한 답변으로 더 나은 대화 경험을 제공합니다. 일반적으로 응답을 짧게 만들면 정보가 누락되기 쉽지만, Kanana 1.5는 정확도를 유지하면서도 응답 길이를 최적화해 불필요한 설명 없이 핵심만 간결하게 전달합니다. 이는 응답 속도가 중요한 실제 서비스 환경에서 사용자 체감 성능을 실질적으로 높이는 요소로 작용합니다. 예를 들어, 대답이 1~2초 빨라진다거나, 10줄짜리 응답 중 핵심 문장 한 줄이 더 자연스럽게 표현되는 것만으로도 체감 성능은 전혀 다르게 다가옵니다.

Kanana 2

현재 카카오는 Kanana 1.5에서 그치지 않고, ‘오픈소스를 뛰어넘는 카카오 서비스에 최적화된 LLM’을 목표로 Kanana 2를 개발하고 있습니다. 더 긴 입력 처리, 정교한 추론, 구조적 효율성까지, 모든 영역에서 한층 진화한 차세대 모델을 준비 중입니다.

앞으로도 지속적인 오픈소스 공개와 업데이트를 통해 더 많은 개발자와 연구자, 기업들이 국산 LLM의 가능성을 체감할 수 있도록 생태계를 확장해 나가겠습니다. 이러한 열린 접근이 국내 AI 생태계를 더욱 풍요롭게 만들고, 앞으로 더 많은 혁신적인 AI 모델이 등장하는 기회로 연결되길 기대합니다.

지금 바로 Kanana 1.5를 자유롭게 활용해 보세요!

👉 Kanana 1.5 다운로드

👉 Kanana 1.5 개발기 바로가기

관련 글 목록