카카오, Agentic AI 지향 'Kanana-2' 및 옴니 모델 'Kanana-o' 진화 공개
핵심 내용
카카오가 if(kakao)25에서 MLA와 MoE를 적용해 추론 처리량을 개선한 Kanana-2와 GPT-4o급 성능의 옴니 모델 Kanana-o 등 Agentic AI를 향한 기술 진화 로드맵을 공개했다.
자세히 보기
카카오가 if(kakao)25에서 Agentic AI로의 진화를 목표로 하는 언어모델 'Kanana-2'와 멀티모달 옴니 모델 'Kanana-o'의 개발 현황과 성과를 공개했다.
Kanana-2: 성능과 효율성의 균형
핵심 언어모델인 Kanana-2는 MLA(Multi-head Attention)와 MoE(Mixture of Experts) 구조를 적용하여 긴 입력 처리와 대규모 추론 환경에서의 효율성을 극대화했다. 현재 개발 중인 Kanana-2-30b-a3b-preview 모델은 기존 모델 대비 획기적인 추론 처리량(Throughput)을 기록했으며, 이는 실서비스 환경에서 더 적은 자원으로 빠른 응답을 가능하게 한다. 또한 온디바이스 적용을 위해 8B 경량 모델도 개발 중이며, 향후 Pruning과 Distillation을 통해 다양한 사이즈로 확장할 계획이다.
Kanana-o: 한국어 특화 Any-to-Any 모델
텍스트, 음성, 이미지를 통합 이해하는 Kanana-o는 시각 이해 모델 Kanana-v와 음성 생성 모델 Kanana-a를 결합해 개발되었다. 한국어 및 문화 특화 데이터셋을 기반으로 학습되어 한국어 벤치마크에서 뛰어난 성능을 입증했으며, GPT-4o 등 글로벌 최고 수준 모델과 경쟁 가능한 성능을 보인다. 스트리밍 기술을 적용해 지연 없는 실시간 대화가 가능하며, 향후 Full-duplex 대화 지원으로 고도화될 예정이다.
멀티모달 생성 및 생태계 확장
이미지 생성 모델 Kanana-kollage는 카나나앱 등에 이미 적용되었으며, 이를 기반으로 한 동영상 생성 모델 Kanana-kinema는 자연스러운 영상 제작을 지원한다. 음성 언어모델은 총 5개 언어(한국어, 영어, 일본어, 중국어, 베트남어) 지원으로 확장될 예정이다. 카카오는 이러한 기술적 토대를 바탕으로 카카오톡 등 자사 서비스에 Kanana 모델을 본격 적용하여 Agentic AI 경험을 확산할 계획이다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.