한국어EN
모델 아키텍처·학습 기법Moonshot AI

Kimi Linear

Kimi Linear — KDA와 MLA의 층별 하이브리드

왜 중요한가

공정 비교에서 full attention을 처음 능가, KV 캐시 최대 75% 절감과 1M 컨텍스트 디코딩 최대 6배

출처 — 1차 출처만 싣고, 직접 이동해 확인할 수 있어요 논문arxiv.orghttps://arxiv.org/abs/2510.266922026년 8월 24일에 더한 조각 · 그 주 보기