一、基础概况
1. 开发主体与发布时间
Kimi K3 是月之暗面(Moonshot AI) 自研旗舰多模态大模型:
- 正式发布:2026年7月16日(WAIC世界人工智能大会首发)
- 权重全面开源:2026年7月27日,Hugging Face开放完整模型权重、技术报告、底层训练基础设施代码
- 产品定位:全球首款3万亿参数级开放权重MoE混合专家大模型,主打超长上下文、代码编程、智能体任务、图文多模态处理
- 迭代谱系:K2 → K2.5 → K2.7 Code → K3(旗舰完整版)

2. 核心硬件与参数规格
| 参数项 | 详细规格 |
|---|---|
| 总参数量 | 2.8万亿 MoE混合专家模型 |
| 单Token激活参数 | 1040亿(稀疏计算,大幅降低推理成本) |
| 专家模块 | 896个路由专家,每次仅调度16个专家参与计算,搭配2个共享专家 |
| 上下文窗口 | 100万 Token(1048576),支持百万字文档一次性上传解析 |
| 模态能力 | 原生多模态,同时支持文本 + 图片输入理解 |
| 网络层数 | 93层,自研KDA注意力架构+注意力残差层 |
| 存储权重大小 | 完整权重1.56TB,拆分为96个Safetensors分片文件 |
| 量化标准 | 权重MXFP4、激活值MXFP8,兼顾精度与部署显存门槛 |
二、三大自研核心底层架构(技术壁垒)
1. KDA(Kimi Delta Attention)混合线性注意力
专为百万超长上下文设计,解决传统Transformer长文本算力爆炸问题,周期性穿插门控MLA层,兼顾全局语义关联与推理速度;相比前代K2,长文本处理效率提升2.5倍。
2. Attention Residuals(AttnRes 注意力残差)
允许网络每一层选择性复用前面所有层的特征信息,深度长文本、超长代码库阅读时逻辑断层、上下文遗忘问题大幅减少。
3. Stable LatentMoE 稀疏混合专家架构
区别于普通MoE模型,路由调度算法更稳定,不会出现专家闲置/过载;按任务类型自动分配专属专家,代码、文档、图像任务各自匹配最优计算模块,算力利用率大幅提升。
配套开源底层基建:MoonEP通信库、FlashKDA算子、AgentEnv智能体沙箱,完整训练链路全部对外公开。
三、六大核心能力模块
1. 百万Token超长文档解析(标志性优势)
一次性导入百万字小说、技术手册、代码仓库、合同卷宗、学术论文:
- 全文逻辑梳理、摘要、问答、对比分析;
- 跨章节信息检索,精准定位任意细节;
- 支持PDF、Word、TXT、代码工程文件批量上传。
2. 行业顶尖代码/智能体编程(全球开源第一梯队)
- 登顶国际前端代码盲测榜Frontend Code Arena,首个夺冠国产开源模型;
- 完整读取数万行大型代码库,定位BUG、重构架构、写单元测试;
- 原生Agent智能体能力:自动调用工具、联网检索、循环调试、多步骤完成复杂开发任务;
- 支持全栈语言:Python/JS/Java/C++/Go/前端框架、数据库脚本。
3. 原生图文多模态理解
同时上传多张截图、图纸、PPT、手写笔记、工程图纸:
- 图片文字OCR识别、图表数据分析;
- 图文联合推理:结合图片内容+超长文档做综合分析;
- 支持复杂流程图、数学公式、代码截图解读。
4. 深度长程逻辑推理
适合科研文献推导、法律合同校验、商业方案推演、数学建模;
支持长链条多步骤思考,自动输出完整推理过程,降低事实幻觉。
5. 工具调用与结构化输出
内置通用工具(检索、计算器、文件读写),支持自定义外部API;
可强制输出JSON/Markdown/表格/思维导图等标准化结构化内容,适配自动化开发流程。
6. 本地私有化部署能力
权重完全开放,兼容vLLM、SGLang、TokenSpeed主流推理引擎,企业可本地离线部署,数据不出内网,满足隐私合规需求。
四、开源授权与使用渠道
1. 开源协议
采用修改版MIT许可证:
- 个人、企业均可免费下载、修改、本地部署、商用;
- 无商用分成、无强制共享二次修改后的模型;
- 禁止克隆模型本身作为竞品直接售卖。
2. 三种使用途径
- 在线网页/App(Kimi客户端)
直接在kimi.com、Kimi Work、Kimi Code网页调用K3,分会员梯度解锁百万上下文、智能体额度;日常用户零门槛试用。 - API接口调用
企业/开发者接入官方API,按量计费,支持并发批量任务,用于产品内嵌。 - 本地离线部署
Hugging Face下载完整1.56TB权重,自有显卡/服务器私有化部署,完全自主可控数据。
五、性能测评表现
- 开源模型维度:全面超越DeepSeek V4 Pro、Llama 3全系、国内所有开源大模型,代码、长文本、智能体三项拉开明显差距;
- 全球综合排名:Artificial Analysis智能指数全球第4,仅次于GPT-5.6 Sol、Claude Fable 5等顶级闭源模型;
- 官方客观短板(不回避):
- 纯硬核数学、物理理论推导弱于头部闭源模型;
- 极端场景事实幻觉概率高于Claude系列;
- 单次推理首字延迟偏高,短对话响应速度不如小参数轻量模型;
- 输出文本篇幅普遍偏长,简洁生成能力有待优化。
六、适用人群与落地场景
1. 程序员/开发团队
读取大型代码仓库、全栈项目开发、自动化测试脚本、AI智能体工具链搭建。
2. 科研/法务/金融从业者
百万字论文文献研读、合同风险逐条校验、财报海量数据复盘、行业报告生成。
3. 企业政企知识库
企业内部文档库、规章手册、历史卷宗统一检索问答,私有化部署保障数据安全。
4. AI开发者/模型研究者
基于开源权重二次微调、MoE架构研究、超长上下文算法实验、自有AI产品底层底座。
5. 自媒体/知识工作者
长篇书稿整理、网课课件解析、多图文素材综合创作、批量文案生成。
七、核心优势总结
- 全球唯一3万亿参数开放权重模型,打破闭源巨头算力壁垒,行业标志性事件;
- 稀疏MoE架构平衡超大容量与推理成本,2.8万亿参数却无需超高端硬件才能运行;
- 百万级上下文+原生图文+顶尖代码三位一体,垂直长文档/编程场景碾压所有开源竞品;
- 全套技术栈开源:权重、训练报告、底层通信/算子、智能体沙箱完整放出,无技术黑盒;
- 商用友好授权,免费可商用、支持离线私有化,企业隐私可控;
- 国产自研,中文语义、国内行业文档适配远优于海外开源模型(Llama系列)。
八、现存短板
- 本地部署硬件门槛高:完整权重1.56TB,需多卡高端GPU集群才能流畅推理;
- 短对话、日常闲聊轻量化体验不如小参数专用对话模型;
- 高精纯数理、前沿基础科学推理不及GPT、Claude旗舰闭源模型;
- 推理速度一般,实时低延迟交互场景不占优势;
- 多模态仅支持图像理解,无文生图、视频生成能力,专注文本推理赛道。
九、标准使用流程
- 在线使用:打开Kimi官网,会员切换模型为K3,上传文档/图片直接对话;
- API开发:注册开发者平台,获取密钥,调用Kimi K3接口批量处理任务;
- 本地部署:Hugging Face下载完整权重,搭配vLLM推理引擎,服务器加载后离线私有化调用;
- 二次微调:基于开源权重导入自有行业数据集,微调打造垂直领域专用模型。
数据统计
数据评估
本站灵境网提供的Kimi K3都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由灵境网实际控制,在2026年7月28日 下午11:42收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,灵境网不承担任何责任。