Kimi K3:月之暗面(Moonshot AI)开源的2.8万亿参数旗舰大模型

AI新闻 dotaai
65

一、Kimi K3是什么

Kimi K3是国内AI企业月之暗面(Moonshot AI) 于2026年7月16日在世界人工智能大会前夕发布的新一代旗舰混合专家(MoE)大语言模型,7月17日全渠道正式上线使用,完整模型权重计划2026年7月27日开源发布,采用MIT开源协议。

该模型总参数规模达2.8万亿,是全球首个开源3万亿级别大模型,同时为当前开源领域参数规模天花板,综合能力全球第三,仅次于GPT-5.6 Sol、Claude Fable 5两款闭源旗舰;在前端代码、长文档推理、自主Agent、图文多模态细分赛道实现反超同级闭源模型,主打超长上下文、长周期工程开发、复杂深度推理场景。

Kimi K3

二、功能特色

1. 百万级超长上下文记忆

原生支持100万Token上下文窗口,单次可完整加载约750页PDF、百万字书籍、完整代码仓库、多份合同卷宗,全程不丢失前置信息,跨文档、跨章节关联溯源检索,解决传统大模型长文本遗忘、断逻辑痛点。

2. 全球顶尖长程编程能力

Frontend Code Arena前端开发盲测榜单登顶,超越海外闭源旗舰;可一次性读取百万行大型工程代码,自主完成前后端、游戏、芯片设计、科学计算代码全流程开发调试;支持联动终端、截图视觉反馈,持续数小时迭代完整项目,适配团队级软件工程需求。

3. 原生图文多模态理解

内置视觉编码器,无需额外插件,直接上传图片、截图、设计图、短视频帧素材,结合文本指令完成图纸解析、UI迭代、数据分析可视化、脚本剪辑;图文代码联动闭环处理,看图写代码、根据界面截图修复BUG。

4. 48小时长效自主Agent智能体

支持长时间无人值守自主任务,可连续数十小时自动完成文献调研、数据整理、文档撰写、批量文件处理、工具调用自动化流程,无需分段重复输入指令,适配科研、金融、法务批量工作。

5. 轻量化稀疏推理,降低使用成本

采用896专家稀疏激活架构,单次推理仅启用16个专家模块,有效活跃参数约32B;搭配Mooncake分离式推理架构,编程场景缓存命中率超90%,大幅减少算力消耗与API调用费用。

6. 全端多平台统一适配

覆盖网页、移动端App、桌面客户端、专属编程工具、开放API五大渠道,个人免费试用、会员进阶解锁、企业私有化部署三种使用模式全覆盖。

三、技术细节

3.1 核心基础参数表

技术项目 官方参数规格
总模型参数 2.8万亿 MoE混合专家架构
专家模块配置 896个专家,单次推理激活16个
原生上下文窗口 100万 Token
核心注意力架构 KDA(Kimi Delta Attention)混合线性注意力+Attention Residuals注意力残差
模态支持 文本输入输出、原生图像/短视频帧输入理解
推理优化架构 Mooncake分离式推理
相对上一代K2提升 整体扩展效率提升2.5倍,百万序列解码速度提升6.3倍
开源时间 2026年7月27日完整权重开源(MIT协议)
默认思考强度 Max极致模式,后续开放Low/High档位

3.2 核心自研技术解析

  1. KDA混合线性注意力:解决传统Transformer注意力长文本算力爆炸问题,百万Token场景下解码速度大幅提升,长序列信息传递无衰减。

  2. 注意力残差AttnRes:强化深层模型信息留存,大幅缓解超长文本上下文遗忘,跨段落、跨文件逻辑连贯性显著增强。

  3. Stable LatentMoE稀疏专家框架:超大参数下保持低推理开销,兼顾模型知识容量与实时响应速度,平衡性能与成本。

  4. Mooncake分离式推理:缓存复用机制降低重复内容算力消耗,高频编程、文档场景API成本降低75%以上。

四、应用场景

  1. 程序员/软件开发:大型前后端项目重构、游戏引擎开发、芯片Verilog代码设计、批量接口调试、前端页面可视化开发、代码仓库全量审计。

  2. 科研学术:批量中英文文献研读、实验数据仿真、论文撰写与参考文献溯源、复杂数学/物理数值计算、科研报告自动化生成。

  3. 法律金融行业:百万字合同比对、财报批量解析、卷宗证据关联检索、投融资尽调材料梳理、风险条款识别。

  4. 设计媒体行业:UI设计图解析、短视频脚本创作、素材图文联动剪辑、数据图表自动生成、营销方案可视化策划。

  5. 企业办公运营:企业知识库搭建、超长会议纪要整理、跨部门项目全流程自动化Agent、批量公文撰写、海量客户资料分类汇总。

  6. 私有化部署场景:政企本地知识库、行业垂直AI系统、离线代码审计平台、内部自主智能工作流。

Kimi-K3

五、使用方法

(一)个人网页端(免费/会员通用)

  1. 打开官方网站kimi.com,手机号注册登录账号;

  2. 对话页面顶部模型切换栏,选择「Kimi K3」;

  3. 直接粘贴文本、上传PDF/图片/截图,输入指令发起对话;

  4. 权限区分:免费账号限制上下文长度,Moderato 99元/月解锁256K上下文,Allegretto 199元及以上会员完整开放100万Token窗口。

(二)移动端&桌面客户端

  1. 手机应用商店下载最新版Kimi App(iOS/Android双端),登录后默认可选K3模型;

  2. 电脑端安装Kimi Work桌面客户端,支持多文件分栏、长文档看板、持续Agent后台运行;

  3. 专业开发者安装Kimi Code工具,内置终端联动、代码快照视觉调试功能。

(三)开发者API调用

  1. 进入Kimi开放平台,创建应用获取API Key;

  2. 请求模型参数填写model: kimi-k3

  3. 计费标准(每百万Token):缓存命中输入2元、未命中输入20元、输出100元;

  4. 适配Python、Java、JS等主流开发语言,支持批量流式输出、长文本分片上传。

(四)本地私有化部署(开源后)

2026年7月27日后下载完整模型权重,基于MIT协议自由修改、本地部署,无需调用官方云端API,适合企业离线数据处理场景,需配套高性能GPU算力集群。

六、竞品对比

选取行业标杆GPT-5.6 Sol、Claude Fable 5、开源头部DeepSeek V4 Pro与Kimi K3横向对比:

对比维度 Kimi K3 GPT-5.6 Sol Claude Fable 5 DeepSeek V4 Pro
参数规模 2.8万亿(MoE,开源) 闭源,未公开完整参数 闭源,未公开完整参数 1.6万亿(MoE,开源)
上下文上限 100万Token 200万Token 100万Token 128K Token
开源属性 2026.7.27完整权重开源 完全闭源,不开放权重 完全闭源 已开源完整权重
前端代码能力 全球第一 第二梯队 第二 第三梯队
原生多模态 图文原生支持 图文视频完整多模态 仅图文支持 基础图文理解
自主Agent长时效 48小时长效任务 短时任务为主 短时任务为主 单段短流程Agent
API输出单价 约14美元/百万Token 30美元/百万Token 50美元/百万Token 低于Kimi K3
核心短板 简单短句响应速度一般 私有化部署门槛极高、价格昂贵 无开源权重,长代码性能偏弱 超长文档推理弱于K3

Kimi K3代码测评对比图

七、常见问题解答(FAQ)

Q:Kimi K3普通用户可以免费使用吗?

A:可以免费调用,但免费账号会限制单次上下文长度,无法解锁完整100万Token窗口;付费会员按档位开放对应超长文本权限,7月27日开源后技术用户可本地免费部署完整模型。

Q:Kimi K3和上一代K2最大区别是什么?

A:核心三点升级:参数从1万亿提升至2.8万亿,上下文上限扩充至100万Token;自研KDA注意力架构大幅提升长文本效率;原生强化视觉多模态与长周期编程Agent,整体模型扩展效率提升2.5倍。

Q:Kimi K3开源后个人电脑能本地运行吗?

A:普通家用PC无法完整加载2.8万亿参数权重,本地部署需要多卡高端GPU算力集群;个人开发者可使用稀疏轻量化蒸馏版本,或直接调用官方云端API降低硬件门槛。

Q:为什么Kimi K3简单短句回答速度偏慢?

A:模型默认开启Max极致思考强度,架构针对百万字长复杂任务深度推理优化,对简短日常问答无速度优化;官方后续更新会推出Low轻量化思考档位,提升短句响应效率。

Q:API调用缓存命中/未命中区别是什么?

A:重复提问、重复上传相同文档会触发缓存命中,输入单价仅2元/百万Token;全新无重复内容为未命中缓存,单价20元/百万Token;代码开发场景重复代码片段多,缓存命中率可达90%以上。

Q:Kimi K3是否支持视频直接解析?

A:原生支持视频帧截图上传解析,暂不支持完整视频流直接导入;可截取关键画面分批上传,完成视频脚本、镜头逻辑分析。

Q:开源协议MIT代表什么,企业可以商用吗?

A:MIT协议宽松无限制,企业可自由下载、修改、二次分发、商业化私有化部署,无需公开自有业务代码,无版权捆绑约束。

八、相关链接

  1. Kimi官方网页端使用入口:https://kimi.com

  2. 月之暗面Moonshot AI官方官网:https://moonshotai.com

  3. 开源权重下载仓库(7月27日开放):https://github.com/MoonshotAI/Kimi-K3

九、总结

Kimi K3作为月之暗面推出的2.8万亿参数开源旗舰大模型,凭借自研KDA注意力稀疏MoE架构实现超长上下文、顶尖编程、长效自主Agent与原生图文多模态四大核心优势,在保持全球开源参数规模第一的同时,细分专业场景性能对标海外顶级闭源模型,兼顾云端多端轻量化使用与企业离线私有化部署双重需求,凭借开源策略与亲民API定价降低了高性能超大模型的使用门槛,覆盖个人办公、软件开发、科研、政企行业全场景智能需求,是国产开源大模型对标国际一线AI产品的代表性基座模型。

打赏
THE END
作者头像
dotaai
正在和我的聊天机器人谈恋爱,它很会捧场。