工具介绍


一、Kimi K3是什么?
Kimi K3是月之暗面(Moonshot AI)2026年7月推出全球首款2.8万亿参数开源原生多模态MoE大模型,开源仓库地址:https://github.com/MoonshotAI/Kimi-K3,同步开放完整模型权重、技术报告、配套训练基建代码,采用专属Kimi K3开源协议,支持学术研究、本地部署与商用二次开发(商用需单独签约)。
二、核心架构与硬件参数
1. 架构体系
自研KDA(Kimi Delta Attention)+ AttnRes注意力残差机制,搭配Stable LatentMoE稀疏混合专家框架;总计896个专家,单次推理仅激活16个,相比K2版本整体扩展效率提升2.5倍。
2. 核心硬件规格
- 总参:2.8T,单次激活有效参数104B
- 层数:93层(69层KDA+24层门控MLA)
- 上下文窗口:1048576(100万token)超长上下文
- 词表:160K;激活函数SiTU-GLU
- 原生视觉模块MoonViT-V2,视觉编码器401M参数
- 量化方案:MXFP4权重 + MXFP8激活,全程量化感知训练
- 模态原生支持:纯文本、图像、视频一体化输入,无后拼接对齐
三、四大核心能力
1. 超长复杂编程智能体
可独立完成大型代码仓库迭代、GPU内核编译、CAD/芯片设计、游戏视觉开发,支持终端工具链式调用,DeepSWE、SWE-Marathon、前端编程榜单表现顶尖,前端Arena榜单得分超越GPT、Claude闭源模型。
2. 端到端专业知识智能体
自动完成深度行业研究、交互式数据图表、报表仪表盘、动态视频剪辑,适配投研、财务、法律、办公全专业场景,海量办公/金融/法律基准评测表现优异。
3. 百万Token超长上下文
一次性载入整本手册、完整代码库、百万字研报,支持长对话完整推理记忆,多轮对话必须携带完整reasoning_content推理过程保证逻辑连贯。
4. 原生多模态理解
原生图文视频融合,支持文档OCR、图表数学推理、视频字幕解析,MMMU、MathVision、OmniDoc等多模态基准成绩突出。
四、评测基准核心表现
覆盖推理、代码、智能体、多模态四大类数十项权威榜单:
1. 逻辑推理
GPQA Diamond 93.5分,接近头部闭源模型;
2. 代码赛道
ProgramBench、Terminal-Bench、前端编程榜单开源第一,部分SWE工程测试超越GPT-5.6;
3. Agent智能体
网页检索、企业财报、法律文书、自动化办公任务综合实力顶尖,MCPMark工具基准94.5分;
4. 多模态
文档识别OmniDoc 91.1,数学视觉MathVision最高97.8,长视频理解稳定。
整体综合能力仅次于Claude Fable 5、GPT-5.6 Sol,为开源模型第一梯队。
五、调用与使用规范
1. 推理配置
内置思考链reasoning_content,提供low/high/max三档推理强度,默认max模式;多轮对话必须完整回传模型推理内容,否则丢失上下文逻辑。
2. API接入
官方平台 https://platform.kimi.ai 提供兼容OpenAI/Anthropic格式API,模型标识kimi-k3;
3. 推荐推理引擎
vLLM、SGLang、TokenSpeed,配套官方部署教程;
4. 配套工具
专属Kimi Code CLI编程智能体框架,适配代码工程全流程任务。
六、部署、开源与授权
1. 开源内容
GitHub仓库包含权重说明、完整技术报告k3_tech_report.pdf、训练基建MoonEP/FlashKDA/AgentEnv源码;
2. 量化优势
MXFP4大幅降低显存占用,适配昇腾、英伟达多硬件生态,多家推理平台上线Day0适配;
3. 授权规则
Kimi K3自定义开源许可,学术/个人免费商用,企业大规模商业化需联系官方support@moonshot.ai签约;
4. 联系方式
技术与商用咨询邮箱 support@moonshot.ai。
七、产品定位与优势总结
Kimi K3是面向长代码、深度行业研究、复杂多模态智能体场景的旗舰开源大模型,核心差异化:
核心差异化优势
- 2.8T超大稀疏MoE架构,百万原生上下文;
- 原生图文视频多模态一体化,无需外挂视觉模型;
- 编程、专业办公、行业智能体能力开源天花板;
- 完整开源权重+训练底层技术,支持企业私有化、本地集群部署;
已知短板
综合全域能力略低于GPT、顶级Claude闭源模型,超大集群部署硬件门槛较高。
AITOP100作为华强方特(深圳)动漫有限公司倾力打造的AI数智化聚合营销平台,同时也作为全网最全AI大赛活动举办和收录平台以及国内AI头部社区之一,平台已收录超700场AI视频、绘画、写作、算法等大赛。更有AI工具、资讯、教程、大咖直播。承办线上线下活动。快来参与或合作!
官网:https://www.aitop100.cn
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:


评论
全部评论

暂无评论
热门推荐
相关推荐

dots.llm1
dots.llm1是小红书Hi Lab研发的1420亿参数专家混合模型(MoE),采用稀疏激活架构,推理时仅激活140亿参数。这一设计在保持高性能的同时,大幅降低了训练和推理成本。模型支持中英双语,上下文长度达32,768个token,适用于语义理解、知识问答、代码生成等多场景任务.
Sonic-3
Sonic-3是美国生成式AI公司Cartesia推出的第三代实时文本转语音(Real-time TTS)模型。它基于自研的State-Space序列架构,在保持极低保真延迟最低90ms的同时,首次在公开API中实现了情绪标签驱动的笑声、呼吸、停顿与多情感强度控制,被业内称为会笑会喊的大语言模型。
SongGeneration
SongGeneration是腾讯AI Lab正式推出并开源的一款音乐生成大模型。它旨在解决音乐生成领域中普遍存在的音质、音乐性和生成速度等三大难题,通过先进的技术架构和算法,实现高质量音乐作品的自动创作。
F-Lite
F-Lite是一款基于扩散变换器架构的文本到图像生成模型,由Black Forest Labs开发并于2025年最高1024x1024图像,并具备开源特性,适用于正式登陆Hugging Face平台。该模型以10亿参数的轻量化设计,实现了高效、低成本的图像生成能力,支持通过自然语言提示生成高分辨率
Marey Realism
Marey Realism由洛杉矶初创公司Moonvalley与AI动画工作室Asteria联合开发,其命名致敬电影运动分析先驱Étienne-Jules Marey。作为全球首款完全基于授权数据训练的企业级AI视频模型,Marey的核心定位是“辅助而非取代专业创作者”,
LLaMA-Factory Online
LLaMA-Factory Online是与明星开源项目LLaMA-Factory官方合作精心打造的在线大模型训练与微调服务平台。这个平台专为那些有微调需求,但工程能力不太强的用户群体量身定制,提供开箱即用、低代码、全链路功能覆盖的大模型训练与微调服务。
Grok Code Fast1
Grok Code Fast 1是埃隆·马斯克旗下xAI公司在2025年8月29日推出的一款颠覆AI编程领域的模型。这款以“速度”为核心竞争力的模型,凭借每秒190 token的极速响应、256K超长上下文窗口以及极具侵略性的定价策略,在发布后迅速引爆开发者社区。
紫东太初大模型
紫东太初大模型是由中国科学院自动化研究所与武汉人工智能研究院联合研发,是全球领先的跨模态通用人工智能平台,也是一个千亿参数级别的多模态大模型,它能够实现文本、图像、音频、视频、传感信号和3D点云等多种数据模态的统一表示和互相生成。
0
0






