风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

Kimi K3:2.8万亿参数开源大模型正式发布,聚焦长程任务与多模态交付能力

摘要

全球首个开源2.8万亿参数模型上线 Kimi正式发布Kimi K3,参数量达2.8万亿,为当前全球公开可获取的规模最大的开源大语言模型。该模型原生支持视觉理解能力,上下文窗口达1048576 token(即100万token),无需分块即...

Kimi K3:2.8万亿参数开源大模型正式发布,聚焦长程任务与多模态交付能力

全球首个开源2.8万亿参数模型上线

Kimi正式发布Kimi K3,参数量达2.8万亿,为当前全球公开可获取的规模最大的开源大语言模型。该模型原生支持视觉理解能力,上下文窗口达1048576 token(即100万token),无需分块即可处理超长文档、完整视频帧序列或大型代码库。

核心能力:从生成到执行的范式升级

Kimi K3不再局限于单轮响应式输出,而是强化了长程Agent式任务编排能力。它能将编程、视觉解析、工具调用与知识整合串联为端到端工作流。例如,在ASIC行业研究任务中,模型自主完成120余轮迭代,执行2800+次网页搜索与抓取、1100+次终端数据提取,处理87份季度财报与99份原始PDF,最终生成含定制图表、动画示意图及交互式叙事的完整研究报告。

多模态与代码生成实测表现突出

在Kimi K3 Max模式下,仅凭一段自然语言提示——‘制作一个单文件HTML的3D横版格斗游戏,场景为被霸天虎入侵的破败城市,含低多边形风格、卡通美学、武器后坐力效果及5类可选角色’——模型一次性生成可直接运行的完整页面,无语法错误,且自动补充射击/击打双模式交互逻辑。相比前代Kimi K2.6,其对空间结构、角色设定与环境细节的理解精度显著提升。 另一实测案例中,Kimi K3复现“达芬奇工坊”模拟器,不仅还原文艺复兴时期视觉风格,更融合扑翼机的历史背景、材料特性与空气动力学原理,体现跨领域知识调用与工程化表达能力。

编程与工程任务实现闭环交付

Kimi K3可独立构建GPU编程基础设施:开发出MiniTriton编译器原型,支持将高级语言程序编译为优化后的GPU内核,并在部分算子上达到或超越现有开源工具性能。在芯片设计场景中,模型基于开源EDA工具链与Nangate 45nm工艺库,在连续48小时无人干预的Agent运行中,完成芯片逻辑综合、物理实现与功能验证全流程。 此外,它能将科研论文中的数学方法自动转化为可执行Python代码,驱动实验仿真并生成分析图表;亦可依据原始素材自主剪辑品牌宣传视频,涵盖素材筛选、动作卡点、音频匹配与多轮迭代优化,效率较人工提升数倍。

知识工作进入可视化协同新阶段

依托Kimi Work平台,Kimi K3支持“小组件”与“看板”两类新型交互范式。小组件可在对话中即时生成可交互图表、动态表格或本地数据连接面板;看板则聚合多个小组件,形成面向项目周期的长期协作空间,支持状态追踪、版本对比与多人协同编辑。

架构升级支撑超大规模高效推理

Kimi K3采用两项关键架构创新:Kimi Delta Attention(KDA)与Attention Residuals(AttnRes),改善长序列信息流动稳定性。MoE稀疏度进一步提升,在896个专家中每次仅激活16个,结合Stable LatentMoE框架实现高吞吐低延迟。训练阶段全程启用量化感知策略,权重采用MXFP4、激活使用MXFP8,并向vLLM社区开源KDA推理适配模块,保障百万token上下文下的实际可用性。

能力边界与使用建议

由于模型在保留完整思维历史的模式下训练,若Agent框架未正确传递历史上下文,或用户在会话中混用不同模型,可能影响输出一致性。官方建议通过系统提示词或AGENTS.md明确行为边界,尤其在意图模糊时防止过度主动干预。当前版本在通用推理、深度文档分析与金融建模等任务中已超越GPT-5.5与Claude Opus 4.8,但在部分真实办公流程类评测中仍略逊于Claude Fable 5。

开源承诺与落地节奏

Kimi K3已全面开放使用,覆盖kimi.com官网、移动端App、Kimi API及Kimi Code编程助手。所有用户享有初始免费额度,用尽后按需付费。完整模型权重计划于7月27日前正式开源发布。

评论 (5)

登录 后即可发表评论
。
2周前

这模型参数这么大,能力看着挺强,能处理好多复杂任务,但在办公流程评测还差点,得再优化。

0 回复
狼叔小白

2.8万亿参数,全球最大开源,处理超长文档厉害,可惜在部分真实办公流程比不过Claude Fable 5

0 回复
开始吧
开始吧 2周前

能做游戏代码、复现模拟器,多模态和代码生成实测效果不错,就是使用得注意规则。

0 回复
齐公子
齐公子 2周前

可视化协同感觉是个亮点,用小组件和看板能多人一起干活,挺方便。

0 回复
石头519
石头519 2周前

模型开源免费额度挺好,不过要想持续用还得花钱,落地开放速度还挺快。

0 回复
更多