风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

月之暗面黄震昕详解K3:底层创新、幻觉治理与商业化逻辑

摘要

首款近3万亿参数开源大模型正式落地 7月21日,月之暗面在北京办公区举行媒体交流活动。企业业务负责人黄震昕首次系统回应K3发布后的技术路径、能力边界与商业节奏。四天前,Kimi正式开源K3大模型——总参数量达2.8万亿...

月之暗面黄震昕详解K3:底层创新、幻觉治理与商业化逻辑
首款近3万亿参数开源大模型正式落地 7月21日,月之暗面在北京办公区举行媒体交流活动。企业业务负责人黄震昕首次系统回应K3发布后的技术路径、能力边界与商业节奏。四天前,Kimi正式开源K3大模型——总参数量达2.8万亿,支持100万Token上下文窗口,综合智能水平在多项基准测试中位列全球前三,仅次于Claude Fable 5与GPT-5.6 Sol。 三项自研技术驱动性能跃升 黄震昕明确指出,K3的突破并非单纯堆叠参数,而是源于底层架构的原创性重构。其核心包含三项自研技术: 第一是MoonClip二阶优化器,首次由Kimi投入大模型训练。该技术可在数据受限环境下显著提升训练效率——20T训练数据可达成40T等效效果,同等性能下训练成本与算力功耗直接减半。 第二是KimiLinearTension线性注意力机制,突破传统线性注意力在超长序列下的性能衰减瓶颈,使上下文窗口扩大十倍的同时,训练成本仅同步增长十倍。 第三是AttentionResiduals(注意力残差)结构,优化深层网络间的信息流动,在保障2.8万亿参数模型稳定训练的前提下,推理效率提升25%。 黄震昕将三者归纳为三大能力支柱:LongContext决定模型“能干多久”,TokenEfficiency决定模型“有多聪明”,AgentSwarm决定模型“如何协同”。所有技术创新均围绕这三点展开。 幻觉不是缺陷,而是创造力的伴生现象 面对媒体对AI幻觉的集中关切,黄震昕未回避问题本质。他提出:“幻觉与创造力同源。”更强的模型,幻觉比例反而更低;K3当前已是幻觉发生率显著低于行业均值的模型。 具体治理机制依托AgentSwarm架构:任务被拆解为多个子Agent并行执行,再由专职“事实校验员”子Agent逐项核验关键数据与结论。这一闭环设计大幅压缩错误传播空间。 但他也坦率表示,幻觉无法根除。“因为人也会犯错,也会‘幻觉’。模型的生成机制决定了它既具备推演能力,也天然携带不确定性。我们追求的不是零幻觉,而是可控、可追溯、可校验的智能输出。” 算力不是瓶颈,而是体验底线的刻度尺 K3上线后流量远超预期。7月19日晚,月之暗面主动暂停新会员注册。黄震昕解释:这不是临时运维动作,而是一次价值观选择——宁可暂缓新增收入,也要守住存量付费用户的响应速度、稳定性与服务连续性。 团队曾预设多级扩容预案,但实际并发请求峰值仍突破承载阈值。权衡之下,公司优先保障已付费用户的完整体验。“体验不是成本项,而是产品尊严的标尺。” 目前,团队正通过模型压缩、推理加速与算力资源协同调度双线推进优化,但重开注册时间尚未明确公布。 开源≠廉价,K3正在重定义中国模型的定价权 针对海外部分声音将开源等同于“减速主义”的论调,黄震昕回应:开源与闭源不是对立选项,更不等于低价策略。K3从设计之初就锚定SOTA水准,全球范围内供不应求,定价逻辑完全独立于“开源即便宜”的旧范式。 Kimi坚持K2以来的开源路线不变:所有核心架构、训练方法、关键技术论文全部公开。底层能力透明化,不是为了降低门槛,而是为了构建可验证、可演进、可协作的技术共识。 聚焦高价值场景,拒绝低维内卷 商业化层面,Kimi现阶段不提供私有化部署服务,API业务占整体收入约70%,客户以数据平台、金融基础设施、科研计算平台等高信任度、高复杂度场景为主。 截至6月中旬,公司ARR(年度经常性收入)突破3亿美元,三个月内连跨三个亿元台阶。黄震昕强调,Kimi的商业路径始终对标全球成熟AI企业的成长范式——先夯实基础模型能力,再延伸至垂直场景渗透。 产品审美上,团队长期聚焦编程、金融、法律、基础科研等高门槛生产力领域,主动避开娱乐化、文生图、文生视频等流量导向赛道。“大模型里1%的数据偏差,可能重塑整个模型的价值取向。我们所有技术决策,都服务于一种确定的、严肃的、面向真实世界问题的智能观。” 关于参数规模,黄震昕给出明确判断:“2.8万亿不是终点,而是新起点。大模型的参数天花板,仍将随硬件演进与算法突破持续抬升。”

评论 (5)

登录 后即可发表评论
闫焱
闫焱 1周前

算力问题处理得可以,为保老用户体验停新注册,没只盯着钱,这点值得肯定。

0 回复
正在加载中……

这模型技术挺厉害,自研技术提升性能,还重视用户体验,不过重开注册时间不定有点让人着急。

0 回复
Ccc。
Ccc。 1周前

K3参数这么高,技术创新多,开源还能定高价,这是要重新定义中国模型定价权啊。

0 回复
重庆系
重庆系 1周前

聚焦高价值场景不搞内卷,有长远规划,这商业路径挺清晰,看好后续发展。

0 回复
an安
an安 1周前

说幻觉无法根除有道理,人也会犯错嘛,治理机制能压缩错误传播就不错。

0 回复
更多