风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

Kimi K3:一场关于规模、算力与路径的中国式突围

摘要

规模不是终点,而是新起点 Kimi K3以2.8万亿参数刷新开源模型纪录,未采用颠覆性新架构,却通过系统级整合——极稀疏MoE结构、低精度训练、大规模并行系统,以及KDA、AttnRes、Stable LatentMoE三大核心模块的协同,实...

Kimi K3:一场关于规模、算力与路径的中国式突围
规模不是终点,而是新起点 Kimi K3以2.8万亿参数刷新开源模型纪录,未采用颠覆性新架构,却通过系统级整合——极稀疏MoE结构、低精度训练、大规模并行系统,以及KDA、AttnRes、Stable LatentMoE三大核心模块的协同,实现了性能跃升。它没有打破Scaling Law,而是用工程与Infra能力证明:这条规律依然有效,但能否走通,取决于底层支撑是否扎实。模型越大,对功耗、通信、负载均衡与集群可靠性的挑战就越尖锐。Kimi能在该量级稳定训练与推理,本身已是基础设施能力的硬核体现。 算力,成了第一道真实考题 热度远超预期,用户涌入如潮,Kimi在7月19日发出暂停新用户接入的通知。这不是营销节奏调整,而是算力已触达物理极限的明确信号。存量算力必须优先保障现有用户,新增订阅被彻底冻结。这比Token限售更严峻——后者尚有弹性空间,前者意味着零冗余。一位接近团队的人士坦言:“找算力,现在是头号任务。” 国产算力,正从“能用”走向“够用+好用” 智谱宣布落地1GW纯国产算力的消息引发关注。按华为昇腾Atlas 950单机柜64卡、100KW功耗估算,1GW相当于约64万张NPU卡。即便按平均单价10万元计,这笔投入也超600亿元。数字背后,是国产AI芯片从实验室走向规模化交付的关键跃迁。WAIC展出的CloudMatrix 384到Atlas 950演进,不只是卡数翻倍,更是互联方式(铜缆+全光)、计算密度、训练与推理兼容能力的系统升级——它开始真正适配万亿参数时代的混合负载需求。 经济性,正在重新定义竞争维度 Artifacial Analysis评测显示,Kimi K3完成整套测试消耗1.3亿Token,总成本近2700美元,远高于同类模型中位数。单任务平均0.94美元,虽略低于GPT-5.6 Sol,但尚未形成显著成本优势。问题不在于“贵”,而在于“量效比”——单位算力产出的有效Token越多,单位Token的能耗与延迟越低,经济性才真正成立。英伟达H200上可能亏损的推理,在B300上或成印钞机;同样,国产卡若不能在NVFP4等新精度下实现吞吐与能效双突破,就难为大模型提供可持续托底。 路已铺就,钱在路上 Kimi并未止步于技术验证。C轮融资后现金超百亿,但半年内估值从43亿美元飙升至500亿美元,折射出市场对其路径的认可。拆VIE、赴港上市进程加速,目标成为港股“大模型第三股”。融资逻辑已悄然转变:不再单纯押注模型能力,而是信任其Infra整合能力、规模化落地潜力,以及与国产算力协同演进的确定性。当Qwen 3.8预览版紧随K3发布,一条可复制、可扩展的中国开源大模型成长范式,正在成型。 第二场芯片战争,刚刚打响 如果说上市是中国芯片的第一战,那么为国产大模型提供高性价比、高可靠性的算力底座,就是第二战。这场战争不靠PPT,靠实打实的交付密度、互联效率、精度支持与集群稳定性。它不只关乎一家公司成败,更决定整个开源生态能否摆脱“有模型、无算力”的困局,让SOTA真正具备商业纵深与产业穿透力。

评论 (10)

登录 后即可发表评论
乌拉拉叭

Kimi K3用系统整合提升性能,说明底层支撑很重要,算力是大问题,国产算力得加油跟上。

0 回复
高高哥
高高哥 1周前

Kimi融资和上市进展不错,市场认可其路径,中国开源大模型成长范式在成型。

0 回复
感恩一切

Kimi上市进程加快,市场看好其潜力,开源大模型发展有希望。

0 回复
小阳
小阳 1周前

芯片第二战开始了,得靠实际交付能力,不然开源生态摆脱不了困境。

0 回复
Fireman
Fireman 1周前

Kimi K3热度高但算力到极限,国产算力得赶紧提升,不然大模型发展受限。

0 回复
更多