风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

房租交得越久,越想有一套自己的房子:中国大模型公司的造芯逻辑

摘要

2013年那道算术题,今天在中国重演 2013年,谷歌工程师算了一道看似简单的题:如果每位用户每天使用3分钟语音搜索,全球数据中心需要扩大多少?答案是翻倍。靠采购英伟达显卡硬扛,账单足以压垮公司。于是谷歌选择了...

房租交得越久,越想有一套自己的房子:中国大模型公司的造芯逻辑
2013年那道算术题,今天在中国重演 2013年,谷歌工程师算了一道看似简单的题:如果每位用户每天使用3分钟语音搜索,全球数据中心需要扩大多少?答案是翻倍。靠采购英伟达显卡硬扛,账单足以压垮公司。于是谷歌选择了一条当时被视作激进的路——自研芯片。那颗后来命名为TPU的芯片,不是技术炫技,而是成本生存战的必然解法。 十三年后,同一道题摆在了中国头部大模型公司面前。推理——即模型真正服务用户、持续耗电烧钱的过程——正成为AI商业化的最大成本黑洞。训练是一次性投入,推理是永不停歇的租金。谁在付这笔长期账单,谁就真正掌控着模型时代的命脉。 DeepSeek:从囤卡开始的生存预演 DeepSeek的造芯动作,并非突发奇想。创始人梁文锋出身量化基金,早于大模型热潮便以系统性囤积高端GPU闻名。他很早就意识到:真正的瓶颈不在资金,而在芯片获取权。2023至2024年,他两次公开强调出口禁令才是核心制约。 行动紧随判断。R1模型先在英伟达H800上完成训练,随即转向华为昇腾平台;工程团队提前定义UE8M0 FP8数据格式——这不是通用标准,而是为尚未流片的下一代国产芯片硬件特性量身设计的接口协议。今年6月,公司完成首轮融资,约510亿元人民币,明确将资金用于扩建国产算力中心与自研AI芯片。所有芯片岗位招聘均未公开挂网,全部通过定向渠道推进。 值得注意的是,其芯片定位清晰:仅面向推理,不覆盖训练。因为推理才是日复一日、随用户增长而指数级膨胀的成本主体。它要回答的,是一个最朴素的问题:每服务一个用户,究竟花多少钱? 智谱:用上市敲钟换来一张算力欠条 智谱的选择路径不同,但目标一致。作为“大模型第一股”,它在港股上市后市值一度破万亿港元,但财报同样刺眼:2024年亏损29.58亿元,2025年上半年再亏23.58亿元,一年半烧掉53亿。 GLM-5海外爆火后,流量涌入带来的第一反应不是扩容,而是涨价——Coding套餐提价30%起;第二反应是发布「算力合伙人」招募令,主动向本土芯片设计公司发出合作邀约。这不是技术谦逊,而是现实倒逼:一家年推理支出以十亿计的公司,无法承受单一供应链风险,更不敢把长期成本结构押注于任何一家供应商。 它的策略是“模型定义需求,厂商交付能力”:智谱提供架构规范与性能目标,由国内芯片设计公司完成工程实现。这条路更快落地、更低门槛,也更契合当前产业链协作现状。 依赖华为,也不等于信任华为 路透社一句关键表述耐人寻味:DeepSeek造芯,是为了减少对英伟达的依赖,以及对华为的依赖。 前半句已是共识——在出口管制下,英伟达在中国数据中心市场已近乎清零;后半句才是深层信号。过去两年,“国产替代”几乎等同于“全面适配昇腾”。DeepSeek V4系列完成昇腾适配,华为亦确认参与部分训练;智谱GLM架构则兼容40余款国产芯片,海光、摩尔线程、沐曦在新模型发布当日集体宣布完成适配。 拥抱越深,越清醒:当推理账单按年数十亿计算,任何单一供应商都构成战略脆弱点。昇腾解决了“有没有”的生存底线,而自研芯片瞄准的是“听谁的”这一权力命题。国产替代进入第五年,行业正悄然分层——从“能用”,走向“可控”,再迈向“主导”。 这不是技术竞赛,是成本主权争夺战 放眼全球,模型公司自研推理芯片已是头部标配。OpenAI联合博通推出Jalapeño芯片;Anthropic正评估同类方案;谷歌、亚马逊、微软早已各自拥有定制化AI加速器。它们共享同一逻辑:推理规模越大,越需要摆脱通用硬件溢价,建立专属成本曲线。 对中国芯片产业链而言,这是双面机遇。正面看,模型公司的定制订单带来真实营收与技术牵引,尤其利好高带宽内存等配套环节;反面看,今天的客户,正在培养明天的竞争对手。谷歌当年也是芯片厂商的大客户,最终成了TPU的所有者。 但牌局才刚开始。一颗有竞争力的AI芯片,动辄数年周期、数十亿投入,失败案例比比皆是——Meta曾推倒重来整个自研计划。更微妙的是,芯片设计赌的是模型架构趋于收敛,而DeepSeek与智谱的新模型刚引入稀疏注意力等前沿机制。今天送出去的流片图纸,两年后量产时,可能已跟不上架构迭代节奏。 结语:房租逻辑从未改变 2013年,谷歌的答案是TPU;2026年,中国公司的解题刚刚落笔。出题人换了,但底层逻辑没变:训练是买房,推理是交租;租得越久,越想拥有自己的房子。这不是要不要造芯的问题,而是——当租金成为最大经营变量,谁还甘心只做租客?

评论 (7)

登录 后即可发表评论
不正常人类研究中心

这和租房买房一个道理,一直交租不如自己买套房子,大模型公司造芯就是为了掌握成本主权,早该这么干了

0 回复
墨懂小学生

对芯片产业链是机遇也是挑战,订单能带来收益和技术提升,但客户可能变成对手,这牌局有看头

0 回复
压百鬼
压百鬼 3周前

造芯投入大、周期长,失败案例不少,Meta都折戟过,中国公司得谨慎,别盲目跟风

0 回复
红尘颠倒

DeepSeek和智谱做法不同,但目标一样,都是为了降低推理成本,摆脱对供应商的依赖,方向没错

0 回复
A落月
A落月 3周前

国产替代到了新阶段,从能用走向可控、主导,不过自研芯片风险大,不一定能成功

0 回复
更多