风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

AI竞争进入飞轮时代:谁掌控真实工作流,谁就握有复利引擎

摘要

战线转移:从聊天框到工位 7月,AI竞争的核心战场悄然位移——不再比谁的模型参数更多、谁的推理更快,而是比谁能率先扎根于程序员的编辑器、嵌入办公人员的Excel表格与会议纪要之中。OpenAI发布新版ChatGPT桌面端,将...

AI竞争进入飞轮时代:谁掌控真实工作流,谁就握有复利引擎

战线转移:从聊天框到工位

7月,AI竞争的核心战场悄然位移——不再比谁的模型参数更多、谁的推理更快,而是比谁能率先扎根于程序员的编辑器、嵌入办公人员的Excel表格与会议纪要之中。OpenAI发布新版ChatGPT桌面端,将Codex整合为「Chat」与「Work」之间的中间标签;这一看似微调的产品结构,实则是战略重心的明确迁移:AI正从对话入口,全面进驻真实工作流的两大高价值场景——编码与办公。

Coding与办公:不是功能扩展,而是飞轮起点

Anthropic的Claude Code并非凭空崛起。它在SWE-bench上取得93.9%的修复率,靠的不是单次生成能力,而是持续接入真实GitHub仓库、直面历史Bug的实战打磨。程序员用它改代码、审PR、调试CI流水线——每一次接受、撤回或手动重写,都构成一条高信噪比的反馈信号。同样,Claude Cowork切入表格分析、文档协同与流程审批,任务链更长、交互点更密,一次季度报表生成可能触发十余次修正行为。这些动作本身不发声,却比任何测评榜单更真实地标注出模型的盲区与进化路径。

数据飞轮:比金矿更稀缺的是“错题本”

公开语料正在枯竭,互联网留下的多是成品而非过程。一段正确代码不会记录删掉的七版错误尝试,一份终稿报告不会保留被废弃的五版开头。而真实工作流恰恰保存了这些“失败痕迹”:光标停顿的位置、反复撤销的操作、中途切换工具的时机、用户最终手动补全的字段……这些行为数据,才是训练下一代模型最硬核的原料。谁先建成稳定采集、精准归因、安全脱敏的反馈闭环,谁就启动了一台自我加速的机器——更好产品吸引真实用户,真实用户产生强反馈,强反馈驱动模型升级,升级后的模型再承接更复杂任务。这不是线性增长,而是指数级复利积累。

Harness:飞轮真正的轴承

模型能力≠产品能力。再强大的大模型,若缺乏一套能拆解任务、调度工具、验证结果、归因失败并沉淀经验的系统,就无法在真实场景中可靠运转。这套系统,业内称之为Harness。它不改变模型权重,却能显著提升任务成功率;它不直接参与训练,却为下一代模型生成评测题与强化学习样本。Anthropic的领先,不仅在于Claude模型本身,更在于其Harness已在开发者工作流中迭代两年——它懂得如何把一次编译失败、一次公式报错、一次邮件发送中断,转化为可学习的结构化经验。Harness的成熟度,已成为比模型参数更难逾越的护城河。

反向驱动:产品先行,模型跟上

腾讯的WorkBuddy提供了另一条路径:2026年初,其自研模型尚无明显优势,但CodeBuddy已深度嵌入内部研发流程;以此为基础孵化出的WorkBuddy,率先在2000多名非技术员工中灰度验证。三个月后PC端月活破885万,日活跃居国内同类第一。真实任务倒逼模型进化——Hy3训练过程中,WorkBuddy暴露出的指令遵循偏差、工具调用失误与长程记忆衰减等问题,直接成为混元模型的优化靶点。授权脱敏后的反馈进入后训练,新模型再回归WorkBuddy执行更长流程。首响提速54%,任务成功率从72%升至90%,飞轮咬合,循环加速。

殊途同归:所有巨头都在抢同一张入场券

马斯克斥资600亿美元收购Cursor,并非押注编辑器本身,而是截取开发者键盘敲击的每一毫秒行为数据;阿里力推Qoder、字节上线Trae,本质都是在构建自己的Coding Harness;Meta以四分之一价格开放模型API,目标明确——让更多Agent跑起来,让每一次点击、犹豫与撤回,都成为自家模型的养料。路径各异,终点一致:抢占高价值工作流入口,建立可持续反馈的数据管道。当竞争从模型榜单下沉到每个人的桌面,胜负手不再是某次技术突破,而是能否让AI在千万次真实任务中,持续学会“怎么把事情做对”。

复利即壁垒

模型可以追赶,算力可以堆叠,但一个在真实工作流中滚动三年的飞轮,无法被复制。它由产品信任、用户习惯、行为密度与Harness精度共同铸成。未来AI公司的估值逻辑或将重构:不再只看参数量或推理速度,而是看其Harness覆盖了多少真实任务节点,看其错题本里沉淀了多少未被公开的“人类修改轨迹”。这场战争的终极奖赏,不是最快的那个模型,而是最懂怎么和人一起把活干完的那个系统。

评论 (6)

登录 后即可发表评论
念远
念远 1周前

这AI竞争逻辑很清晰啊,谁掌握工作流数据谁就有优势,那些巨头抢入口就是为这。

0 回复
顾念
顾念 1周前

Harness就是关键,即便模型强,没这系统也没法在实际场景用。

0 回复
嘿嘿
嘿嘿 1周前

腾讯这路子挺聪明,产品先上,用实际任务倒逼模型进步,效果明显。

0 回复
Mr张
Mr张 1周前

数据飞轮太重要了,有‘错题本’能让模型不断进化,后来者很难追。

0 回复
哈姆波特

巨头们凑一块抢高价值工作流入口,胜负得看能不能让AI把事做对。

0 回复
更多