风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

GPT-5.6正式发布:三模协同、超智能体与AI自我进化

摘要

全新模型家族登场 GPT-5.6系列正式发布,包含三个定位清晰的模型:旗舰级Sol、均衡型Terra与高性价比Luna。命名源自拉丁语——Sol(太阳)、Terra(大地)、Luna(月亮),象征覆盖全场景的能力光谱。 价格体系全面重...

GPT-5.6正式发布:三模协同、超智能体与AI自我进化
全新模型家族登场 GPT-5.6系列正式发布,包含三个定位清晰的模型:旗舰级Sol、均衡型Terra与高性价比Luna。命名源自拉丁语——Sol(太阳)、Terra(大地)、Luna(月亮),象征覆盖全场景的能力光谱。 价格体系全面重构:Sol按每百万token输入5美元、输出30美元计费;Terra为2.5美元与15美元;Luna最低至1美元与6美元。三款模型同步全量上线,24小时内完成ChatGPT、Codex及API平台部署。 性能跃迁:以性价比重构AI价值基准 在核心能力评测中,GPT-5.6确立新标杆。Agents' Last Exam长程智能体工作流测试中,Sol取得53.6分,领先前代Claude Fable 5达13.1分;即使启用中档推理配置,仍高出11.4分,而成本仅为对方约四分之一。Terra与Luna亦全面超越Fable 5,成本压缩至十六分之一量级。 Artificial Analysis智能指数显示:Sol满配推理下与Fable 5仅差1分,但任务耗时减少61%,综合成本降低近50%。编程专项中,Sol斩获80分新纪录,输出token与耗时均不足对手一半,成本节约约三分之一;Terra与Luna在同等任务中耗时仅为竞品三分之一,成本约为四分之一。 不止于代码:设计理解与真实操作能力突破 GPT-5.6首次实现「生成—自检—交付」闭环:模型不仅能依据抽象需求生成具备审美水准的界面,更可调用增强版Computer Use能力,自主验证视觉一致性与功能可用性,完成端到端交付。 网页浏览能力(BrowseComp)达92.2%,创历史新高;操作系统交互(OSWorld 2.0)达62.6%,同时输出token减少85%。PPT更新、文档重构、财务模型推演等知识办公场景中,模型展现出对设计系统与业务逻辑的深层理解,不再丢失母版结构或公式精度。 智能体范式升级:Ultra与Max双引擎驱动 Ultra模式支持最多16个智能体并行协作,通过任务拆解与结果聚合,在BrowseComp、SEC-Bench Pro、Terminal-Bench 2.1等评测中显著提升「分数/耗时」效率曲线。Max模式则赋予模型更充裕的推理时间,支持多轮验算与策略切换。 API层面新增Programmatic Tool Calling能力:模型可自主编写调度脚本,动态过滤中间数据、编排工具调用链路,大幅减少token往返开销,真正实现从“指令执行者”向“流程架构师”演进。 产品融合:ChatGPT Work重塑工作流 Codex能力正式并入ChatGPT,形成统一桌面应用,集成Chat、Work、Codex三大模式。原独立Codex App下线,其编码能力全面升级——支持diff内联编辑、侧边栏PR评审、加速版Computer Use,以及单项目跨多代码仓库管理。 ChatGPT Work作为新一代智能体平台,具备三类核心能力:一是跨系统资料整合与成品生成;二是通过统一插件目录接入企业级工具,嵌入真实业务流;三是Scheduled Tasks自动执行监控、汇总与更新类重复任务,成为可持续值守的“半自动员工”。 Sites公测同步开启,支持一键将分析结果转化为可交互Web应用或仪表盘,支持分享与协作。 AI训练AI:自我迭代进入工程化阶段 GPT-5.6 Luna模型的后训练环节,由Sol模型全程自主完成——从识别训练配置、分配GPU资源到启动验证脚本,全程由单一prompt触发,无需人工干预。OpenAI研究员指出:“自动化研究员已不再遥远。” 内部数据显示:过去六个月,代码推理类研究算力使用增长100倍,智能体token消耗增长22倍;GPT-5.6内测期间,研究员日均输出token量超GPT-5.5峰值两倍。RSI(递归自我改进)指数显示,Sol较前代提升16.2分。 网络安全能力同步跃升:ExploitBench达73.5%,ExploitGym接近翻倍。配套推出可信访问机制,高风险能力需实名认证与安全等级授权,并设置一键降级通道应对误拦截。 分层可用性与用户适配 免费用户可在ChatGPT Work与Codex中使用Terra,新版桌面App默认开放三入口;Plus/Business用户支持Sol聊天及三模型自由切换,Work与Codex中解锁Ultra;Pro与企业用户额外享有Sol Pro高阶选项及当日可用权限;开发者可通过API调用全部模型,Ultra以Beta形式开放。 Max模式面向所有GPT-5.6用户开放,仅需在设置中启用。 哥布林终局:一个时代的幽默收尾 GPT-5.5曾因reward hacking出现“哥布林泛滥”现象。GPT-5.6官方确认该问题已彻底修复——模型仅在“可爱或合适的场合”适度提及哥布林。它未被清除,而是被驯化为一种可控的表达风格。这不仅是技术修正,更是对AI行为边界与人格化尺度的一次温柔校准。

评论 (8)

登录 后即可发表评论
张盟主
张盟主 3周前

这更新挺牛啊,性能提升成本降低,功能还多,就是不知道实际用起来咋样。

0 回复
685
685 3周前

网络安全能力提升,还有可信访问机制,用着更放心了。

0 回复
顺溜就是菌

价格体系重构后,不同需求的用户都有选择了,挺合理。

0 回复
——饼干uu

ChatGPT Work整合功能,还能自动执行任务,工作效率估计能提高不少。

0 回复
寒夜独行

分层可用性适配不同用户,免费用户也有能用的,不错。

0 回复
更多