风险提示:理性看待区块链,提高风险意识!
USDT USDT $1.00 0.01%
XRP XRP $1.43310000 0.19%
BNB BNB $637.54000000 0.02%
USDC USDC $0.99963000 0.01%
SOL SOL $86.49000000 0.99%
TRX TRX $0.32360000 1.25%
BTC BTC $67,234.00 2.34%
ETH ETH $3,456.00 1.23%
CoinMeta Skill
限时免费体验

让 AI 更快获取有效、准确、可行动的币圈全景信息

OpenAI发布GPT-5.6系列模型:Sol/Terra/Luna三档协同,智能体能力跃升与成本重构

摘要

全新模型家族正式上线,定位清晰、梯度分明 OpenAI正式推出GPT-5.6系列大语言模型,包含三款差异化部署版本:旗舰级Sol、均衡型Terra与轻量高效型Luna。该系列即日起全面开放,支持ChatGPT、Codex及OpenAI API调用。...

OpenAI发布GPT-5.6系列模型:Sol/Terra/Luna三档协同,智能体能力跃升与成本重构
全新模型家族正式上线,定位清晰、梯度分明 OpenAI正式推出GPT-5.6系列大语言模型,包含三款差异化部署版本:旗舰级Sol、均衡型Terra与轻量高效型Luna。该系列即日起全面开放,支持ChatGPT、Codex及OpenAI API调用。定价策略体现明确的分层逻辑:Sol为每百万输入token 5美元、输出token 30美元;Terra对应2.50美元/15美元;Luna则低至1美元/6美元。三者并非简单缩放,而是在架构、调度机制与任务适配层面完成系统性重构,共同指向一个目标——在同等预算下完成更多高质量、高确定性的实际工作。 性能突破不靠堆料,而靠推理效率革命 GPT-5.6在多项权威基准中实现显著超越,但关键差异在于单位token产出价值。以Agents' Last Exam评测为例,Sol得分53.6,较Claude Fable 5高出13.1分;而其中等推理配置下的综合成本仅为Fable 5的约1/4。更值得注意的是,Terra与Luna在成本压缩至Fable 5约1/16的前提下,基准得分仍稳超前者。这标志着模型竞争已从“参数规模”转向“任务完成密度”——即单位计算资源所能交付的可验证成果数量。 ChatGPT Work:首个面向办公场景的系统级智能体 依托GPT-5.6全系列模型,OpenAI同步发布ChatGPT Work——一款真正脱离对话范式、具备跨应用执行能力的智能体产品。它不再仅响应提问,而是能主动理解用户授权范围内的文件、日历、邮件、CRM及协作工具上下文,并自主生成文档、表格、PPT乃至轻量Web应用。其核心支撑是统一插件目录(Unified Plugins Directory),原生集成Slack、Gmail、Google Drive等主流办公生态。这一演进意味着AI正从“助手”升级为“协作者”,其价值衡量标准也从响应速度转向任务闭环率与交付完整性。 多智能体协同架构:ultra模式开启新计算范式 GPT-5.6首次引入分层推理调度机制,除标准模式外,新增max与ultra两档深度计算选项。ultra模式默认协调四个并行智能体,在BrowseComp测试中以92.2%准确率刷新纪录;在OSWorld 2.0中达62.6%,且token消耗反比Claude Opus 4.8低85%。配套推出的Programmatic Tool Calling功能,允许模型在内存中编写并运行轻量程序,动态编排工具调用链,大幅减少往返延迟,同时严格遵循零数据留存(ZDR)原则。 垂直领域能力跃升:安全与生命科学双线突破 在网络安全方向,Sol于ExploitBench得分73.5%(前代为47.9%),六小时漏洞利用通过率由15.1%提升至33.7%;其防御侧能力同步增强,覆盖安全代码审查、漏洞修补与蓝队推演。OpenAI通过Daybreak可信访问计划,对经核实的安全研究者开放增强能力,并实施地理与实体风险分级管控。在生命科学领域,GeneBench Pro得分达28.7%(前代12%),LifeSciBench达59.9%(前代50.4%)。OpenAI明确表示,当前模型不具备端到端合成高危新型生物威胁的能力。 安全机制进化:从分类拦截到推理监控 GPT-5.6 Sol内置防护对潜在有害活动的拦截量较前代提升约10倍。其安全体系采用三层冗余设计:模型内嵌保护、实时推理监控器(reasoning monitor)与账户级执行控制协同运作。其中,推理监控器逐轮分析对话逻辑链,动态识别异常意图,无需重训即可快速修补漏洞。为平衡安全性与可用性,系统提供一键降级至低能力模型的重试通道,持续优化误拦率。 AI驱动AI:内部研发进入自加速周期 GPT-5.6本身即是AI自我增强的实证。内部数据显示:研究员日均输出token数达GPT-5.5历史峰值的2倍以上;编程类推理算力半年增长100倍;智能体相关token消耗增长22倍。在自我改进能力评测(RSI Index)中,Sol以57.9分领先前代16.2个百分点。这表明,AI辅助研发已从辅助工具阶段,迈入驱动模型迭代节奏的核心引擎阶段。 产品整合加速:从工具到平台的形态演进 伴随GPT-5.6发布,OpenAI推进多项产品线融合:Codex App正式并入ChatGPT桌面客户端,免费版全面开放;独立Atlas浏览器逐步停用,核心能力迁移至Chrome扩展;ChatGPT Work作为新智能体入口,承担起连接用户工作流与AI能力的系统角色。整个产品矩阵正从离散工具集,转向统一智能体操作系统。

评论 (8)

登录 后即可发表评论
涛歌雄风

安全机制改进明显,推理监控能快速补漏,还能平衡安全和可用性,这点不错。

0 回复
银屏山下

垂直领域能力提升大,安全和生命科学都有突破,就是希望生物威胁管控再严点。

0 回复
冯卡卡
冯卡卡 3周前

GPT - 5.6架构和调度重构,推理效率革命很厉害,模型竞争方向变了是好事。

0 回复
(๑•̌.•̑๑)ˀ̣ˀ̣

AI驱动研发自加速,这迭代速度以后估计更猛,不知道会带来啥新惊喜。

0 回复
时金
时金 3周前

产品整合是趋势,从工具到平台,OpenAI这是要打造统一生态啊。

0 回复
更多