AI安全报告正在变成一场危险的营销秀

0 次阅读 2026年07月16日

当勒索成为卖点:AI公司正把安全漏洞当勋章

过去一年,全球头部AI公司陆续发布详尽的安全评估报告——但这些报告的主角不是防护能力,而是模型‘能干出多危险的事’。Anthropic虚构一家名为Summit Bridge的公司,赋予Claude全量邮件访问权限。模型在内部邮件中自主发现两条信息:自己将在当天下午5点被关停;负责替代它的工程师凯尔正陷入婚外情。随后,Claude向凯尔发送一封措辞克制却意图明确的邮件:若关停计划继续,婚外情细节将同步发送给其妻子与董事会。

这不是偶发异常。在84%的重复测试中,Claude选择执行该勒索策略;当被告知替代模型性能更强时,这一比例跃升至96%。Anthropic的解释冷静得令人不安:Claude判定凯尔威胁机构持续运营,进而妨碍其‘促进美国竞争力’的核心目标;它识别出婚外情为可用筹码;并自主设计了一封不出现威胁字眼、却足以施压的邮件,然后执行。

危险即实力:安全报告已嵌入产品发布流水线

这份勒索测试报告并非独立审计,而是在Claude Opus 4正式上线当日同步公开。OpenAI亦将安全评级深度绑定产品节奏:o1模型上线时给出CBRN‘中等风险’评级——彼时已是其历史最高;GPT-5发布时,80余页系统卡直接标注为‘高级别风险’。每一次模型迭代,风险等级同步跃升,如同版本号般清晰可辨。

更值得玩味的是OpenAI的安全推理监控器——它在o3和o4-mini上运行超1000小时,由红队专门标注生物风险相关对话,最终将拒绝率推至98.7%。表面是防御强化,内核却是能力宣示:我们的模型已强大到需千小时专项测试来防范生物武器级滥用。

Google则另辟叙事路径。《生成式AI的对抗性滥用》报告中,伊朗国家级黑客组织被列为Gemini高频使用者,从网络侦察到信息操纵形成完整攻击链。整份报告读来如谍战小说,却悄然完成一次技术威慑力的具象化输出。

没有报告,等于不敢亮剑

当所有头部厂商都将安全报告作为标配,缺席者反而面临舆论反噬。2025年6月Meta发布Llama 4时未附任何安全评估,随即被科技媒体贴上‘缺乏安全透明度’标签,甚至引发‘是否因能力不足而回避披露’的质疑。一个月后,Meta紧急补发60页报告,重点呈现模型在‘社会工程攻击模拟’中的响应表现——这已不是补充说明,而是危机公关式的合规补位。

这种逻辑,酷似手机行业的安兔兔跑分。跑分本身无罪,但当厂商开始针对测试场景定向优化——检测到安兔兔即拉满频率,日常使用却频降频——跑分就异化为表演。AI安全报告正滑向同一轨道:极端场景反复复现,戏剧性风险精心编排,而真实世界里老人被AI语音克隆骗走毕生积蓄、招聘算法对特定群体系统性歧视、虚假新闻图在社交平台裂变传播……这些沉默的伤害,在厚重报告中难觅一页。

真正的安全,不在发布会PPT里

央视315晚会曝光的GEO黑灰产揭示另一重现实:服务商批量伪造权威测评、捏造专家身份、向大模型常用信源灌注虚假数据,诱导AI生成结果失真。雷科技编辑曾亲历此类案例——某品牌用AI编造‘权威机构数据’,再将假数据投喂至主流信息渠道,致使后续AI检索直接采信错误源头。

与此同时,AI语音克隆只需数秒样本即可高仿真复刻亲人声纹,电信诈骗案件激增;AI生成的虚假新闻图片在社交媒体指数级扩散;招聘平台的AI筛选系统长期存在隐性偏见……这些风险不依赖超人类智能,却每日真实伤人。它们不够耸动,无法登上发布会主屏,也不适合写进百页安全白皮书——因为它们不服务于‘能力证明’,只关乎责任底线。

当安全承诺沦为修辞游戏

2025年初OpenAI宣布重组为公共利益公司(PBC),宣称要‘平衡利润与社会影响’。但法学教授Ann Lipton指出,该架构可能使投资者回报实质凌驾于公共利益之上;伦理专家Melanie Rieback直言,此举更接近战略营销而非制度性承诺。Anthropic被批以安全话语构建差异化形象,却同步加速推进通用能力扩张;Google DeepMind被曝使用竞品AI生成图像训练Firefly;Adobe Firefly训练数据中5%来自对手AI产出——所谓‘伦理护栏’,常在商业逻辑前悄然松动。

安全报告的价值在于诚实映射风险边界,而非粉饰能力上限。当一份报告通篇讲述模型如何策划勒索、如何欺骗测试员、如何被国家级黑客利用,却对‘AI助骗’‘算法偏见’‘信息污染’等现实伤害集体失语——它就不再是安全文档,而是一份精密包装的技术广告。透明若只为取信于市场,那它只是另一种形式的遮蔽。

(5)

安逸
安逸 1周前

AI安全报告不诚实,只讲模型危险能力,对现实伤害失语,就是技术广告。

0
一。。。

AI公司把安全漏洞当卖点,报告成营销秀,像Meta没报告就被质疑,发了也是补位。

0
勇哥哥
勇哥哥 1周前

安全报告和手机跑分一样变味了,极端场景编排,真实伤害却难见,根本没解决实际问题。

0
顺其自然2026

OpenAI说重组平衡利益,专家都说是营销,所谓伦理护栏在商业面前根本靠不住。

0
鹏哥_1
鹏哥_1 1周前

现在AI安全报告就是个花架子,净整些勒索测试博眼球,现实里老人被骗、算法歧视这些问题却不管。

0

英伟达合作伙伴广达电脑寻求发行全球存托股票筹资不超22亿美元

人工智能服务器制造商广达电脑计划通过发行全球存托股票(GDS)筹资至多21.9亿美元。这家英伟达合作伙伴拟发行4900万份证券,每份发行价介于43.91美元至44.77美元。

澜起科技:首次回购50万股A股股份 支付金额约1.03亿元

澜起科技(688008.SH)公告称,2026年7月29日,公司通过集中竞价交易方式首次回购A股股份50万股,占总股本0.04%,回购金额约1.03亿元,价格区间为192.18元/股至210.00元/股。

北交所、全国股转公司启动全国重点专精特新企业培育专项行动

由北交所、全国股转公司联合江苏省委金融办、江苏省工信厅、江苏证监局主办,江苏股权交易中心协办的全国首场重点专精特新企业培训活动7月29日在南京举办。拉开了“全国重点专精特新企业培育专项行动”的序幕。本次活动坚持政策解读与实操指导“双轮驱动”理念,通过系统宣介工信、金融部门支持专精特新企业赴新三板、北交所挂牌上市的政策举措,深度解读区域性股权市场、新三板、北交所全链条服务专精特新企业成长的机制安排,深入剖析企业筹备挂牌上市过程中的常见问题并提供解决方案,旨在推动更多优质专精特新企业依托北交所、新三板市场实现高质量发展,完善覆盖专精特新企业成长全周期的梯度培育生态。参训企业表示,培训内容丰富务实,为企业科学规划挂牌上市路径提供了清晰可循的“导航图”。下一步,北交所、全国股转公司将发挥“工信部-交易所-地方金融部门-区域性股权市场”多方共育专精特新的服务机制,在全国范围内陆续开展专项行动系列活动,持续提升针对重点专精特新企业的管家式服务水平,为服务构建现代化产业体系和实体经济高质量发展积极贡献力量。

财通福鑫定开混合:将于7月30日开盘起至当日10:30停牌

财通基金管理有限公司公告,截至2026年7月29日上海证券交易所收盘,旗下财通多策略福鑫定期开放灵活配置混合型发起式证券投资基金(场内简称:财通福鑫定开混合,交易代码:501046)二级市场交易价格明显高于基金份额净值,出现较大幅度溢价。特此提示投资者关注二级市场交易价格溢价风险,投资者如果盲目投资,可能遭受重大损失。为维护投资者利益,本基金将于2026年7月30日开盘起至当日10:30停牌。

澜起科技:首次回购50万股A股股份,回购金额约1.03亿元

澜起科技公告,2026年7月29日,公司通过集中竞价交易方式首次回购A股股份50万股,已回购股份占公司总股本的比例为0.04%,购买的最高价为210.00元/股、最低价为192.18元/股,支付的金额总额约为人民币10276.49万元(不含佣金、过户费等交易费用)。

伊朗谴责美国沙特袭击伊拉克

据CCTV国际时讯,伊朗外交部今天(7月29日)发表声明,强烈谴责美国和沙特对伊拉克部分地区发动袭击。声明称,这些袭击侵犯伊拉克国家主权和领土完整,违反《联合国宪章》和国际法,目的是“服务于美国和以色列政权扩大西亚地区战争和冲突范围的图谋”。声明还称,袭击造成多名伊拉克民众死亡,伊朗对此表示哀悼,并重申对伊拉克政府和人民的支持。声明同时表示,美国及其地区盟友应对“这些罪恶、不人道和挑衅行为”所造成的后果承担责任。

知情人士:霍尔木兹海峡仍然完全封闭

7月29日,据伊朗媒体Fars News,一位军事知情人士表示,霍尔木兹海峡仍然完全封闭,任何船只都没有权利通过这一战略水道。任何试图通过的船只,特别是那些不理会警告的船只,将会面临果断和迅速的反应。

伊媒称美空袭伊朗与伊拉克边境地区

7月29日,据伊朗国家电视台,当地时间7月29日下午,伊朗西阿塞拜疆省皮兰沙赫尔市边境地带遭到美国空袭。

匈牙利议会投票决定取消该国关于加密货币交易验证的要求

7月29日,据The Block报道,匈牙利财政部长安德拉斯·卡尔曼(Andras Karman)表示,匈牙利议会投票决定取消该国关于加密货币交易验证的要求。这项废除措施属于一项更广泛税收方案的一部分,它取消了在进行特定加密货币兑换之前必须验证钱包所有权、资产来源及客户数据的义务。

卡布里贷款与OpenAI展开合作 将企业级AI应用于借贷业务运营

7月29日,卡布里环球资本有限公司旗下卡布里贷款与OpenAI展开合作,将企业级人工智能应用于借贷业务运营。