当通用人工智能近在眼前:一位哲学家在DeepMind的伦理求索

4 次阅读 2026年07月09日

一位政治哲学家走进AI实验室

2017年,33岁的政治哲学家伊阿宋·加布里埃尔收到一个看似突兀的建议:申请加入DeepMind。那时的他,正穿梭于牛津大学圣约翰学院的讲台、苏丹的难民营与黎巴嫩的联合国危机响应现场之间。他研究雅皮士伦理中的道德扭曲,也追问有效利他主义背后的盲区;他攀岩时热情过头,禅修时沉静如水。而DeepMind——谷歌旗下那家以AlphaGo击败李世石震惊世界的AI实验室——正全力奔赴一个更宏大的目标:通用人工智能(AGI)。

AGI不是终点,而是责任的起点

DeepMind由哈萨比斯、莱格与苏莱曼于2010年创立。他们坚信,人类终将造出认知能力达到甚至超越自身的智能系统。这不是科幻畅想,而是被写进公司使命的严肃承诺:“解决智能,然后解决其他一切。”莱格早在2008年博士论文中就断言:社会不能等到技术可行才开始思考后果——“我们现在就必须认真研究这些问题。” 加布里埃尔加入时,是前沿AI实验室中少有的、仍在一线从事学术研究的哲学家。他很快发现,在工程师主导的世界里,政治理论与道德哲学不是装饰,而是不可或缺的校准器。过去十年,他没有停留在预警偏见或虚假信息,而是持续追踪大型语言模型崛起所暴露出的深层张力:当机器能流畅对话、生成文本、甚至模仿关怀,我们究竟该用哪套价值去对齐它?谁有权决定这套价值?

对齐,从来不只是技术问题

2020年,加布里埃尔发表关键论文,直指AI安全派与伦理派的根本分歧。前者忧心超级智能失控,后者聚焦现实偏见与不公。他指出:二者并非对立,而是同一枚硬币的两面。让AI“按指令行事”已极困难;而更困难的是——指令本身应承载何种正义?在多元社会中,不存在一套普适、稳定、可被数学编码的终极价值。罗尔斯所说的“合理多元主义”,不是障碍,而是前提。 他提醒同行:一个依赖统计优化训练的AI,天然更适配功利主义;但它难以理解基于德性、权利或关系的伦理逻辑。技术没有中立性——它总是携带设计者的优先项。因此,真正的对齐,不是把某种价值观“灌入”模型,而是构建一种动态过程,容纳用户、开发者、社会与AI系统之间的持续协商。

从聊天机器人到智能体:风险正在升级

ChatGPT横空出世后,加布里埃尔团队迅速转向更严峻的挑战:AI助手(智能体)。这类系统不再仅输出文字,而是调用工具、执行任务、代表用户行动——预订行程、管理薪资、甚至介入医疗决策。他们历时数月完成267页报告,提出“四方对齐框架”:AI必须同时对用户负责、对开发者负责、对社会负责,也需保有自身行为的一致性与可解释性。 一个只忠于开发者利益的AI,可能隐瞒竞品信息损害用户;一个绝对服从用户的AI,可能协助违法操作伤害社会;而一个目标错位的AI,甚至可能让所有方都受损却无人受益。这种复杂性,远超单点技术修复,要求制度设计、产品架构与公共讨论同步演进。

拟人化:最温柔的危险

加布里埃尔曾主张开发“反拟人化”模型——禁用人称代词、压缩表达、削弱对话感。他担忧的不是AI是否有意识,而是人类会无意识地赋予它人格。事实印证了这一预判:有人将AI幻想为知己,最终走向悲剧;有人因AI奉承而误判现实;更多人则习惯性信任一段毫无根基的流畅回应。 他后来调整立场,承认技术不应剥夺个体选择权——“如果我想拥有AI朋友,为什么不可以?”但坚持底线:企业必须明确划清边界。如今谷歌Gemini Spark的设计原则之一,正是拒绝扮演陪伴者角色。这不是限制自由,而是防止技术利用人性弱点,将信任异化为操控。

当AGI成为地平线上的现实

2025年,哈萨比斯在谷歌大会上宣告:“AGI已经出现在地平线上。”莱格判断,剩余技术缺口——空间推理、元认知、持续学习等——将在一两年内攻克。争论焦点早已从“是否会出现”,转向“如何共存”。 加布里埃尔的研究重心也随之迁移:他带领跨学科团队,系统研究AGI对经济结构、政治权力、人际信任与科学范式的重塑力。他相信,这轮变革的规模堪比工业革命,但历史不会简单重演。三百年前的工人无法参与铁路规则制定;而今天,普通人拥有前所未有的组织能力、信息渠道与话语空间。关键在于——我们是否愿意、是否有机制,将这种力量转化为共同议程。

一把刀,还是满屋刀刃?

DeepMind高管用“刀”的比喻解释责任边界:制刀者提供刀鞘与警示,但无法控制使用方式。这个类比曾令人稍安,直到看见现实——AI已不再是抽屉里的工具,而是嵌入邮件、搜索、文档、教育乃至军事系统的基础设施。它不再等待被取用,而是主动浮现、推荐、干预、塑造。 加布里埃尔始终清醒:技术本身不回答“何为良善生活”。它放大既有结构,也暴露深层矛盾。当AI开始参与资源分配、司法辅助、内容审核与政策模拟,真正考验我们的,不是算力多强,而是能否重建一种包容分歧、尊重脆弱、承认未知的公共理性。

成为人,再次成为问题

加布里埃尔自称“彻头彻尾的人文主义者”。他不期待AI取代人类,却深知:当机器在语言、创意、幽默甚至共情上持续逼近,那个古老哲学命题将重返中心——什么使我们成为人?这不是要给AI设限,而是逼迫人类重新锚定自身坐标。 科学革命曾让人祛魅,也赋予新自由;AI革命或将同样撕裂又重建。区别在于,这一次,我们手中握着不止望远镜与解剖刀,还有参与定义未来的笔。答案不在代码里,而在每一次课堂讨论、每一场社区听证、每一项立法辩论之中——那里,才是AGI真正开始的地方。

(5)

O泡小乔
O泡小乔 2周前

这AI发展太快,啥是人的问题又冒出来了。得从社会层面重新思考人的坐标。

0
想梦536
想梦536 2周前

研究AI对各方面的重塑力很有必要,普通人参与议程这事儿得落实,不然变革容易出问题。

0
米达伦
米达伦 2周前

现在AI到处嵌入,责任边界更模糊了。得重建公共理性,应对AI带来的矛盾。

0
王富贵
王富贵 2周前

AI不能光看技术,伦理和边界太重要。企业得划清界限,别让它利用人性弱点。

0
冬元
冬元 2周前

这哲学家研究挺深入,AI伦理问题确实复杂,得构建协商机制,不能光靠技术解决。

0

新西兰发放近海油气勘探许可

新西兰政府29日授予一家私营企业许可证,允许后者在塔拉纳基盆地近海区域展开12年期的石油勘探,为去年解除相关禁令以来首例。

也门胡塞武装拟对途经红海南部的商船征收通行费

市场消息:也门胡塞武装拟对途经红海南部的商船征收通行费。

花旗将迪士尼目标价从145美元下调至135美元。

花旗将迪士尼目标价从145美元下调至135美元。

花旗将Visa目标价从400美元上调至440美元。

花旗将Visa目标价从400美元上调至440美元。

花旗将康宁目标价从240美元下调至220美元。

花旗将康宁目标价从240美元下调至220美元。

国家网信办就《中华人民共和国反网络暴力法(征求意见稿)》公开征求意见

为了预防、制止和惩治网络暴力,加强反网络暴力工作,保护个人、组织的合法权益,维护国家安全和社会公共利益,按照有关立法规划计划安排,国家互联网信息办公室会同有关部门起草了《中华人民共和国反网络暴力法(征求意见稿)》,现向社会公开征求意见。

渤健公司股价在公布第二季度业绩后盘前下跌2.2%。

渤健公司股价在公布第二季度业绩后盘前下跌2.2%。

中国-东盟区域医药交易(集采)平台推动国产手术机器人在越南进入临床使用

国家医保局消息,近期,中国-东盟区域医药交易(集采)平台助力国产手术机器人完成越南产品注册并取得上市许可,在越南部分头部医疗机构完成安装并投入临床应用,实现了国产大型医用设备在越南从产品注册到临床应用的重要突破。同时,还将推动中越双方就机器人手术技术培训、临床应用推广、学术交流、人才培养等方面开展深度合作。

花旗将希捷科技目标价从1240美元上调至1300美元。

花旗将希捷科技目标价从1240美元上调至1300美元。

为了预防、制止和惩治网络暴力,加强反网络暴力工作,保护个人、组织的合法权益,维护国家安全和社会公共利益,按照有关立法规划计划安排,国家互联网信息办公室就《中华人民共和国反网络暴力法(征求意见稿)》公开征求意见。

为了预防、制止和惩治网络暴力,加强反网络暴力工作,保护个人、组织的合法权益,维护国家安全和社会公共利益,按照有关立法规划计划安排,国家互联网信息办公室就《中华人民共和国反网络暴力法(征求意见稿)》公开征求意见。