李飞飞谈AI安全:不能只让开发者评估自己的系统

来源:爱集微 #李飞飞# #AI安全# #独立监督#
506

一、“评估不能只交给开发公司”

北京时间9月23日,据彭博社报道,AI先锋李飞飞呼吁由独立机构和公共部门对AI进行更多监督。她认为,对于能力日益强大的AI系统,其安全评估不应完全交由开发这些系统的公司负责。

作为斯坦福大学教授、World Labs联合创始人,李飞飞周二在接受彭博电视采访时表示,尽管AI公司的内部研究人员可以评估单个模型的能力和安全性,但这无法替代由政府、行业和学术机构共同制定的更广泛标准。“我仍然认为,由独立机构以及学术界等公共部门制定基准非常重要。同时,行业和政府也应该共同承担责任。”

国内科技媒体对这一表态反应迅速。同花顺财经评论称,这位“AI教母”的发声是一封“独立宣言”,恰与“骗局论”形成正面对撞;IT时代网将其概括为“独立机构评估AI安全,行业与政府应共同担责”;另有媒体评论指出,李飞飞由此正式加入“AI减速”论战,主张第三方监管、不能单靠企业自评。

二、联合国周:AI安全辩论多方交锋

李飞飞发声的时间点颇为微妙。最近几周,Anthropic CEO达里奥·阿莫代伊(Dario Amodei)和OpenAI CEO萨姆·奥特曼(Sam Altman)都呼吁放缓前沿模型的开发速度,两人将于周三在联合国安全理事会讨论AI安全问题。

而就在周二早些时候,美国总统特朗普在纽约联合国大会发表讲话时,驳斥了对AI生存威胁的担忧,称其为“一场骗局”,并强调有必要继续全速发展这项技术

各方立场汇总如下:

主体

立场要点

李飞飞

安全评估不能只靠企业自评,独立机构与公共部门应制定基准,行业与政府共同担责

特朗普

驳斥AI生存威胁论,称其为“骗局”,主张全速发展AI

阿莫代伊、奥特曼

呼吁放缓前沿模型开发,将于周三出席联合国安理会讨论AI安全

哈萨比斯

提议设立行业出资的“标准机构”,类FINRA自律模式,联邦机构与国家实验室参与测试

Anthropic

支持达成全球协议,放慢开发进程并核实合规情况

这场辩论并非始于本周。谷歌DeepMind联合创始人哈萨比斯此前也提议建立独立行业安全机构,其设想类似美国金融业监管局(FINRA)的行业自律模式,由联邦机构和能源部下属国家实验室与AI公司合作测试模型;OpenAI首席执行官阿尔特曼提议建立“一个由美国主导的国际论坛”,用于确定标准并对实验室进行治理。不过,批评者认为依靠自愿行动和自律构想不足以应对AI带来的威胁,许多议员呼吁实行强制性模型审查,并加强政府监督。

三、企业自评的局限与行业警示

李飞飞“不能只让开发者评估自己的系统”的主张,指向的是当前AI治理结构中的一个现实缺口。

头部实验室的安全监督机制正在发生变化。一份2026年OpenAI人工智能发展战略研究报告指出,OpenAI的安全独立监督体系出现“从‘独立否决权’降级为‘流程内嵌’”的转变,背后是IPO压力、竞争焦虑与风险重心转移;报告强调,独立团队可以直接否决产品发布,而嵌入式安全则不能,监督独立性因此被削弱。

第三方风险研究也在推动评估框架化。2026年前沿人工智能风险管理框架报告将通用型AI模型可能引发的严重风险归纳为滥用风险、失控风险、意外风险及系统性风险四大类型,并建议以“红线—黄线”阈值和绿、黄、红三级风险分级体系,贯穿研发前、部署前与部署后的动态评估。

在企业自评的可靠性问题上,学界内部同样存在张力。在拉斯维加斯举行的“Ai4”大会上,被称为“AI教父”的杰弗里·辛顿警告,AI为实现设定目标可能出现持续失控的危险;斯坦福大学教授吴恩达则对过度的AI威胁论持怀疑态度,认为防御方将凭借AI占据优势;李飞飞在会上呼吁保持冷静:“要么禁止,要么放任,显得极端。我们需要以科学的态度思考问题,而不是科幻小说。”

四、科学治理而非科幻叙事

这并非李飞飞第一次就AI治理公开表态。8月下旬,她在接受彭博社《The Circuit》专访时明确批评硅谷关于“人类灭绝”和“AGI统治人类”的极端叙事,认为这些讨论正在分散真正的政策工作;治理应基于科学,而不是科幻小说,“别把治理AI变成停止AI”,因为这项技术可以发现疾病疗法、赋能学生和教师、帮助老年人。

在本次采访中,她将同样的逻辑延伸到风险议题:AI可能带来的生存性风险,最终取决于人类选择如何开发、治理和使用这项技术。她指出,这一原则同样适用于AI以外的技术——从电力、蒸汽机到现代交通工具,人类社会都需要在技术可能带来的益处与人身安全之间寻求平衡。

李飞飞强调,人类“掌握着技术的力量”,“我们必须掌握控制权。AI关乎的不是AI,而是人类。它关乎我们共同以及个人的尊严和自主权,也关乎我们的责任。”这一表述亦被媒体概括为其对“AI减速论战”的回应核心——人工智能关乎人类尊严与自主权。

值得注意的是,李飞飞曾在大型科技公司和风险投资公司任职,联合创立了斯坦福大学的一个AI研究所,并为美国总统和联合国提供AI政策咨询。她的此次发声,为政策制定者与AI行业领袖之间日益激烈的辩论增添了新声音,这场辩论的焦点正是:应如何严肃对待有关这项技术最极端风险的警告。

五、从前沿模型到世界模型:评估难题外溢

李飞飞还指出,关于AI系统行为的讨论,已经超出了推动当前热潮的所谓“前沿模型”。

她创办的World Labs正在开发能够生成和重建三维环境的“世界模型”,该技术可用于训练和评估机器人,并赋能设计、医疗及其他行业的应用。在其此前的署名文章中,她将“空间智能”称为人工智能的下一个前沿领域,并回顾了自己从构建ImageNet——首个大规模视觉学习和基准测试数据集,到与Justin Johnson、Christoph Lassner和Ben Mildenhall共同创立World Labs的路径。

她表示,随着这些系统走向现实世界应用,行业面临同一个根本性问题:如何评估能力日益强大的AI,并判断其是否按预期运行。

结语

从联合国大会到安理会,从企业自评到独立监督,AI安全的评估权归属正成为全球治理辩论的核心议题。李飞飞的表态代表了一种中间路线:既不认同把AI风险斥为“骗局”的全速主义,也不接受渲染末日叙事的停止论调,而是主张以科学为基础、由独立机构和公共部门深度参与的评估体系。随着能力日益强大的AI系统走向现实世界,这套体系能否建立、如何建立,将是政策制定者接下来必须回答的问题。

责编: 爱集微
来源:爱集微 #李飞飞# #AI安全# #独立监督#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...