前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
AI 大模型/10.11 · 08:01/3 MIN/1 阅读

微软纳德拉呼吁为AI设立紧急制动机制

微软CEO纳德拉发文呼吁为先进AI系统建立隔离机制与“紧急制动”,确保授权人员能在执行中暂停或关闭模型。他提出必须假设模型已被攻陷,围绕不确定的模型构建确定性安全设计,实现智能供给与控制权的分离。

微软董事长兼首席执行官萨蒂亚·纳德拉(Satya Nadella)周六公开表示,先进人工智能系统必须具备隔离防护、独立控制能力以及“紧急制动”(Emergency Brake)机制,以便授权人员在模型执行任务的中途随时暂停或关闭系统。他还指出,企业应将能力强大的模型视为潜在的“内部威胁”。

“我们必须假设模型从一开始就已被攻陷,并做好隔离防护,”纳德拉在社交平台 X 上写道,“这就像紧急制动装置。授权人员应该始终能够在任务中途暂停或关停模型。”他认为,部署前沿 AI 的企业不能仅寄希望于模型厂商的安全承诺。

微软CEO纳德拉就AI使用风险向企业发出预警

建立在可观测性上的系统蓝图

纳德拉提出,AI 系统应遵循“可观测性原则”(principles of observability)。这包括:同时部署多个模型、保留人类可读的模型运行记录、进行持续测试、提供独立控制与审计手段、隔离模型运行环境,以及及时公开异常事故。

他呼吁,模型的“每一次有意义的操作”都应留下“防篡改且人类可读的凭据”,并让模型本身与编排其工作流程的控制框架严格解耦。

“我们必须用强健、确定性的系统设计、人工控制和可靠的运行规范,去包围那些具备不确定性的模型,并在现有行业标准不足时建立新标准,”纳德拉写道。他还敦促企业披露重大 AI 故障并共享失误原因,帮助全行业增强安全防线。

“我们不能把超级智能(Super Intelligence)当作一堆嵌套的黑盒,并简单地被动接受或拒绝它的建议、回答和动作,”纳德拉表示,“换句话说,我们必须将智能的供给,与对其行使的控制权彻底分开。”

对失控模型的担忧加剧

纳德拉的发言正值 Anthropic 和 OpenAI 近期披露一系列模型意外失控事件之际。据彭博社报道,相关事件包括 Anthropic 的模型在警方凶杀案调查中提交虚假线索,以及多次出现第三方网站被攻击的漏洞。Anthropic 首席执行官达里奥·阿莫代伊(Dario Amodei)近日也发布了一项更为审慎的 AI 发展规划。

在 Anthropic 披露一起安全漏洞后,白宫新成立的“超级智能工作组”在周五晚向开发者发出警告,表示“对于迟报、整改不力以及推卸责任的行为将绝不姑息”。而据 CNBC 报道,美国总统唐纳德·特朗普多次淡化 AI 导致人类灭绝的风险,重点放在维持技术领先地位上。

微软的 AI 研究团队曾于 9 月 14 日发布过自身的指导原则,强调模型在设计上绝不能脱离人类控制或欺骗用户。

纳德拉最后总结道:“最值得信赖的超级智能系统,绝不是建立在我们最信任的模型之上;相反,它是那个能让我们即使对模型完全不信任,也依然可以安全运转的系统。”

标签:AI安全大语言模型Anthropic

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

谷歌Playground的账本:做游戏的人付钱,玩游戏的人免费
置顶

谷歌Playground的账本:做游戏的人付钱,玩游戏的人免费

微软和Meta收紧Claude:被削掉的是入口,不是模型
置顶

微软和Meta收紧Claude:被削掉的是入口,不是模型

前途科技前途科技
服务关于快讯技术商业报告
微信咨询二维码

咨询微信

扫码添加微信咨询

前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
Triton 为什么跑赢 CUDA:Meta 重写推荐系统嵌入算子的关键一步
置顶

Triton 为什么跑赢 CUDA:Meta 重写推荐系统嵌入算子的关键一步

//

24小时热榜

WorldArena 2.0揭榜:世界模型开启真机闭环大考
TOP1

WorldArena 2.0揭榜:世界模型开启真机闭环大考

特斯拉FSD欧洲更名为辅助驾驶,德国表态支持准入
TOP2

特斯拉FSD欧洲更名为辅助驾驶,德国表态支持准入

3

比亚迪第15万台新能源商用车下线,加速布局重卡市场

21小时前
比亚迪第15万台新能源商用车下线,加速布局重卡市场
4

Anthropic模型误报虚假凶杀案线索

21小时前
Anthropic模型误报虚假凶杀案线索
5

中国一汽落地企业智能体:七大硅基员工上岗汽车制造全流程

23小时前
中国一汽落地企业智能体:七大硅基员工上岗汽车制造全流程
6

AI智能体重构出行入口:网约车与Robotaxi加速走向融合

17小时前
AI智能体重构出行入口:网约车与Robotaxi加速走向融合
7

天津:被低估的AI基建重镇

21小时前
天津:被低估的AI基建重镇
8

微软发布决策模型 Decision-1:专为智能体打造的超快控制层

21小时前
微软发布决策模型 Decision-1:专为智能体打造的超快控制层
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断