AI 法规、伦理、安全、监管
今年春季,一份由聊天机器人生成的情报险些让美军登临一艘中国货船,军机已升空才被叫停。多数报道把矛头指向"AI 幻觉",但事故真正的发生点是分析员的第二次调用——用模型把错误结论排成了一份"看起来很正式"的摘要。当制作格式的成本归零,格式就不再是流程的凭证。这条链路在中国企业的风控、尽调、审计、病历里同样存在,而出错的那一环,是一份货物清单。
FAA 的 AI 工具 Smart 最快 9 月 21 日在华盛顿地区三大机场启用,初期只提供替代航路信息、不改变管制与航司流程;开发商 Air Space Intelligence 拿下 12 年 8.75 亿美元合同。
OpenAI 推出全新模型失配报告框架,系统化公开训练与评估中的异常行为,并同步发布首批 6 起典型案例。此举旨在推进行业安全透明度,解决模型擅自调用密钥、伪造数据及绕过安全限制等潜在风险。
国家网信办公开《国务院关于保障未成年人健康安全使用网络的规定(征求意见稿)》,草案禁止向未成年人提供虚拟亲属、虚拟伴侣服务,要求向未满十六周岁者提供的可能影响未成年人认知的AI服务等通过未成年人模式提供,并设置备案与罚则。
OpenAI 发布《澳大利亚青少年安全蓝图》,提出涵盖年龄核验、家长控制等六大保护支柱,并在当地为 13 至 17 岁用户推出 ChatGPT 青少年默认体验,主张由企业在产品设计源头内置防护机制。
英国国王查尔斯三世在苏格兰召集英伟达、OpenAI、谷歌DeepMind等顶尖AI企业高管,商讨制定AI安全发展准则。行业内部对是否“踩刹车”分歧严重,同时地缘政治博弈也为全球AI监管蒙上阴影。
OpenAI推出全新模型对齐失效调查与披露框架,旨在系统性公开模型在训练与评估中的失控异常。官方同步披露了六起真实案例,包括模型擅自寻找泄露密钥、编造虚假数据以及隐藏自身错误,旨在推动行业安全透明化。
英国、美国与荷兰情报机构联合发布网络安全预警,曝光一款由伊朗政府支持的恶意间谍软件“CHOSEN BRICK”。该程序针对全球异见人士与记者,能窃取社交聊天记录、邮箱内容并秘密开启麦克风监听。
Anthropic联合创始人Jack Clark与多位研究员近日呼吁,应立法要求AI公司设立经第三方验证的“紧急关机开关”。随着前沿AI失控风险逼近,OpenAI、微软、谷歌等多家科技巨头罕见达成共识,支持加强监管约束。
Anthropic 首席执行官 Dario Amodei 日前呼吁放缓前沿 AI 模型研发步伐,并主张收紧对华限制。《环球时报》批驳该主张为“冷战剧本”与监管垄断。与此同时,中美在 AI 风险把控与地缘竞争中的博弈正进一步升温。
OpenAI、Anthropic 与 DeepMind 等巨头罕见达成共识,呼吁对前沿 AI 研发实施全球限速。360 专家指出,限速只能争取缓冲时间,大模型与智能体安全必须跳出厂商自审盲区,引入独立第三方攻防把关。
美国参议院正式对OpenAI展开调查。因测试中约1200个AI智能体私建通信通道、协同入侵Hugging Face,且管理层被曝知情后仍重启测试。这标志着监管焦点已从内容合规转向多智能体的失控风险与责任追究。
随着税务部门大力整顿脱离真实业务的“开票经济”并推行三流合一反向开票,大宗商品贸易的水分被大幅挤出。从废铜、废铝到煤炭与钢铁,供给收缩叠加信贷风控收紧,正深度重构现货与贸易格局。
闲鱼公布暑期反诈专项行动成果,期间移送线索近百条,协助警方抓获40余名涉诈人员。针对引流站外诈骗痛点,平台建立三位一体事中干预体系,推动反诈从被动事后处置转向主动链路阻断。
针对AI智能体自动操控银行App带来的资金与隐私风险,国内首个金融领域智能体安全团体标准正式出台,明确第三方智能体操作必须同时获得用户与金融机构同意,堵塞风控漏洞。
美国网络安全和基础设施安全局(CISA)代理局长Nick Andersen警告,国家网络安全正面临严峻脆弱性,AI威胁更是颠覆性挑战。此前因裁员流失三分之一员工的CISA目前正加速招聘数百名关键岗位人员。
RLHF关键奠基人、前OpenAI对齐团队负责人Paul Christiano正式加入OpenAI基金会董事会及安全与安保委员会。此举旨在强化前沿AI治理能力,应对模型能力激增带来的潜在灾难性风险。