Concitech AI · 深度长文

2026/09/22 11:20

中美AI热线与两巨头互测:两条真新闻,零份生效协议

美国提出中美AI国家安全事件通报机制,OpenAI与Anthropic讨论商业模型交叉压力测试。两条消息存在可靠信源,公开材料的生效协议数量是零。

两条消息有可靠信源。推文给出的落地状态超过证据范围。

美国政府提出中美 AI 国家安全事件通报机制,提案等待两国领导人审议。OpenAI 与 Anthropic 的律师讨论一份交叉测试合同,签署证据与生效证据缺席。

准确表述是“两项提议”。“两项安排”属于夸大。

两条消息的确认信息与证据缺口

第一条:美国提出机制,“热线”缺少成立证据

路透社和美联社报道了美中财政与经贸官员的一场会谈。美国财政部长斯科特·贝森特称,美方提出一套 AI 安全通报机制。议题指向国家安全级别事件。

提案内容包含两项设想:美中 AI 对话,以及重大 AI 安全事件的双向通报。特朗普与习近平承担审议角色。

中方发布材料提到 AI 议题,细节清单缺少通报机制。中国外交部关于两国领导人会晤的通稿使用原则性表述,机制名称、启动日期和操作流程缺席。

五月会谈提出过 AI 磋商构想。正式论坛的形成证据缺席。九月提案延续该方向,制度状态是提议。

“中美将建 AI 安全预警热线”属于超前概括。可靠证据的支持范围是“美方提议”和“双方讨论”。“机制建成”的支持证据缺席。

“热线”的真实形态

原始英文表述是 notification mechanism,中文含义是通报机制。电话线路属于社交媒体转译。

一个可运行机制包含五类信息:事件门槛、联系机构、身份认证、信息格式和演练记录。现有报道的披露量是零。

通报对象有边界。贝森特划定的范围是国家安全级别事件。产品故障、模型越狱、军事误判和基础设施事故的入选状态未知。

提案形态接近 AI 版危机沟通接口。目标是降低误判概率。功能清单排除模型权重与情报来源共享。

国家通报与公司互测构成两类有限信任接口

第二条:合同讨论获得报道,签署证据缺席

《The Information》报道了 OpenAI 与 Anthropic 的合同谈判。彭博法律新闻转述了核心信息,信源是一位匿名知情人士。

合同草案允许双方测试对方的商业模型,访问方式是 API。测试目标包括漏洞、隐藏风险和危险行为。草案包含数据留存限制。披露范围排除未发布模型、训练权重和内部研究计划。

报道使用的词是“discussed”和“neared a deal”。这两个词描述谈判接近程度。公司公告、签字文本、生效日期和新一轮评测结果缺席。

该消息的可信度介于普通传闻与正式协议之间。合理结论是:法律方案接受过讨论,合同状态未知。

2025年的交叉评测试验

OpenAI 与 Anthropic 有一段合作记录。一次交叉评测试验发生于 2025 年夏季。两家公司交换公共模型的 API 访问权限,双方安全团队测试对方模型。

评测项目包括指令层级服从、越狱、幻觉、谄媚、欺骗和自我保护倾向。部分外部安全过滤器接受放宽,目的是暴露模型底层行为。两家公司的结果发布日期是 8 月。

这次试验有明确限制。参测模型版本不同,测试集不同,采样参数不同,结论缺少横向排名价值。试验证明了交叉评测的可行性。数据、知识产权和结果发布产生合同需求。

OpenAI与Anthropic交叉评测、中美机制提案时间线

法律合同要解决什么

竞争对手访问彼此模型,会碰到四类问题:测试数据归属、提示词留存、漏洞披露和结果发布。

一份有约束力的合同定义访问权限、数据删除、保密责任和披露窗口。外部红队视角进入模型公司,商业秘密保持隔离。

技术价值来自对抗性。模型开发团队熟悉自家评测框架,盲区伴随熟悉感产生。竞争对手拥有不同攻击方法与安全假设。交叉测试能发现单方评测遗漏的行为。

合同风险包括产品弱点外泄、测试结果营销化和漏洞披露伤害用户。独立审计记录与共同发布规则属于必备条款。

两套机制共有一条设计原则

国家通报机制与公司交叉评测属于两种制度。前者处理地缘政治误判,后者处理模型行为缺陷。两者共有一条设计原则:有限信任接口。

国家分享事件信号,情报来源留在本国体系。公司分享商业模型访问权,训练权重留在内部系统。合作对象是风险信息,核心能力保持隔离。

这种结构说明了 AI 安全合作的现实边界。全面信任属于非前提条件。窄接口、触发条件和责任记录构成必要条件。

新闻的分量取决于制度产物

中美提案的观察指标包括领导人确认、联络机构、事件门槛和首次演练。公司合同的观察指标包括签署公告、适用模型、数据留存条款和评测报告。

这些制度产物处于缺席状态,“建立热线”和“互相验货”属于失准表述。两条新闻的关注价值来自竞争者对可验证安全接口的讨论。

现状数字很简单:两条可靠消息,两套提议,零份公开生效协议。

参考资料

  1. 路透社:美方提出中美 AI 安全通报机制
  2. 美联社:贝森特介绍 AI 通报机制提案
  3. 中国外交部:9 月 21 日例行记者会
  4. 彭博法律新闻:OpenAI 与 Anthropic 讨论交叉压力测试协议
  5. OpenAI:OpenAI 与 Anthropic 安全评测
  6. Anthropic:交叉评测发现
微信搜一搜:智简 Smart&Concise 公众号二维码

关注公众号

智简 Smart&Concise

微信搜一搜,获取独立开发与 AI 实践更新。