摘要
- RFC 9969 是 IAB 的信息性研讨会报告,记录讨论和可能的后续工作,不是 AI 控制协议,也不是参与者意见的共识规则。
- 偏好表达、附着方式、爬取观察、数据保管、模型决策、合规证据和救济决定必须保留为不同事实。
把公开的偏好称作“控制”,很容易省略关键步骤。RFC 9969 没有这样做。它记录 AI-CONTROL 研讨会关于内容所有者如何表达 AI 使用偏好的讨论,同时明确:其中的观点未必代表 IAB,内容来自展示与讨论笔记,报告不试图验证这些内容或形成共识。首先应保留的边界正是这个文档地位:它是问题与方向的记录,不是已经落地的规则。
偏好出现的时间与它可能影响的使用时间并不相同。爬虫访问资源时,位置或元数据中的声明或许可见;之后数据可能服务于搜索、被第三方收集、被复制到别的库,或在模型推理时以不同方式被使用。RFC 9969 指出,通用基础模型在推理时通常不能挑出某一来源的数据并按该来源的偏好选择性处理。因此,爬取时看见一个信号,只能证明那一时点存在表达,不能证明后来发生了排除、训练、推理或合规。
不同附着方式也只提供不同种类的证据。robots.txt 随站点位置工作;它对多作者或大型站点可能过于粗糙,内容移动后也不会自动随行。嵌入式元数据可以更贴近对象,却容易在常规处理时被剥离,也不适用于所有内容。注册表可把内容指纹与位置分开,但报告记录了它在互联网规模上的部署问题。这些机制并非同一种控制,更不是远端行为的收据。
报告提出的初始技术方向相当克制:在位置上附着偏好、在 IETF 控制的格式中附着偏好、定义共同核心词汇,以及定义多种附着方式发现的偏好如何组合。相反,执行机制、注册表方案、爬虫或内容所有者的识别与认证、审计或透明度机制都被列为初始阶段之外。词汇能说明一个信号想表达什么;组合规则能处理多个信号;两者都不能回答谁收到信号、使用了哪份副本、做了何种模型决定。
RFC 9309 的 Robots Exclusion Protocol 也应被放在这个边界内。观察到某处存在 robots.txt,可以证明一个声明性资源在该位置可获取;它不能证明某个爬虫的身份、内部数据流、集合排除、模型使用或生成结果。把一次位置观察延伸为合规结论,是用一个可见事实替换多个未被观察的决定。
适当的记录链至少包括:所有者偏好、内容版本、附着机制、收集事件、独立核验的收集者身份、声明用途、保管与转换、纳入或排除模型的决定、可审阅的证据和救济决定。每一环都可能有价值,但没有任何一环会自动继承前一环的权威。
会员简报
档案背景详情
使用相应会员等级登录,即可解锁完整简报与来源注释。
仅限 Strategic Circle
Strategic Circle
所有读者均可浏览。加入并登录后可解锁档案简报。
加入 Strategic Circle仅限 Leadership Alliance
Leadership Alliance
符合条件的 IP 资产所有者和管理层可登录查看 Leadership Alliance 简报。
加入 Leadership Alliance

