跳到主要内容

法律与社会图景 — 版权两问、偏见审计法与技术乐观主义的尽头

这一章讲三件事: 生成式——会自己创作内容——的 AI 在法律上被追问的两个版权问题与四个经典判例; 隐私、偏见、责任三条法律战线的现状;以及作者对「技术-法律解决方案主义」的批判。 全书最不技术的一章——但第 06 章的 DP、第 12 章的公平审计, 都是在给本章的法律要求提供技术答案

1. 先看现象:作者为什么在一本技术书里写这一章

书里开宗明义:这是「这本以技术为主的书里最特别的一章」1。 理由埋在前十二章里——技术手段(加密、DP、审计)只能管住你自己系统内的行为; 模型一旦上线,它就在别人的法律管辖区、别人的版权、别人的身体数据上运行。 不理解这层,前面的技术就不知道在为谁服务。

2. 顶层全景:一条生成内容的供应链,八个法律触点

书里最有分析力的框架:把生成式 AI 拆成八段供应链,每段都有独立的法律与伦理选择2:

① 创作作品(人写的文、画的图) ← 版权起点:素材是谁的?
② 转成量化数据 ← 转换合法吗?
③ 训练集策展 ← 选择偏差与偏见从这里进
④ 基座预训练 ← "拿全网数据训练"的合法性主战场
⑤ 微调 ← 第 03-08 章的全部隐私战场
⑥ 发布部署 ← 开源还是 API?控制权问题
⑦ 生成 ← 产物著作权归谁?
└→ 生成物回流成训练数据(循环!)
⑧ 对齐 ← 价值观由谁定?

图说:主走查就是拿一件 AI 产物沿这八段走一遍,标出每段的法律问题。

3. 走查:一张 AI 生成图片的法律旅程

拿一件具体产物走供应链——一张用户用生成模型做的图:

①②③ 溯源:训练集里有无数艺术家受版权保护的作品,
艺术界称之为"art theft(艺术盗窃)",已引发多起诉讼
④⑤ 训练本身是否侵权?→ 法律未决(见 §4 问题一)
⑥ 发布方式决定控制权:API 发布可以限用途,开源权重收不回
⑦ 这张图有著作权吗?→ 美国版权局:纯机器产物没有(见 §4 问题二)
⑧ 图里的偏见与风格模仿,责任算谁的?→ 问责难题(§5)

图说:一张图过境八个阶段,每段都是一个未决法律问题。
(案例与立场均为书中引用,不是本拆解的判断。)

4. 版权两问:四个判例的缠斗

问题一:拿作品训练模型,侵权吗?

书里摆的战场3:GitHub Copilot 用公开代码训练,被质疑「无归属复述代码」; 艺术界的「AI 偷艺术」诉讼;还有第 01 章提过的纽约时报诉 OpenAI。 法院正在拿旧判例硬套,四个必须认识的名字:

判例确立的原则套到生成 AI 上的困难
Sony Betamax(1980s)设备有「实质性非侵权用途」→ 厂商免责(安全港原则)模型不是「设备」,「用途」由使用者定义
Napster / Grokster服务商要为用户侵权担责;积极诱导必败「模型」算服务商还是设备?
Feist(1991)版权要求最低限度的创造性;传统主题/风格不受保护恰好是判定 AI 产物「原创性」的尺子

书里点破的深层困难:旧技术只是复制、分发作品;生成式 AI 主动学习并转化数据, 「复制」与「原创」的界线本身被搅浑了4。 开发者的三条自保策略(书里原样):Intent(部署方式上避免「诱导」的外观)、 Control(用流式接口——一问一答、不开放下载——等机制维持对产出的控制)、Knowledge management (用加密查询这类技术,减少对侵权行为的「知情」)5

问题二:AI 的产出有著作权吗?

美国版权局的现行立场:无人类作者参与的机器产物,不受版权保护6。 Feist 案的「最低创造性」标准成了试金石;学界在造测量工具—— 用「生成新成语的能力」探测文本原创性、用 DreamSim 距离测图像新颖性, 想让「有没有原创性」变成可测量的量7这直接关系商业模式:无版权 = 无独占 = 生成内容本身不构成护城河。

5. 隐私、偏见、责任:三条战线

隐私法:GDPR(欧盟)、CCPA(加州)、HIPAA(美国医疗)三大支柱。 但书里挑了一个刺眼的案例:心脏起搏器病人想拿自己设备生成的数据, 被厂商以「数据专有+DMCA 反规避」挡回——你身体产生的数据,法律上可能不属于你8。 更深一层:现有法律管「收集」,管不住「推断」——匿名化的数据, AI 仍可能从模式里推断出身份(第 12 章的组级 DP 正是对着这个问题设计的)9

偏见与歧视法:COMPAS 累犯评估工具对黑人被告的系统性偏见(ProPublica 调查)、 招聘 AI 歧视女性、人脸识别对深肤色错误率高——书里一次列齐10。 已经生效的应对是纽约市偏见审计法(2023 年 7 月 5 日进入执法): 雇主使用自动化雇佣决策工具(AEDT)必须做独立偏见审计,并告知候选人工具的使用与数据来源11。 书里的冷静提醒:审计的有效性取决于标准与执法,且警惕「审计通过」制造虚假的客观感12。 技术侧的对接:算法影响评估(AIA,对系统做系统化的风险与偏见评估)——原书第 9 章(我们的第 14 章)给了案例框架。

责任:自动驾驶出了事故,算车厂、AI 开发者、还是「本该监控的人类乘客」的? 两条法律路径各有别扭:产品责任(严格责任,但模型会演化,「产品出厂时合格」的静态概念失效) vs 追究操作者(要新造 AI 语境下的注意义务)13

6. 作者的批判:技术-法律解决方案主义

本章的灵魂段落。作者反对的思路是:「复杂社会问题 = 技术问题 + 法律问题, 算法优化一下、法律修订一下就能解决」14。 不成立的理由:①系统复杂不透明,出了事归责链条断;②系统跨境运行, 适用谁的法律?③技术和法律问题互相定义——DMCA 能不能管起搏器数据, 既是法律解释问题也是技术架构问题。 作者的替代方案:原则导向监管——立法管「透明、公平、问责、隐私」这几条原则, 不管会速朽的具体技术细则15;加上公众参与(公民议事、参与式设计), 以及 AI 从业者群体自身的多元化与跨学科16

判断(我们的,不是书里的): 把本章与前十二章连读,会发现一个反向依赖: 法律的不确定性正在给技术指方向。 「知识管理」策略直接催生了加密查询的需求, GDPR 第 25 条「设计阶段即隐私」几乎是第 06-08 章的立法注脚, 偏见审计法创造了第 12 章探针工具的商业需求。对工程师的启示: 合规不是上线前的法务检查表,而是需求来源——看懂法律在怕什么, 就知道下一代隐私技术会为什么买单。 如果错,会错在: 如果最终立法走向「细则导向」(规定具体技术指标而非原则), 技术与法律的关系会变成「达标工程」而非「需求牵引」,上述判断就要修正。

7. 作者的判断与证据

书里给了出处的:COMPAS 调查、纽约偏见审计法、起搏器 DMCA 案例、 Betamax/Grokster/Feist 判例,全部附了引用;版权局立场有明确表述。

作者的立场(要和事实分开):对 Gemini 争议「不怪伦理 AI 工作」的辩护(第 01 章) 在本章延伸成对「技术解决方案主义」的系统批判;这是作者的价值立场, 引用时应当写明它是本书观点。

8. 边界与局限

  • 法律内容以美国与欧盟为主(书成稿于 2025),其他法域(包括中国的算法备案——向监管登记——制) 未覆盖;书出版后的判例进展(如多起版权案的裁决)不在其内;
  • 「原则导向监管」的具体机制书里只有一段论述,没有可操作的框架;
  • 平台责任、内容审核的法律(如DSA类)未涉及;
  • 供应链八阶段的第⑧段(对齐)的法律分析很薄。

9. 可带走的

  1. 供应链八阶段:创作→量化→策展→预训练→微调→部署→生成→对齐,每段一个法律触点;
  2. 版权两问:训练侵权与否未决;纯机器产物在美国无著作权;
  3. 安全港原则(Betamax)与诱导责任(Grokster)是两条正在被硬套的旧轨道;
  4. 开发者三自保:Intent(避免诱导外观)、Control(流式接口维持控制)、知识管理(加密查询减少知情);
  5. 「你身体产生的数据可能不属于你」:起搏器数据被 DMCA 挡回;
  6. 现有隐私法管收集、管不住推断——匿名化挡不住 AI 拼图再识别;
  7. 纽约偏见审计法已生效:自动化雇佣决策工具必须独立审计+告知候选人;
  8. 责任认定的两条路(产品责任 vs 追责操作者)都对 AI 勉强;
  9. 技术和法律互相定义,「好算法+好法律」的解决方案主义注定不够;
  10. 原则导向监管(管透明/公平/问责/隐私,不管具体技术)是作者押注的方向。

10. 原文地图

主题原书章原文位置
最不技术的一章A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:5(搜「predominantly technical」)
供应链八阶段A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:83(搜「eight key stages」)
生成物回流训练A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:109(搜「Generation」)
deepfake 与信任侵蚀A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:61(搜「Deepfakes」)
算法身份A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:70(搜「algorithmic identity」)
Copilot 争议A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:145(搜「GitHub Copilot」)
「艺术盗窃」诉讼A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:147(搜「art theft」)
Betamax 与安全港A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:149(搜「Betamax」)
Grokster 诱导责任A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:154(搜「Grokster」)
复制与原创界线被搅浑A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:151(搜「learn from and transform」)
三条自保策略A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:158(搜「Intent」) · text/72-fm-a-new-kind-of-socio-technical-systems.txt:167(搜「Knowledge management」)
版权局:无人类作者不受保护A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:178(搜「Copyright Office」)
Feist 最低创造性A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:180(搜「Feist」)
原创性测量(DreamSim)A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:182(搜「DreamSim」)
起搏器数据与 DMCAA New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:196(搜「pacemakers」)
推断与再识别A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:202(搜「re-identification」)
COMPASA New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:211(搜「COMPAS」)
纽约偏见审计法A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:213(搜「Bias Audit Law」)
审计的局限A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:217(搜「false sense」)
自动驾驶责任A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:230(搜「self-driving」)
产品责任路径A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:234(搜「product liability」)
技术-法律解决方案主义A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:243(搜「techno-legal solutionism」)
跨境难题A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:247(搜「cross-jurisdictional」)
原则导向监管A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:251(搜「principles-based」)
AI 素养与公众参与A New Kind of Socio-Technical Systemstext/72-fm-a-new-kind-of-socio-technical-systems.txt:289(搜「AI literacy」)

Footnotes

  1. 出处:「A New Kind of Socio-Technical Systems」第 5 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:5,搜「predominantly technical」)。

  2. 出处:「A New Kind of Socio-Technical Systems」第 83 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:83,搜「eight key stages」);八段定义在 :85-115;生成物回流见 :111(text/72-fm-a-new-kind-of-socio-technical-systems.txt:109,搜「Generation」)。

  3. 出处:「A New Kind of Socio-Technical Systems」第 145 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:145,搜「GitHub Copilot」)与第 147 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:147,搜「art theft」)。

  4. 出处:「A New Kind of Socio-Technical Systems」第 151 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:151,搜「learn from and transform」)。

  5. 出处:「A New Kind of Socio-Technical Systems」第 158 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:158,搜「Intent」)、第 165 段(搜「Control」)、第 167 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:167,搜「Knowledge management」)。

  6. 出处:「A New Kind of Socio-Technical Systems」第 178 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:178,搜「Copyright Office」)。

  7. 出处:「A New Kind of Socio-Technical Systems」第 182 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:182,搜「DreamSim」)。

  8. 出处:「A New Kind of Socio-Technical Systems」第 196 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:196,搜「pacemakers」)。

  9. 出处:「A New Kind of Socio-Technical Systems」第 202 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:202,搜「re-identification」)。

  10. 出处:「A New Kind of Socio-Technical Systems」第 211 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:211,搜「COMPAS」)。

  11. 出处:「A New Kind of Socio-Technical Systems」第 213 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:213,搜「Bias Audit Law」)。

  12. 出处:「A New Kind of Socio-Technical Systems」第 217 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:217,搜「false sense」)。

  13. 出处:「A New Kind of Socio-Technical Systems」第 230 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:230,搜「self-driving」)与第 234 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:234,搜「product liability」)。

  14. 出处:「A New Kind of Socio-Technical Systems」第 243 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:243,搜「techno-legal solutionism」)。

  15. 出处:「A New Kind of Socio-Technical Systems」第 251 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:251,搜「principles-based」)。

  16. 出处:「A New Kind of Socio-Technical Systems」第 261 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:261,搜「Technological solutionism」)与第 289 段(text/72-fm-a-new-kind-of-socio-technical-systems.txt:289,搜「AI literacy」)。