法律与社会图景 — 版权两问、偏见审计法与技术乐观主义的尽头
这一章讲三件事: 生成式——会自己创作内容——的 AI 在法律上被追问的两个版权 问题与四个经典判例; 隐私、偏见、责任三条法律战线的现状;以及作者对「技术-法律解决方案主义」的批判。 全书最不技术的一章——但第 06 章的 DP、第 12 章的公平审计, 都是在给本章的法律要求提供技术答案。
1. 先看现象:作者为什么在一本技术书里写这一章
书里开宗明义:这是「这本以技术为主的书里最特别的一章」1。 理由埋在前十二章里——技术手段(加密、DP、审计)只能管住你自己系统内的行为; 模型一旦上线,它就在别人的法律管辖区、别人的版权、别人的身体数据上运行。 不理解这层,前面的技术就不知道在为谁服务。
2. 顶层全景:一条生成内容的供应链,八个法律触点
书里最有分析力的框架:把生成式 AI 拆成八段供应链,每段都有独立的法律与伦理选择2:
① 创作作品(人写的文、画的图) ← 版权起点:素材是谁的?
② 转成量化数据 ← 转换合法吗?
③ 训练集策展 ← 选择偏差与偏见从这里进
④ 基座预训练 ← "拿全网数据训练"的合法性主战场
⑤ 微调 ← 第 03-08 章的全部隐私战场
⑥ 发布部署 ← 开源还是 API?控制权问题
⑦ 生成 ← 产物著作权归谁?
└→ 生成物回流成训练数据(循环!)
⑧ 对齐 ← 价值观由谁定?
图说:主走查就是拿一件 AI 产物沿这八段走一遍,标出每段的法律问题。
3. 走查:一张 AI 生成图片的法律旅程
拿一件具体产物走供应链——一张用户用生成模型做的图:
①②③ 溯源:训练集里有无数艺术家受版权保护的作品,
艺术界称之为"art theft(艺术盗窃)",已引发多起诉讼
④⑤ 训练本身是否侵权?→ 法律未决(见 §4 问题一)
⑥ 发布方式决定控制权:API 发布可以限用途,开源权重收不回
⑦ 这张图有著作权吗?→ 美国版权局:纯机器产物没有(见 §4 问题二)
⑧ 图里的偏见与风格模仿,责任算谁的?→ 问责难题(§5)
图说:一张图过境八个阶段,每段都是一个未决法律问题。
(案例与立场均为书中引用,不是本拆解的判断。)
4. 版权两问:四个判例的缠斗
问题一:拿作品训练模型,侵权吗?
书里摆的战场3:GitHub Copilot 用公开代码训练,被质疑「无归属复述代码」; 艺术界的「AI 偷艺术」诉讼;还有第 01 章提过的纽约时报诉 OpenAI。 法院正在拿旧判例硬套,四个必须认识的名字:
| 判例 | 确立的原则 | 套到生成 AI 上的困难 |
|---|---|---|
| Sony Betamax(1980s) | 设备有「实质性非侵权用途」→ 厂商免责(安全港原则) | 模型不是「设备」,「用途」由使用者定义 |
| Napster / Grokster | 服务商要为用户侵权担责;积极诱导必败 | 「模型」算服务商还是设备? |
| Feist(1991) | 版权要求最低限度的创造性;传统主题/风格不受保护 | 恰好是判定 AI 产物「原创性」的尺子 |
书里点破的深层困难:旧技术只是复制、分发作品;生成式 AI 主动学习并转化数据, 「复制」与「原创」的界线本身被搅浑了4。 开发者的三条自保策略(书里原样):Intent(部署方式上避免「诱导」的外观)、 Control(用流式接口——一问一答、不开放下载——等机制维持对产出的控制)、Knowledge management (用加密查询这类技术,减少对侵权行为的「知情」)5。
问题二:AI 的产出有著作权吗?
美国版权局的现行立场:无人类作者参与的机器产物,不受版权保护6。 Feist 案的「最低创造性」标准成了试金石;学界在造测量工具—— 用「生成新成语的能力」探测文本原创性、用 DreamSim 距离测图像新颖性, 想让「有没有原创性」变成可测量的量7。 这直接 关系商业模式:无版权 = 无独占 = 生成内容本身不构成护城河。
5. 隐私、偏见、责任:三条战线
隐私法:GDPR(欧盟)、CCPA(加州)、HIPAA(美国医疗)三大支柱。 但书里挑了一个刺眼的案例:心脏起搏器病人想拿自己设备生成的数据, 被厂商以「数据专有+DMCA 反规避」挡回——你身体产生的数据,法律上可能不属于你8。 更深一层:现有法律管「收集」,管不住「推断」——匿名化的数据, AI 仍可能从模式里推断出身份(第 12 章的组级 DP 正是对着这个问题设计的)9。
偏见与歧视法:COMPAS 累犯评估工具对黑人被告的系统性偏见(ProPublica 调查)、 招聘 AI 歧视女性、人脸识别对深肤色错误率高——书里一次列齐10。 已经生效的应对是纽约市偏见审计法(2023 年 7 月 5 日进入执法): 雇主使用自动化雇佣决策工具(AEDT)必须做独立偏见审计,并告知候选人工具的使用与数据来源11。 书里的冷静提醒:审计的有效性取决于标准与执法,且警惕「审计通过」制造虚假的客观感12。 技术侧的对接:算法影响评估(AIA,对系统做系统化的风险与偏见评估)——原书第 9 章(我们的第 14 章)给了案例框架。
责任:自动驾驶出了事故,算车厂、AI 开发者、还是「本该监控的人类乘客」的? 两条法律路径各有别扭:产品责任(严格责任,但模型会演化,「产品出厂时合格」的静态概念失效) vs 追究操作者(要新造 AI 语境下的注意义务)13。
6. 作者的批判:技术-法律解决方案主义
本章的灵魂段落。作者反对的思路是:「复杂社会问题 = 技术问题 + 法律问题, 算法优化一下、法律修订一下就能解决」14。 不成立的理由:①系统复杂不透明,出了事归责链条断;②系统跨境运行, 适用谁的法律?③技术和法律问题互相定义——DMCA 能不能管起搏器数据, 既是法律解释问题也是技术架构问题。 作者的替代方案:原则导向监管——立法管「透明、公平、问责、隐私」这几条原则, 不管会速朽的具体技术细则15;加上公众参与(公民议事、参与式设计), 以及 AI 从业者群体自身的多元化与跨学科16。
判断(我们的,不是书里的): 把本章与前十二章连读,会发现一个反向依赖: 法律的不确定性正在给技术指方向。 「知识管理」策略直接催生了加密查询的需求, GDPR 第 25 条「设计阶段即隐私」几乎是第 06-08 章的立法注脚, 偏见审计法创造了第 12 章探针工具的商业需求。对工程师的启示: 合规不是上线前的法务检查表,而是需求来源——看懂法律在怕什么, 就知道下一代隐私技术会为什么买单。 如果错,会错在: 如果最终立法走向「细则导向」(规定具体技术指标而非原则), 技术与法律的关系会变成「达标工程」而非「需求牵引」,上述判断就要修正。
7. 作者的判断与证据
书里给了出处的:COMPAS 调查、纽约偏见审计法、起搏器 DMCA 案例、 Betamax/Grokster/Feist 判例,全部附了引用;版权局立场有明确表述。
作者的立场(要和事实分开):对 Gemini 争议「不怪伦理 AI 工作」的辩护(第 01 章) 在本章延伸成对「技术解决方案主义」的系统 批判;这是作者的价值立场, 引用时应当写明它是本书观点。
8. 边界与局限
- 法律内容以美国与欧盟为主(书成稿于 2025),其他法域(包括中国的算法备案——向监管登记——制) 未覆盖;书出版后的判例进展(如多起版权案的裁决)不在其内;
- 「原则导向监管」的具体机制书里只有一段论述,没有可操作的框架;
- 平台责任、内容审核的法律(如DSA类)未涉及;
- 供应链八阶段的第⑧段(对齐)的法律分析很薄。
9. 可带走的
- 供应链八阶段:创作→量化→策展→预训练→微调→部署→生成→对齐,每段一个法律触点;
- 版权两问:训练侵权与否未决;纯机器产物在美国无著作权;
- 安全港原则(Betamax)与诱导责任(Grokster)是两条正在被硬套的旧轨道;
- 开发者三自保:Intent(避免诱导外观)、Control(流式接口维持控制)、知识管理(加密查询减少知情);
- 「你身体产生的数据可能不属于你」:起搏器数据被 DMCA 挡回;
- 现有隐私法管收集、管不住推断——匿名化挡不住 AI 拼图再识别;
- 纽约偏见审计法已生效:自动化雇佣决策工具必须独立审计+告知候选人;
- 责任认定的两条路(产品责任 vs 追责操作者)都对 AI 勉强;
- 技术和法律互相定义,「好算法+好法律」的解决方 案主义注定不够;
- 原则导向监管(管透明/公平/问责/隐私,不管具体技术)是作者押注的方向。
10. 原文地图
| 主题 | 原书章 | 原文位置 |
|---|---|---|
| 最不技术的一章 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:5(搜「predominantly technical」) |
| 供应链八阶段 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:83(搜「eight key stages」) |
| 生成物回流训练 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:109(搜「Generation」) |
| deepfake 与信任侵蚀 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:61(搜「Deepfakes」) |
| 算法身份 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:70(搜「algorithmic identity」) |
| Copilot 争议 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:145(搜「GitHub Copilot」) |
| 「艺术盗窃」诉讼 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:147(搜「art theft」) |
| Betamax 与安全港 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:149(搜「Betamax」) |
| Grokster 诱导责任 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:154(搜「Grokster」) |
| 复制与原创界线被搅浑 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:151(搜「learn from and transform」) |
| 三条自保策略 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:158(搜「Intent」) · text/72-fm-a-new-kind-of-socio-technical-systems.txt:167(搜「Knowledge management」) |
| 版权局:无人类作者不受保护 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:178(搜「Copyright Office」) |
| Feist 最低创造性 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:180(搜「Feist」) |
| 原创性测量(DreamSim) | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:182(搜「DreamSim」) |
| 起搏器数据与 DMCA | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:196(搜「pacemakers」) |
| 推断与再识别 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:202(搜「re-identification」) |
| COMPAS | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:211(搜「COMPAS」) |
| 纽约偏见审计法 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:213(搜「Bias Audit Law」) |
| 审计的局限 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:217(搜「false sense」) |
| 自动驾驶责任 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:230(搜「self-driving」) |
| 产品责任路径 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:234(搜「product liability」) |
| 技术-法律解决方案主义 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:243(搜「techno-legal solutionism」) |
| 跨境难题 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:247(搜「cross-jurisdictional」) |
| 原则导向监管 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:251(搜「principles-based」) |
| AI 素养与公众参与 | A New Kind of Socio-Technical Systems | text/72-fm-a-new-kind-of-socio-technical-systems.txt:289(搜「AI literacy」) |