一、AI 写代码了,版权归谁?
云间书店技术部早就用上了 AI 编程助手。有一天,小陈发现一个问题:
"林姐,我让 AI 帮我写了段排序算法,加进了云间荐书 Pro。这段代码……版权算谁的?我的?公司的?AI 的?"
林薇笑了:"这是当前全球知识产权界最大的争论之一。我给你讲讲目前的'主流答案'。"
AI 生成代码的版权归属(现状,2020s):
主流观点(多数国家执法/司法倾向):
- AI 不是"作者"(没有法律人格)
- 版权归"对创作有实质性贡献的人"
- 谁?通常是:组织者/使用者(提示词设计者)+ 后续编辑者
中国实践:
- 2023 年北京互联网法院:AI 生成图片案
→ 认可"人类在 AI 创作中的智力投入"→ 认定版权归提示词作者
- 对代码的启示:你设计提示词 + 审查修改 = 有贡献 → 可主张权利
美国实践(2023 年版权局):
- "纯 AI 生成、无人类创作性输入" → 不登记版权
- 人类参与修改/编排 → 可登记"人类创作部分"
结论(云间书店内部政策):
员工用 AI 辅助写的代码 → 职务作品 → 归公司
(劳动合同已约定:在职期间开发的软件归公司)
→ 加上"人工审查修改"流程,强化"人类贡献"
"一句话:AI 是'笔',不是'作者'。 谁拿着笔、写什么、怎么改,决定权在人——所以 AI 辅助代码的版权,属于'指挥和修改它的人'(通常是公司)。但前提是:人类真的有智力投入,而不是'完全让 AI 自由发挥'。"
二、AI 训练用了别人的代码,算侵权吗?
"更麻烦的问题是反过来的:AI 的训练数据里,用了别人的代码/文章,这算侵权吗?"林薇说,"这个正在全球打官司。"
AI 训练数据合规(现状与争议):
核心矛盾:
- AI 公司:训练需要海量数据,合理使用(fair use)?
- 内容方:我的作品被拿去训练,凭什么不给钱?
已经发生的著名诉讼:
- 纽约时报 vs OpenAI(新闻报道训练)
- GitHub Copilot 集体诉讼(开源代码训练)
→ 指控:训练数据含 GPL/开源代码,AI 输出"高仿片段"
- Getty Images vs Stability AI(图片训练)
趋势判断:
- "纯文本挖掘训练"在某些司法辖区算合理使用
- "输出实质性复制了受保护表达" → 侵权风险高
- 各国正在立法:AI 训练数据透明度、来源标注
云间书店的应对:
① 自研模型训练用自采数据(用户授权数据)→ 风险最低
② 用商用大模型 API → 看服务条款(责任通常平台承担)
③ 内部制度:AI 输出若"高仿知名代码片段"→ 人工改写
(防 Copilot 输出 GPL 片段 → 传染我们的代码!)
"AI 时代的新合规点:AI 的输出可能带着'训练数据的版权基因'。 你可能用 AI 写了段代码,结果它'复述'了一段 GPL 代码——你的商业软件就'中招'了。所以 AI 生成的代码,一定要人工审查 + 用代码指纹扫描(第九章的 SBOM 思路延伸)。"
三、开源许可证 + AI:一个新难题
"第四章讲了开源许可证,现在它和 AI 碰撞出了新问题。"林薇说:
开源 + AI 的新问题:
① AI 模型训练用开源代码,输出算不算"衍生作品"?
→ GPL 的"传染性"是否延伸到 AI 输出?(法律未定)
② 开源项目的 LICENSE 管不管 AI 的使用?
→ 很多项目开始加"AI 训练条款"(禁止用我的代码训练模型)
③ 我们的 AI 辅助开发,要不要记录"用了哪些开源组件"?
→ 要!SBOM 记录 + AI 使用日志
实践建议:
- 生产代码:AI 生成的片段走"许可证扫描"(Trivy 也能查代码)
- 高风险场景:AI 写核心算法?人工重写关键路径
- 关注:公司开源项目要不要加 AI 训练限制条款
"开源许可证是 1980 年代设计的,AI 是 2020 年代的产物——旧规则遇新事物,处处是灰色地带。 灰色地带的操作原则:往'保守'靠——宁可多记录、多审查,也别赌'没人追究'。"
四、国际保护:AI 时代更要"提前出海布局"
"最后补充国际保护的完整版。"林薇说,"软件公司迟早要出海,知识产权一定要提前布局:"
软件国际保护体系:
① 著作权(自动,全球 180+ 国):伯尔尼公约
→ 创作即保护,无需登记(登记只是证据便利)
② 商标(逐国/区域注册):
- 马德里国际注册(一次申请,多国生效)
- 欧盟:EUTM(一件覆盖欧盟 27 国)
→ ⚠️ 抢注风险:别人在你出海前抢注你的品牌!
③ 专利(逐国申请):
- PCT 国际申请(先国际申请,保留优先权,再进各国)
- 申请费不便宜,挑"重要市场"进(美/欧/日)
④ 海关保护:
知识产权海关备案 → 查扣侵权货物
⑤ 域名/APP 名:
提前注册对应域名、海外应用商店开发者账号
云间书店出海路线图:
第 0 步:商标查重(海外市场是否有同名)
第 1 步:马德里注册"云间荐书"商标(东南亚市场优先)
第 2 步:PCT 申请荐书算法专利(保留优先权)
第 3 步:海关备案 + 海外域名注册
第 4 步:每进入一个国家,先查当地知识产权布局
"出海的铁律:'市场未动,知识产权先行'。 你的产品还没到那个国家,商标和专利要先到——否则你辛辛苦苦打下的市场,可能是给'抢注者'打工。"
五、云间书店的"未来防御体系"
老周把 AI 时代的挑战融入公司的保护体系:
云间书店知识产权保护体系 V2.0(含 AI 时代):
确权层(法律):
✅ 著作权登记(每个大版本)
✅ 专利布局(算法 + 未来 AI 功能)
✅ 商标注册(国内 + 出海)
✅ NDA/保密制度(全员)
防护层(技术):
✅ 代码混淆 + 加固 + 水印 + DRM
✅ 核心算法服务端化
✅ AI 代码审查 + 许可证扫描(新增)
合规层(管理):
✅ SBOM 管理(含 AI 使用记录,新增)
✅ 数据合规(个保法)
✅ AI 训练数据合规(新增)
维权层(法律):
✅ 证据保全 SOP
✅ 律师函 → 投诉 → 诉讼路径
✅ 国际维权(伯尔尼/马德里/PCT/海关)
"记住:这套体系不是一次建完就结束,是'随着技术和法律演进,持续更新'的活体系。 AI 时代的规则还在形成中,我们要做的,是'边做边看、往保守靠、留好证据'。"
六、章末:林薇的第十一、十二层总结
第十一层:国际保护
├── 著作权:伯尔尼公约(自动全球保护)
├── 商标:马德里/欧盟(逐国申请,防抢注)
├── 专利:PCT 国际申请(保留优先权)
├── 海关备案:查扣侵权货物
└── 铁律:市场未动,知识产权先行
第十二层:AI 时代的挑战
├── AI 生成代码版权:归"有智力投入的人"(AI 是笔不是作者)
├── 训练数据合规:全球诉讼中(人工审查 AI 输出防"高仿")
├── 开源 + AI:灰色地带,往保守靠,多记录多审查
└── 体系 V2.0:确权/防护/合规/维权 + AI 时代新增项
"小陈,到这里,软件知识产权保护的十二层,我们全部讲完了。"林薇合上厚厚一叠讲义,"从'为什么需要保护',到'AI 时代的挑战'——法律和技术的两条线,我们完整走了一遍。"
"明天,王姐让我给你们出一张卷子——软件保卫战的综合测试。题目我都出好了,都是咱们这十二层里最要命的坑。"林薇笑着说,"去把终章准备好——那是你的结业报告:《从 9.9 元破解版到知识产权体系》。"
小陈深吸一口气,笑了:"林姐,我准备好了。这堂课,比写一万行代码都值钱。"