第十一章

AI 时代的软件知识产权

第十一层 + 第十二层 · 国际保护/AI挑战 当 AI 也开始“写代码”

一、AI 写代码了,版权归谁?

云间书店技术部早就用上了 AI 编程助手。有一天,小陈发现一个问题:

"林姐,我让 AI 帮我写了段排序算法,加进了云间荐书 Pro。这段代码……版权算谁的?我的?公司的?AI 的?"

林薇笑了:"这是当前全球知识产权界最大的争论之一。我给你讲讲目前的'主流答案'。"

AI 生成代码的版权归属(现状,2020s):
  主流观点(多数国家执法/司法倾向):
    - AI 不是"作者"(没有法律人格)
    - 版权归"对创作有实质性贡献的人"
    - 谁?通常是:组织者/使用者(提示词设计者)+ 后续编辑者

  中国实践:
    - 2023 年北京互联网法院:AI 生成图片案
      → 认可"人类在 AI 创作中的智力投入"→ 认定版权归提示词作者
    - 对代码的启示:你设计提示词 + 审查修改 = 有贡献 → 可主张权利

  美国实践(2023 年版权局):
    - "纯 AI 生成、无人类创作性输入" → 不登记版权
    - 人类参与修改/编排 → 可登记"人类创作部分"

  结论(云间书店内部政策):
    员工用 AI 辅助写的代码 → 职务作品 → 归公司
    (劳动合同已约定:在职期间开发的软件归公司)
    → 加上"人工审查修改"流程,强化"人类贡献"

"一句话:AI 是'笔',不是'作者'。 谁拿着笔、写什么、怎么改,决定权在人——所以 AI 辅助代码的版权,属于'指挥和修改它的人'(通常是公司)。但前提是:人类真的有智力投入,而不是'完全让 AI 自由发挥'。"


二、AI 训练用了别人的代码,算侵权吗?

"更麻烦的问题是反过来的:AI 的训练数据里,用了别人的代码/文章,这算侵权吗?"林薇说,"这个正在全球打官司。"

AI 训练数据合规(现状与争议):
  核心矛盾:
    - AI 公司:训练需要海量数据,合理使用(fair use)?
    - 内容方:我的作品被拿去训练,凭什么不给钱?

  已经发生的著名诉讼:
    - 纽约时报 vs OpenAI(新闻报道训练)
    - GitHub Copilot 集体诉讼(开源代码训练)
      → 指控:训练数据含 GPL/开源代码,AI 输出"高仿片段"
    - Getty Images vs Stability AI(图片训练)

  趋势判断:
    - "纯文本挖掘训练"在某些司法辖区算合理使用
    - "输出实质性复制了受保护表达" → 侵权风险高
    - 各国正在立法:AI 训练数据透明度、来源标注

  云间书店的应对:
    ① 自研模型训练用自采数据(用户授权数据)→ 风险最低
    ② 用商用大模型 API → 看服务条款(责任通常平台承担)
    ③ 内部制度:AI 输出若"高仿知名代码片段"→ 人工改写
       (防 Copilot 输出 GPL 片段 → 传染我们的代码!)

"AI 时代的新合规点:AI 的输出可能带着'训练数据的版权基因'。 你可能用 AI 写了段代码,结果它'复述'了一段 GPL 代码——你的商业软件就'中招'了。所以 AI 生成的代码,一定要人工审查 + 用代码指纹扫描(第九章的 SBOM 思路延伸)。"


三、开源许可证 + AI:一个新难题

"第四章讲了开源许可证,现在它和 AI 碰撞出了新问题。"林薇说:

开源 + AI 的新问题:
  ① AI 模型训练用开源代码,输出算不算"衍生作品"?
     → GPL 的"传染性"是否延伸到 AI 输出?(法律未定)
  ② 开源项目的 LICENSE 管不管 AI 的使用?
     → 很多项目开始加"AI 训练条款"(禁止用我的代码训练模型)
  ③ 我们的 AI 辅助开发,要不要记录"用了哪些开源组件"?
     → 要!SBOM 记录 + AI 使用日志

实践建议:
  - 生产代码:AI 生成的片段走"许可证扫描"(Trivy 也能查代码)
  - 高风险场景:AI 写核心算法?人工重写关键路径
  - 关注:公司开源项目要不要加 AI 训练限制条款

"开源许可证是 1980 年代设计的,AI 是 2020 年代的产物——旧规则遇新事物,处处是灰色地带。 灰色地带的操作原则:往'保守'靠——宁可多记录、多审查,也别赌'没人追究'。"


四、国际保护:AI 时代更要"提前出海布局"

"最后补充国际保护的完整版。"林薇说,"软件公司迟早要出海,知识产权一定要提前布局:"

软件国际保护体系:
  ① 著作权(自动,全球 180+ 国):伯尔尼公约
     → 创作即保护,无需登记(登记只是证据便利)
  ② 商标(逐国/区域注册):
     - 马德里国际注册(一次申请,多国生效)
     - 欧盟:EUTM(一件覆盖欧盟 27 国)
     → ⚠️ 抢注风险:别人在你出海前抢注你的品牌!
  ③ 专利(逐国申请):
     - PCT 国际申请(先国际申请,保留优先权,再进各国)
     - 申请费不便宜,挑"重要市场"进(美/欧/日)
  ④ 海关保护:
     知识产权海关备案 → 查扣侵权货物
  ⑤ 域名/APP 名:
     提前注册对应域名、海外应用商店开发者账号

云间书店出海路线图:
  第 0 步:商标查重(海外市场是否有同名)
  第 1 步:马德里注册"云间荐书"商标(东南亚市场优先)
  第 2 步:PCT 申请荐书算法专利(保留优先权)
  第 3 步:海关备案 + 海外域名注册
  第 4 步:每进入一个国家,先查当地知识产权布局

"出海的铁律:'市场未动,知识产权先行'。 你的产品还没到那个国家,商标和专利要先到——否则你辛辛苦苦打下的市场,可能是给'抢注者'打工。"


五、云间书店的"未来防御体系"

老周把 AI 时代的挑战融入公司的保护体系:

云间书店知识产权保护体系 V2.0(含 AI 时代):
  确权层(法律):
    ✅ 著作权登记(每个大版本)
    ✅ 专利布局(算法 + 未来 AI 功能)
    ✅ 商标注册(国内 + 出海)
    ✅ NDA/保密制度(全员)
  防护层(技术):
    ✅ 代码混淆 + 加固 + 水印 + DRM
    ✅ 核心算法服务端化
    ✅ AI 代码审查 + 许可证扫描(新增)
  合规层(管理):
    ✅ SBOM 管理(含 AI 使用记录,新增)
    ✅ 数据合规(个保法)
    ✅ AI 训练数据合规(新增)
  维权层(法律):
    ✅ 证据保全 SOP
    ✅ 律师函 → 投诉 → 诉讼路径
    ✅ 国际维权(伯尔尼/马德里/PCT/海关)

"记住:这套体系不是一次建完就结束,是'随着技术和法律演进,持续更新'的活体系。 AI 时代的规则还在形成中,我们要做的,是'边做边看、往保守靠、留好证据'。"


六、章末:林薇的第十一、十二层总结

第十一层:国际保护
├── 著作权:伯尔尼公约(自动全球保护)
├── 商标:马德里/欧盟(逐国申请,防抢注)
├── 专利:PCT 国际申请(保留优先权)
├── 海关备案:查扣侵权货物
└── 铁律:市场未动,知识产权先行
第十二层:AI 时代的挑战
├── AI 生成代码版权:归"有智力投入的人"(AI 是笔不是作者)
├── 训练数据合规:全球诉讼中(人工审查 AI 输出防"高仿")
├── 开源 + AI:灰色地带,往保守靠,多记录多审查
└── 体系 V2.0:确权/防护/合规/维权 + AI 时代新增项

"小陈,到这里,软件知识产权保护的十二层,我们全部讲完了。"林薇合上厚厚一叠讲义,"从'为什么需要保护',到'AI 时代的挑战'——法律和技术的两条线,我们完整走了一遍。"

"明天,王姐让我给你们出一张卷子——软件保卫战的综合测试。题目我都出好了,都是咱们这十二层里最要命的坑。"林薇笑着说,"去把终章准备好——那是你的结业报告:《从 9.9 元破解版到知识产权体系》。"

小陈深吸一口气,笑了:"林姐,我准备好了。这堂课,比写一万行代码都值钱。"

✌ 语言