杭州中院开庭审理的这起“AI数字人”专利纠纷,争议焦点不在数字人本身,而在被告服务中使用的音频驱动人物口型模型是否落入原告专利的保护范围。这类案件的边界,从来不由技术名称划定,而由权利要求书划定。
边界由权利要求的技术特征决定
涉案专利属于自然人机交互领域的方法专利。侵权判断的标准路径是技术特征比对:把权利要求拆解为若干必要技术特征,再逐项核验被控方案是否全部具备。全部具备,构成字面侵权;缺少其中一项,一般就不落入保护范围;只有当替换手段与专利手段在手段、功能、效果上基本相同,且无需创造性劳动即可联想时,才可能进入等同侵权的讨论。庭审展示的技术比对过程,本质上就是这套拆解与对应。
算法环节最难比对
音频驱动口型看似只是一次模型推理,实际往往由前处理、特征提取、驱动映射、渲染输出等多个环节串联。权利要求若把创新点落在这些环节的先后关系或输入输出约束上,边界相对清晰;若只用“以音频驱动口型”这类功能性表述概括,保护范围就可能被限缩到说明书的具体实现。被告的抗辩空间也多半在这里:或主张某一步骤的技术手段不同,或主张被控方案缺少某个必要技术特征。
举证是另一重约束
模型参数与训练数据通常不公开,权利人很难直接拆开对方系统,只能借助服务的外在表现、接口行为和文档描述反向推断内部技术路径;而专利以公开换保护,竞争对手同样可能照着权利要求书的记载设计规避方案。
对做 AI 数字人产品的人来说,可操作的判断很朴素:先看目标专利的权利要求写了什么,而不是它叫什么名字;音频驱动、口型生成等关键环节的设计留痕,既是研发资产,也是日后抗辩的证据。该案仍在审理中,但比对逻辑已经清楚——保护范围以权利要求记载的内容为准,说明书与附图用于解释权利要求。