法律 AI 正式进入知识产权:检索之后,还能把什么做完?
作者 | Lexicowork
Lexicowork 不是再增加一个知识产权检索入口。它想做的,是把商标、专利和裁判数据继续向前推进:从找到材料,到整理证据、形成判断,再交出一份可以复核、修改和进入现有工作流程的成果文件。
这也是知识产权专业人员最熟悉的一段距离。客户问“这个名字能不能注册”,需要的不是一屏近似商标;企业做知识产权尽调,需要的也不是若干条著录项目。检索只是起点,筛选、比对、解释、成文和风险提示,才是工作真正耗时的部分。
上篇回答了为什么法律 AI 要从回答走向交付。这一篇只讲一件事:Lexicowork 如何让知识产权数据从“可以查”走向“可以用”,以及哪些事情目前还不能交给它。
一、不是再增加一个检索入口,而是让数据继续往下走
知识产权领域最容易用数据规模建立第一印象,也最容易因此忽略真正重要的问题:这些数据覆盖到哪里、哪些字段可以使用、更新到什么时间,以及能否继续形成可交付成果。
Lexicowork 目前接入的核心数据包括约 9,500 万条中国商标、约 1.70 亿条全球专利、约 198 万件商标驳回复审文书,以及约 27 万件专利无效和复审决定书。数据是底座,但底座本身不是产品的终点。
真正需要解决的是数据之后的工作:近似结果如何筛选,申请人名下资产如何归集,类案规则如何提炼,报告结构如何组织,引用依据如何回到原文。为此,Lexicowork 将数据接入五项知识产权专项能力,并要求每一项都以明确的交付物收尾。
二、不是罗列五项功能,而是承接五类真实任务
商标检索与尽调。输入拟申请名称、类别或者企业名称,系统完成名称近似检索、同类别在先权利筛查和申请人名下商标归集,输出检索结果表、商标清册及类别与类似群分析。它解决的不是“查到几件”,而是把分散结果整理成一份可以继续判断的工作底稿。
专利检索与尽调。围绕技术关键词、申请人、申请号、公开号及 IPC、CPC 等分类信息进行组合检索,统一常见专利号格式,输出著录项目清单、同族关系及现有数据范围内的引证信息,为技术摸底、竞争分析和资产核查提供结构化材料。
知识产权类案检索。围绕案由、争议焦点、法条和关键词检索相关裁判文书,整理类案清单、裁判要旨和原文链接。专业人员不必在大量结果中反复复制粘贴,而可以直接进入核验、取舍和论证。
知识产权尽调报告。将商标、专利和相关争议信息按照固定结构汇总为可编辑的 Word 报告。在相同数据条件和任务参数下,采用确定性聚合逻辑的统计与清单可以保持口径一致,更便于团队复核和审计。
裁判规则检索与弹药包。围绕一个具体争点,将可以引用的法律条文、案例、决定书片段及原文依据组织在一起,形成论证材料包。它不代替律师完成最终观点,而是把寻找依据、核对出处和整理引用这段工作向前完成。
三、不是给出一段回答,而是交付一份可以继续工作的文件
以商标注册风险预判为例。用户输入拟申请名称和指定类别后,系统调用商标数据进行名称近似检索,筛查同类别在先商标,并结合现有异议及评审文书整理历史处理倾向。最终交付的不是一句“风险较高”或者“可以申请”,而是一份线索级初判报告:近似在先商标有哪些,相关案件怎样处理,依据从哪里来,还需要专业人员核查什么。
原本散落在多个检索窗口中的结果,被收敛到一次任务和一份文件里。专业人员可以在这份文件上删除、补充、修改并形成最终意见,而不必从一段对话重新整理成正式成果。
这也是 Lexicowork 对“完成工作”的定义:不是模型说完了,而是专业人员可以接着工作,成果可以进入复核流程。
四、不是回避数据边界,而是把不能做什么写在明面上
一个说不清楚边界的系统,使用者就无法判断哪些工作可以交给它。数据是我们自己长期建设的,覆盖范围和缺口也应当由我们主动说明。
•商标方面,现阶段主要支持文字名称检索,不提供商标图样和维也纳图形要素编码,因此不能进行图形近似判断;
不提供完整的申请流程时间轴,也不包含续展、转让、许可备案等完整变更数据。
以申请人名称反查商标时,主要按照工商登记全称匹配,曾用名、关联主体和未及时办理变更的权利可能不在结果中。因此,系统形成的商标清册不能被理解为资产完整性保证。
•专利方面,现阶段不提供完整的法律状态和年费信息,不能据此直接判断权利是否持续有效;
中国专利目前主要提供著录项目与摘要,不承接依赖中国专利权利要求书、说明书全文的比对任务;
引证信息也有覆盖边界,不能据此直接作出专利价值结论。
不同国家和地区的数据更新存在时间差,使用时应以产品标示的统计基准日为准。
风险判断同样有边界。商标注册风险预判属于线索级初判,可能存在漏报,不能作为“没有风险”的最终结论。相关警示会随结果一并出现,而不是藏在用户协议里。
把不能做什么写清楚,不是削弱产品,而是让专业人员知道哪些结果可以使用、应当如何使用,以及哪一步必须回到人工判断。
五、不是用数据规模建立信任,而是用回源机制建立信任
法律和知识产权工作不能只凭模型自述。Lexicowork 对依据类结果保留原文链接和证据锚,方便逐条回源;对结构化输出设置字段和格式校验,避免报告在不同环节失去口径;对风险评估类能力强制附带边界提示;对企业和团队使用,则可以按照部门或项目配置权限与用量。
这些机制的意义,不在于让系统显得更复杂,而在于把“为什么得出这个结果”留在成果里。结论可以被质疑,依据可以被查证,遗漏可以被补充,错误可以被纠正,这才是专业工具应当提供的可信基础。
原始数据服务与专业工作台的分界也正在这里:接口把数据调出来,专业工作台则把数据组织成资产清册、检索报告、尽调报告和论证材料,并把来源、口径和边界一起交付。
六、不是看一份演示样例,而是拿一件真实任务来验
评估这类产品,最有意义的方法不是看一份为演示准备的样例,而是拿手上正在处理的一件真实任务来验证:一个仍在纠结的拟注册商标、一次正在进行的专利检索、一份需要提交会议的知识产权尽调,或者一个需要寻找类案支持的争议焦点。
验证时只看四件事:关键结果有没有明显遗漏,引用依据能不能回到原文,交付物能不能减少二次整理,产品边界是否与实际输出一致。能够通过这四项,数据才真正进入工作;不能通过,就不应当仅凭数据规模和演示效果作出判断。
Lexicowork 现处于邀请内测阶段。获得资格后,可以使用免费额度完成一次真实任务。全部产出均须经法律专业人员复核、修改后使用:系统承接检索、筛选、比对、整理与成文,最终判断和签字始终属于专业人员。
知识产权数据的终点,不是被检索出来,而是成为一份可以核验的依据、一个可以讨论的判断,以及一项可以继续推进的工作。
如需要试用,请扫码添加客服一对一咨询。

也可扫码进群交流

封面来源 | AI生成
往期热文






















