据Engadget报道,多家AI公司正加快向法律服务市场推出工具,试图让模型协助律师办案;与此同时,法院和律师协会仍在处罚提交含虚构判例引注的律师。今年,四大AI实验室中已有三家推出或推介面向律师的产品。

谷歌在8月底将Gemini Enterprise for Legal投入预览,参与方包括四家全球大型律所;三个月前,Anthropic发布了现称Claude Legal Solutions的产品。Elon Musk的SpaceXAI实验室也在网站上线了专门的法律解决方案页面。据Engadget报道,这一波动作在律师持续因AI文书受罚之际反而加速。

安大略律师协会去年12月认定,律师Shahryar Mazaheri使用较早版本Grok为客户上诉起草书面法律论证,产生虚构引注和编造的法律原则。6月费用裁决令其支付31150美元;裁决者称该大语言模型“不体察细微差别,不行使判断,也不使用道德指南针”,并“强烈倾向于给出答案——任何答案——而不是承认无知”,还将其AI生成材料描述为“胡言乱语”。研究员Damien Charlotin的数据库已记录全球近2000起此类案件,涉及800多名律师和1100多名自我代理诉讼当事人。

美国律所Sullivan & Cromwell也出现此类问题。该所4月向纽约南区联邦法院提交紧急信函,原因是此前提交给首席法官Martin Glenn的破产动议被发现含42处AI生成的虚构内容。加拿大法院涉及虚构引注的已报告案件从2024年的7起升至2025年的86起,2026年第一季度又增加39起。DoNotPay曾在2023年初放弃让AI“机器人律师”出庭辩论,因州律师协会威胁刑事起诉。

谷歌和Anthropic都暗示其法律产品为核验而建。谷歌产品通过连接器将查询导向Everlaw、NetDocuments等外部法律数据库,而非孤立依赖模型训练数据。谷歌云CEO Thomas Kurian在发布时表示,“确保这些代理工作流的每个方面都准确、符合事实并以法律权威为依据,至关重要。”Gottlieb、Freshfields、Weil和Williams & Connolly参与预览。

Anthropic的Claude Legal Solutions据称包含20个法律平台连接器和12个预建插件,并称Opus 4.7在BigLaw Bench法律推理基准上得分90.9%,客户包括Freshfields和Quinn Emanuel。文章指出,这些产品与Mazaheri案的关键区别在于,它们从外部经核验来源提取引注,而不是要求模型从记忆中生成引注。

SpaceXAI由Grok驱动的法律产品资历较薄。Cursor博客文章曾称Grok 4.5适合“金融、法律工作或你在电脑上做的任何其他事情”,但SpaceXAI随后公告聚焦“编程、代理任务和知识工作”,未提及法律应用。该页面也未披露将引注追溯至原始来源的架构或机制。SpaceX于8月15日正式以600亿美元收购Cursor,将这家代码编辑器的法律营销纳入Grok旗下。

2024年斯坦福RegLab研究测试LexisNexis和Westlaw的专用法律AI平台后,发现幻觉率分别为17%和33%。目前尚无对谷歌或Anthropic法律工具的同类独立审计。所有律师都受律师协会规则约束,无论是否使用AI,提交引注的核验义务都在律师本人。Mazaheri的31150美元罚款并非因为使用AI,而是因为未彻底检查其输出。无论法律AI工具设计得多么谨慎,或厂商附带多少保障措施,这一义务都不会改变。