面向Google编程CHARLES ZHANG

AI DAILY / 2026-09-08

Legora 利用 GPT-6 Astra 在数分钟内完成 41 份财报核对

Legora reviewed 41 documents in minutes with GPT-6 Astra

上下文与记忆OpenAI · 2026-09-03

全文中文翻译 · AI 生成,仅供学习交流

Legora 用 GPT-6 Astra 在数分钟内审阅 41 份文档

Legora 是一款面向法律与专业服务工作的智能体操作系统(agentic operating system),全球 50 多个市场、超过 1,800 家企业法务部门和律所的逾 10 万名专业人士都在用。Legora 的法律工程师会跟客户一起摸清他们的工作方式,再把 Legora 适配到端到端的工作流里,从合同与协议审阅一路到法律研究。

最繁琐的工作流之一,叫财务报表勾稽核对(financial-statement tie-out)。它要做的,是把草拟账目里的每一项数字,逐一同试算平衡表、合并报表附表以及上一年度的账目进行比对,直到每一笔分录都对得上。Legora 的法律工程师 Percevale Perks 说过,这项工作「有时要耗掉一整个晚上,甚至要好几天」。

大规模处理复杂财务数据

借助 GPT‑6 Astra,Legora 的智能体(Agent)一次性完成了 41 份文档的勾稽核对。Legora 表示,这个智能体在数分钟内就完成了全部工作。它把每个余额与对应的支持性附表逐一核对,把金额上的差异标出来,并记录每一次核对结果。这样给到法律专业人士手里的,是一份细到每一笔分录和每一个数字的记录,方便他们逐项审阅。

「我觉得前后最大的变化在于处理能力,能够一次性吃下如此大量的文档,消化真正复杂的信息,并提取出所有那些不同的分录和数字。」

Percevale Perks
Legora 法律工程师智能体承担了逐项比对的苦活,专家则保留对每项结果的判断权。这种「人在回路(human in the loop)」的做法,正是 Legora 把平台从法律工作拓展到审计、税务、合规与风控领域的核心思路。

提升准确性、完整性与可靠性

Legora 用自家的 Legora 智能体推理基准测试(Legora Benchmark for Agentic Reasoning,简称 BAR)来评估 GPT‑6 Astra,这套基准测试涵盖来自真实业务场景的端到端法律任务。Legora 报告说,GPT‑6 Astra 在这一财务报表工作流上的表现比上一代模型提升了近 40%;在 BAR 涵盖的全部任务上,平均提升约 3%。

在这项勾稽核对任务中,Percevale 把这些提升概括为准确性、完整性和可靠性三个维度。GPT‑6 Astra 找出了 Legora 预先埋设的全部四处错误,其中包括藏在收入附注里的一项 50 万英镑差额;它把每个余额与对应支持性附表逐一核对,并记录每一次核对结果;不仅完整保留了上一代模型原本就核对正确的全部条目,还多完成了大约 50 项核对。

原文配图
原文配图
原文配图