Legora 使用 GPT-6 Astra 在几分钟内审查了41份文件

OpenAI Blog 新闻

摘要

Legora 使用 GPT-6 Astra 在几分钟内审查了41份金融文件,在金融核对任务上实现了40%的性能提升,同时保持人类监督。

Legora 使用 GPT-6 Astra 在几分钟内审查了41份文件,发现了所有四个植入的错误,并在这个金融审查工作流中将性能提升了近40%。
查看原文
查看缓存全文

缓存时间: 2026/09/03 21:03

# Legora 借助 GPT-6 Astra 在数分钟内审阅41份文档 来源:https://openai.com/index/legora-financial-statement-review-with-astra/ Legora 是一个面向法律与专业工作的智能体操作系统,服务于全球超过50个市场的1,800多家企业法务部门及律所中的10万名专业人士。其法律工程师直接与客户合作,理解其运作模式,并将Legora适配于从合同协议审查到法律研究的全流程工作流中。 其中较为繁琐的流程之一是财务报表勾稽:需要逐一核对草案中的各项数字与试算平衡表、合并报表工作底稿及上年度报表,直至所有项目完全一致。正如Legora法律工程师Percevale Perks所言,这项工作"可能耗费整整一晚,有时甚至数天时间"。 ## 大规模处理复杂财务语境 通过运用GPT-6 Astra,Legora的智能体在一次运行中完成了跨越41份文档的勾稽工作。Legora表示该智能体仅用数分钟便完成了任务:核对每一余额与其支持性工作底稿,揭示金额差异,并记录每项检查结果。这为法律专业人士提供了可供复核的逐行项目与数字的精细记录。 > "我认为前后变革的核心在于处理能力——即摄取海量文档、消化高度复杂信息,并完整提取所有不同行项目与数字的能力。" ——Legora法律工程师 Percevale Perks 智能体负责执行详尽比对工作,而专家则始终对每个结果保持最终判断权。这种"人在回路"的方法,正是Legora将其平台从法律工作扩展至审计、税务、合规与风险管理领域的核心理念。 ## 提升准确性、完整性与可靠性 Legora使用其智能体推理基准测试(BAR)评估了GPT-6 Astra的表现,该基准针对真实场景的端到端法律任务进行衡量。Legora报告显示,GPT-6 Astra在此财务报表工作流中的性能较前代模型提升近40%。在BAR涵盖的所有任务中,平均改进幅度约为3%。 在此次勾稽工作中,Percevale将GPT-6 Astra的进步概括为准确性、完整性与可靠性的全面提升。该模型成功检测出Legora植入报表中的全部四处错误,包括隐藏在收入附注中一笔50万英镑的差额。它逐一核对了所有余额与其支持性工作底稿,并记录了每项检查结果。此外,模型不仅保留了前代模型已正确完成的检查项,还额外完成了约50项新检查。 最终成果是更完整、更快速的初步审查,以及更清晰的可复核记录,而最终决策权始终掌握在法律专家手中。

相似文章

GPT‑6 Astra

Simon Willison's Blog

OpenAI 发布 GPT‑6 Astra,在安全任务和长上下文处理方面表现出色,在 ARC-AGI 3 上达到 99.9%,尽管在某些基准测试上仍落后于 Claude Fable。

GPT-6 Astra 基准测试

Reddit r/singularity

本文介绍了OpenAI的GPT-6模型的基准测试,使用Astra基准测试系统评估其性能。

GPT-6 Astra

Hacker News Top

OpenAI 推出了 GPT-6 Astra,这是一个最先进的 AI 模型,在多个基准测试中获得高分,并在计算机使用、对齐和专业任务方面表现出色,即将向用户推出。

内部人士对Astra能力的看法

Reddit r/singularity

一位内部人士评估了GPT Astra的能力,强调其在长期任务、协调、应用学术文献和代码生成方面的优势,并指出在创意写作方面相比前代模型有所改进。