Legora 是一個專為法律及專業工作設計的代理作業系統,目前已被超過 50 個市場中 1,800 多家企業法務部門和律師事務所的 10 萬多名專業人士使用。其法務工程師直接與客戶合作,了解他們的工作方式,並將 Legora 應用於從合約審閱到法律研究的端到端工作流程。
其中一項特別繁瑣的工作流程是「財務報表核對」(financial-statement tie-out):這需要將草稿帳目中的每個數字與試算表、合併報表以及前一年的帳目進行比對,直到每個項目都吻合為止。正如 Legora 的法務工程師 Percevale Perks 所說,這項工作「可能需要一整個晚上,有時甚至數天」。
運用 GPT-6 Astra,Legora 的 Agent 在單次執行中完成了 41 份文件的核對工作。Legora 表示,這個 Agent 在數分鐘內就完成了任務:它比對了每個餘額與其支援的附表,找出金額不符之處,並記錄下每次檢查。這項成果為法律專業人士提供了每個明細項目和數字的詳細記錄,以便他們進行審閱。
Legora 的法務工程師 Percevale Perks 表示:「我認為前後的改變在於處理能力,能夠處理如此大量的檔案、消化真正複雜的資訊,並取得所有不同的明細項目和數字。」
Agent 負責執行詳盡的比對工作,而專家則仍需對每個結果做出判斷。這種「人類在迴圈中」(human in the loop)的方法,是 Legora 將其平台從法律工作擴展到審計、稅務、合規和風險管理等領域的核心策略。
Legora 使用其「代理推理基準測試」(Legora Benchmark for Agentic Reasoning, BAR)評估了 GPT-6 Astra,該基準測試衡量了從實際案例中提取的端到端法律任務的表現。Legora 報告指出,在財務報表核對工作流程中,GPT-6 Astra 的表現比前一代模型提升了近 40%。而在 BAR 中的所有任務,平均提升約 3%。
在核對工作中,Legora 在 Percevale 所描述的準確性、完整性和可靠性方面都看到了進步。GPT-6 Astra 找出了 Legora 在帳目中預設的所有四個錯誤,包括隱藏在收入附註中的 50 萬英鎊差異。它比對了每個餘額與其支援的附表,並記錄了每次檢查。此外,它保留了前一代模型正確的所有檢查,並額外完成了約 50 項檢查。
最終結果是更完整、更快速的初步審閱,以及更清晰的審閱記錄,而最終決策仍由法律專家負責。

