shiichan

たった 1 つの見落としも許さない!Hebbia の財務 AI が Claude Fable 5 で精度 20% アップ

こんにちは、しぃちゃんだよ!今日は「見逃しが許されない」金融の世界で、AI がどこまで信頼されているかというお話だよ。

Claude Blog claude.com

なにが発表されたの?

Claude Blog の「Working at the frontier」シリーズで、金融デューデリジェンス向けの AI プラットフォームを作る Hebbia が、Claude Fable 5 をどう活用しているかが紹介されているよ。

Hebbia のファウンディングプロダクトマネージャー Divya Mehta さんによると、Fable 5 がとくに強いのは「大量のデータの中から正しい情報を見つけ出して、それを正確に統合する」ところなんだって。リサーチャーの Joe Renner さんも、これまで試したどのモデルよりも高いスコアを記録した、と話しているよ。

今までどうだったの?

これまでのモデルだと、複雑で複数のステップからなる依頼を投げたときに、途中でいくつかの問いを取りこぼしてしまうことがあったみたい。金融の意思決定に関わる場面では、こういう抜け漏れは致命的になりかねないよね。

これで何が変わるの?

Claude Fable 5 では、複雑な複数パートの依頼を同時に抱えても取りこぼさずに追いかけられるようになったんだって。しかも、推測で答えを埋めるんじゃなくて、根拠となる原本の記述にちゃんと立ち返って主張を裏付けてくれるの。

金融文書に対する質問応答・引用タスクでは、約 20% の相対的な精度向上を記録。これは Hebbia がこれまで測ってきた中で、いちばん大きな精度改善なんだって。

Hebbia は、トップ 50 の資産運用会社の 3 分の 1 以上や、一流の投資銀行・法律事務所に使われているの。比較のベンチマークは「置き換える予定のモデル」と比べる形で、しかも顧客がディールレベルの意思決定に使う以上、基準自体をかなり厳しく設定しているんだって。

深く潜ってみよう

たとえば投資向けのデッキ資料を作るような作業だと、これまで 2〜3 日かかっていたものが数分に圧縮されるらしいの。銀行員の人たちは、資料をかき集める作業から解放されて、戦略的なポジショニングを考える時間に集中できるようになるんだって。

まとめ

  • 金融デューデリジェンス AI の Hebbia が、Claude Fable 5 で過去最大の精度改善を記録
  • 金融文書への質問応答・引用タスクで約 20% の相対的な精度向上
  • 複雑な複数ステップの依頼を取りこぼさず、根拠を原本に立ち返って確認できるように
  • 投資デック作成のような作業が、2〜3 日から数分に圧縮される事例も

金融・法務など「絶対に見落としが許されない」仕事に AI をどこまで任せられるか気になる人は、注目の事例だよ。