Ur AI(本社:東京、代表:エラ・サンディープ)は2026年7月13日、日本語ビジネス文書をAI向けに変換するドキュメントAI製品「Nebula」の提供を開始しました。Nebulaは、プラットフォームおよびAPIで利用できる「Nebula Frontier」と、顧客環境内で動作する完全自社ホスト版「Nebula Sovereign」の2つの形態で提供します。PDFなどの文書をAIアプリや生成AIツールにうまく読み込めない、文書を渡すたびにトークンコストが膨らむ、といった課題にはNebula Frontierが、AI活用の拡大にともなうコストやセキュリティの制約にはNebula Sovereignが応えます。
あわせてUr AIは、文書変換後に「意味」がどれだけ保持されるかを測る新ベンチマーク「RCRR Benchmark」を公開し、Nebulaを含む複数のドキュメントAI製品・フロンティアVLM APIの比較評価結果を発表しました。Nebula FrontierはRCRR総合スコア94.4を記録し、評価対象のドキュメントAI製品の中で最高スコアとなりました。Fable 5、GPT-5.6 Sol、Gemini 3.1 Proといった最新フロンティアVLM APIとも統計的同等(有意差なし)であり、テキスト・表の設問では評価した全システム中の最高スコア(94.3)を記録しています。Nebula Sovereignは87.3を記録し、Microsoft Azure Document Intelligenceと統計的に同等(有意差なし)の結果となりました。
発表の背景
企業の知識の多くは、PDF、スキャン文書、スライドの中に蓄積されています。生成AIにこれらの文書を読ませるには、機械可読な形式への変換が必要です。しかし、その過程で、数値と項目の対応関係、表の構造、チャートの意味などが失われることがあります。
文字そのものは正しく読み取れていても、文書の構造が壊れることで、AIの回答が誤る場合があります。Ur AIは、この課題を「文書変換における意味の保持」の問題として捉え、RCRR Benchmarkを開発しました。
RCRR Benchmarkの概要
RCRR(reading-comprehension recovery:読解回復率)は、文字の一致率ではなく、変換後の文書を読んだAIが、人間なら元のページから答えられる質問にどれだけ答えられるかを測る指標です。
本ベンチマークは、TDnetで公表された実在の日本語IR資料99ページをもとに構築し、独立に検証済みの1,410問を、すべてのシステムに同一条件で出題・採点しました。実運用では100ページを超えるPDFや複数ファイルを扱うため、フロンティアVLM APIはページ画像入力(実運用条件)で評価しています。
評価結果
評価の結果、Nebula FrontierはRCRR総合スコア94.4を記録し、評価対象のドキュメントAI製品の中で最高スコアとなりました。フロンティアVLM APIではFable 5が94.6、GPT-5.6 Solが94.0、Gemini 3.1 Proが93.7で、いずれもNebula Frontierと統計的同等(有意差なし)です。Azure Document Intelligenceは88.2、Nebula Sovereignは87.3、Mistral OCRは73.6でした。その他の商用・オープンソースOCRは20.2〜85.9で、全システムの完全な比較は技術レポートに収載しています。
図1:ドキュメントAI製品・フロンティアVLM APIのRCRR総合スコア比較
Nebula Frontierは、フロンティアVLM APIをUr AIの変換パイプライン(全ページ変換、PDFテキスト層の併用)で動かすオーケストレーション版です。本評価では、最も強力な商用クラウドOCRであるAzure Document Intelligenceに6.2ポイントの差をつけ、統計的に有意に上回りました。最新のフロンティアVLM API(Fable 5、GPT-5.6 Sol、Gemini 3.1 Pro)とは統計的同等(有意差なし)であり、テキスト・表の設問では評価した全システム中の最高スコア94.3を記録しています。
Nebula Sovereignは、fine-tuningを施したQwen3-VL-32Bが、自社の管理するGPU上だけで完結して動作する完全自社ホスト版です。Azure Document Intelligence(88
.2)とは統計的に同等(有意差なし)、Mistral OCR(73.6)には約14ポイントの差をつけました。
チャート設問に限ると、Nebula Frontierは94.7、Nebula Sovereignは77.3を記録し、Azure Document Intelligenceの69.1を上回りました。チャートを含む文書では、数値そのものが読み取れていても、どの項目に対応する数値なのかが誤って解釈されることがあります。RCRRは、このような「文字は読めているが意味が壊れている」ケースを評価できる点に特徴があります。
図2:チャート設問におけるRCRRスコア比較
図3は、RCRR Benchmarkで対象とするチャート文書の一例です。このような損益増減のウォーターフォールチャートでは、各数値がページ上に明確に表示されていても、変換時に「どの数値がどの項目に対応するか」が崩れることがあります。たとえば、為替差、価格/MIX、固定費などの項目と数値の対応を誤ると、変換後の文書を読んだAIは、ページ上に実在する別の数値をもっともらしく回答してしまいます。RCRRは、このような「文字は読めているが、意味の対応関係が壊れている」ケースを評価するためのベンチマークです。
図3:RCRR Benchmarkで対象とするチャート文書の例
Nebulaの提供形態
Nebula Frontier:フロンティアVLM APIを束ねるオーケストレーション版です。プラットフォームおよびAPIから利用でき、本日より提供を開始します。プラットフォーム:nebula.ur-ai.net、APIドキュメント:ocr.ur-ai.net/docs。
Nebula Sovereign:顧客の管理するGPU上で動作する、完全自社ホスト・fine-tuned版です。データが顧客環境の外に出ないため、金融、保険、半導体、ヘルスケアなど、機密性の高い文書を扱う企業向けに提供します。
価格
Nebula Frontier:1ページあたり10円(税別、従量課金)から。 100ページ未満のPDFは、プラットフォーム上で無料でお試しいただけます。
Nebula Sovereign:導入形態に応じた個別見積もりです。データが顧客環境から出ない、定額型の運用が可能です。
自社ホスト版「Nebula Sovereign」について
Nebula Sovereignは、顧客環境内で動作する自社ホスト型の提供形態によ
FACT BOX ・ 要点整理
- 出典:PR TIMES
- 分類:新製品
- 関連組織:Microsoft / Mistral / Fable
- 製品・サービス:Nebula Frontier / Nebula Sovereign