Reducto とは
Reducto は、AI のワークフローがモデルではなくドキュメントで止まっているチームのための、ドキュメントのパースと抽出の API です。Adit Abraham と Raunak Chowdhuri は LLM の長期記憶システムを開発したのち、未解決なのは乱雑な PDF をエージェントが動ける構造化データに変える部分だと結論づけ、Y Combinator から独立してこの会社を立ち上げました。Reducto はページを 1 つのテキストの塊に潰すのではなく、レイアウト、フォーマット、構造を意味のシグナルとして読みます。契約書の赤線、手書きの投与量、開示書類の 3 ページにまたがる表といったものです。
製品はチャット画面ではなく、6 つのエンドポイントです。Parse はドキュメントをレイアウトを踏まえたチャンク分割つきの構造化 JSON に変換し、Extract は指定したスキーマに名前つきフィールドを引き出し、Split は自然言語のルールで分割し、Classify はドキュメント種別でルーティングし、Pipelines はこれらの手順をつなぎます。そして Edit は変更を PDF と DOCX に書き戻します。Reducto はこれを最初期のドキュメント編集 API の 1 つと呼んでおり、競合が持っていないのはこの部分です。土台にあるのは r-1 で、OCR の出力を別のレイアウト検出器に縫い合わせるのではなく、テキスト、表、図版、書式を 1 回のパスでまとめて扱うフルページモデルです。Python、Node、Go の SDK、REST API、CLI、MCP サーバー、そしてコードに組み込む前にパイプラインを試せるビジュアル環境の Studio が用意されています。
a16z は 2025 年 10 月 14 日に発表された 7,500 万ドルのシリーズ B をリードし、Benchmark、First Round Capital、BoxGroup、Y Combinator の参加を得て累計調達額は 1 億 800 万ドルになりました。2,450 万ドルのシリーズ A から 6 か月後です。Reducto は累計 10 億ページ超の処理と、2 つのラウンドの間に月間処理量が 6 倍に伸びたことを公表し、顧客として Harvey、Mercor、Rogo を挙げています。2026 年 5 月 7 日には初の買収として、AI 学習ノート Opennote のチームを迎え入れました。
オペレーションのスタックに入る理由
ボトルネックがプロンプトより手前にあるからです。取り消し線の条項を見落とす契約レビューのアシスタント、結合セルを誤った列として読む請求書のパイプライン、2 段組の履歴書を壊す ATS。どれもモデルを良くしても直りませんし、プロンプト調整に費やした時間はすべて誤ったレイヤーに費やされています。Reducto は、抽出は自前で維持するのではなく買うものだ、という主張そのものです。
Legal Ops にとってそれは Ironclad や Spellbook の下にあるドキュメント層です。そこでの素材はきれいなテンプレートではなく、スキャンされた締結済みの写しだからです。RevOps にとっては、CRM に決して届かない発注書、締結済みの MSA、価格の別紙です。recruiting にとっては履歴書のパースで、10 年にわたりどの ATS でも最も弱い環でした。
セキュリティレビューを通る理由はデプロイにもあります。SaaS、ハイブリッド VPC、フル VPC、エアギャップのオンプレミスに対応し、SOC 2 Type II、HIPAA の BAA、保存時の AES-256、通信時の TLS 1.2+、EU のデータレジデンシー、24 時間でのドキュメント削除を備えます。
買う価値のあるユースケース
社内法務チームが詰まる契約書の抽出作業です。数千件の締結済み契約、その半分はスキャン、そこから準拠法、更新日、譲渡条項、責任上限を監査可能な表に引き出す必要があります。Classify が契約種別でルーティングし、Split が別紙を切り出し、Parse がレイアウトを踏まえた JSON を生成し、Extract がスキーマを埋めます。各フィールドはページ座標まで遡れます。汎用モデルが PDF を要約した結果とは違い、成果物が説明可能になるのはここです。
料金
料金は 2026 年 9 月 1 日から、シート課金なしのエンドポイント別・ページ別です。Parse は複雑さに応じて 1,000 ページあたり 10〜30 ドル、Extract と Split は 20〜40 ドル、Classify は 7.50〜15 ドル、Edit は 1,000 ページあたり 60 ドル、事前入力済みなら 1,000 ページあたり 15 ドルです。スプレッドシートはセル単位で計測し、バッチ処理は 20% 引きになります。Standard は 150 ドル分の無料利用から始まり、これは定価の Parse で 15,000 ページ分です。
1 ページ 1 セントという見出しの数字は下限であって、請求額ではありません。月 10 万ページの Parse のみのパイロットで月 1,000 ドルです。classify、split、parse、extract の 4 段構成の本番パイプラインは同じページに対して 4 つのメーターを課金するので、月 25 万ページなら定価で月 14,400 ドル前後、ボリュームディスカウント前で年間およそ 17 万 3,000 ドルに着地します。予算はこの帯に対して組んでください。
Growth と Enterprise は見積もりのみです。Growth はボリュームディスカウント、データレジデンシー、Studio の無制限シートを追加し、Enterprise は VPC とオンプレミス、個別 SLA、SSO/SAML、RBAC を追加します。もう 1 つの階層の境目は同時実行数で、Standard が 200 ページ、Growth が 350 ページ、Enterprise が 500 ページ以上です。調達額 1,500 万ドル未満、売上 300 万ドル未満、従業員 50 名未満のチーム向けに、無料クレジットと割引後の Growth 料金を提供するスタートアッププログラムがあります。
最適な相手
AI のワークフローをすでに構築し、抽出品質ですでに頭打ちになり、そもそも正しく読めるはずのないドキュメントに対して汎用モデルのプロンプト調整にエンジニアリング時間を燃やしている Legal Ops と Finance Ops の責任者です。採算が合うのは月 5 万ページを超えるあたりから、しかもスキャン、密な表、多段組のレイアウト、手書きといった本当に難しいドキュメントの場合です。
きれいで均一な機械生成のフォームのために買ってはいけません。どのドキュメントも同じデジタル請求書テンプレートなら、ハイパースケーラーの OCR サービスがはるかに安く同じ仕事をします。エンドユーザー向けアプリケーションとして買うのも違います。Reducto が出すのは API と構築用のワークスペースで、統合を書くのはあなたのチームの誰かです。そのコードを持つ人がいないなら、抽出が中に入ったワークフロー製品を買ってください。
代替と、それを選ぶ場面
- Azure AI Document Intelligence: 導入実績で見た既存勢で、会社がすでに Azure のコミットメントを抱えているときの既定の選択肢です。ドキュメントが定型フォーム、請求書、身分証明書で、表の再現性より調達の都合が重いなら、こちらを選んでください。Reducto 自身の RD-TableBench は、1,000 件の複雑な表で Azure を 82.7%、Reducto を 90.2% としています。このベンチマークはベンダー自身が実施したものなので、順位は検証すべき仮説として扱ってください。
- AWS Textract: もう 1 つの既存勢で、Bedrock につなぐ AWS ネイティブのパイプラインには正しい選択です。ただし Textract は思われているほど安い選択肢ではありません。フォームと表の抽出は 1 ページあたり約 0.065 ドルで、Reducto の Parse の定価を上回ります。同じベンダー実施の表ベンチマークでは 80.9% でした。
- Mistral OCR: 最も成長の速い新規参入で、価格の下限です。OCR 4 は 2026 年 6 月 23 日に 1,000 ページあたり 4 ドル (バッチで 2 ドル) でリリースされ、段落単位のバウンディングボックス、信頼度スコア、170 言語に対応します。OCR 3 は 1,000 ページあたり 2 ドル (バッチで 1 ドル) のままです。テキストとレイアウトを最小の単価で大量に必要としていて、複雑な表の再現性が効いてくる制約でないなら、こちらを選んでください。月 100 万ページなら、Reducto のフルパイプラインとの差は月あたり 5 桁ドルになります。
注意点
- 買おうとしている精度の差はベンダーが測ったものです。 RD-TableBench は Reducto 自身の表データセット上の、Reducto 自身のベンチマークです。ガード: 契約前に、手作業でラベル付けした正解データに対して、自社で最も汚い実ファイル 200 件の評価を回し、本番で抽出するのと同じフィールドで採点してください。150 ドルの無料枠は Parse 15,000 ページ分をまかなえるので十分です。自社のドキュメントで差が残らないなら、それこそ知るべきことを学んだことになります。
- 1 ページに 4 つのエンドポイントは、4 つのメーターです。 社内で引用されるのは 1 ページ 1 セントの Parse の料金ですが、classify-split-parse-extract のパイプラインは 1 ページ約 0.058 ドルで、同じドキュメントに対して 5.8 倍の差になります。ガード: パイロットの前にパイプライン全体のページ単価を積算し、Studio でドル閾値のアラートを設定し、使用量エクスポート API をクラウド支出を見ている仕組みに流し込んでください。
- セキュリティレビューが求めるものはすべて Enterprise にあります。 SSO/SAML、RBAC、個別 SLA、VPC、オンプレミスはいずれも Growth より上の線にあり、ゼロリテンションの条件と HIPAA の BAA は Growth 以上です。ガード: 秘匿特権のある資料や規制対象の資料が対象に入るなら、最初の商談から Enterprise で見積もり、保存期間の条件を契約書に書き込んでください。Standard はプロトタイプ用の階層であって、顧客のドキュメントを送る階層ではありません。
- 設立 2 年の会社が、本番ワークフローの依存するレイヤーを握っています。 Reducto は買収される側ではなく買収する側で、短期のリスクは下がりますが、集中は現実です。ガード: 抽出の呼び出しを自社のインターフェースの内側に置き、Azure、Textract、Mistral への乗り換えを設定変更で済むようにし、パース済みの JSON だけでなく元のドキュメントも保管してください。