space ocr
ガイド記事料金ドキュメント
comparison

Amazon Textract の代替をお探しですか?

Amazon Textract の代替を選ぶべき場面を、事実検証済みの公平な視点で解説します——値ごとの出所座標、確認対象を明示する検討リスト、CJK(日本語・韓国語・中国語)対応、クエリ可能なシート、明朗な料金、AWSのセットアップ不要。

8 分で読了· 2026-08-31

Amazon Textract は実力のある成熟したOCRサービスで、英語の書類を大規模に処理するAWSネイティブなパイプラインなら、妥当な既定の選択肢です。しかし「実力がある」ことと「あなたの業務にちょうど合う」ことは別物で、いくつかの現実的な制約から Amazon Textract の代替を探す人も少なくありません。

  • CJK は対応言語一覧にありません。 Textract の印刷テキスト・フォーム・テーブルの各機能は、ラテン文字系の一群(英語、フランス語、ドイツ語、イタリア語、ポルトガル語、スペイン語)を対象とし、手書き、請求書・領収書(AnalyzeExpense)、身分証(AnalyzeID)、Queries は英語のみと明記されています。日本語・韓国語・中国語はその一覧に入っていません。
  • AWSへの引力。 利用にはAWSアカウント、IAM、SDK、対応リージョン、そしてたいていはS3が必要です——画像を送ってフィールドを受け取りたいだけなら、これは実質的なセットアップコストです。
  • 機能を重ねるページ単位の料金。 料金はページ単位で、呼び出す機能(プレーンテキスト/フォーム/テーブル/クエリ/エクスペンス)によって単価が変わり、機能を組み合わせるとコストが積み上がります。
  • 値ごとの確認は別サービスです。 Textract は信頼度スコアを返しますが、人手による確認(human-in-the-loop)は Amazon Augmented AI(A2I)で、自分で組み込む必要があります。

このガイドは公平な比較です——Textract が強い場面と、space-ocr のような代替が合う場面——を整理します。

Textract の代替を評価するときに比べるべきこと

どちらのツールも書類を読み取り、座標付きの構造化データを返します。違いは、値をどうやって検証するか、どの言語に対応するか、データがどうやってツールの外に出るか、そして始めるのにいくらかかるか、にあります。下の表は両者の検証済みの事実を並べたものです——ご自身のワークロードのチェックリストとしてお使いください。

機能Amazon Textractspace-ocr
バウンディングボックスあり——ブロックごとに0〜1正規化の BoundingBoxPolygonあり——値ごとに box{ xmin, ymin, xmax, ymax })と4点の quad。いずれも0〜1000正規化
値ごとの検証シグナルブロックごとの認識信頼度(%)判定の verified、引っかかった理由をランク順に並べた review.reasons、裏付けの evidencetext_matchsourcematch_ratio
値ごとのレビューUIが組み込みTextract 自体にはなし。人手確認は別サービス(Amazon A2I)アプリに組み込み——セルをクリックすると、その正確な領域が元画像上で光る
領収書・請求書フィールドAnalyzeExpense(別API)、英語のみ欲しい項目を fields で宣言するか、autoFields にスキーマを提案させる——エンジンが読む言語ならどれでも
明細行AnalyzeExpense の明細行(ITEM / QUANTITY / PRICE)children を持つ array フィールド。各セルが自分のパス(items[0].price)で引ける
日本語・韓国語・中国語記載なし(ラテン文字系6言語。Expense/ID/手書きは英語のみ)一つのエンジンが日本語・韓国語・中国語・英語などを自動判定
クエリ可能なストレージ結果は自分で保存・クエリ保存済みシートを GET /viewwheresortselect)でサーバー側からクエリ——再OCRも追加料金もなし
CSVエクスポートJSONから自分で組み立てるワンクリック——UTF-8 BOM、明細行は展開済み
料金モデルページ単位、機能ごとに課金。機能を組み合わせるとコストが積み上がる。さらにAWSアカウント前提一律 1枚あたり¥10。無料枠は月100クレジット、カード不要。Pro は月額¥8,980
セットアップAWSアカウント + IAM + SDK、リージョン依存サービス、たいていS3Bearerキー1本でHTTPSを1回呼ぶだけ。同じAPIはAIエージェント向けのMCPエンドポイントとしても開いています
✓ Verified

「検証可能」について:座標はモデルの言い分を鵜呑みにしていません。 言語モデルは各フィールドのテキストと、どの単語トークンを使ったかのヒントを返しますが、ボックスそのものは決して返しません。エンジンはそのテキストを、ビジョンOCRがページ上で実際に検出したシンボルと文字単位で照合します。だからこそボックスは、それらの文字が見つかった実際のピクセルに配置されます。照合が走った値には、どれだけ照合できたかを示す evidence.match_ratio が付き(0.85以上で確実にマッチしたものとして扱います)、照合できなかった場合はそのキー自体がありません。モデルのトークンヒントはノイズを含むことがあり——繰り返し行の間で取り違えることがあります——そのため鵜呑みにするのではなく、列・行の整合性チェックで検証します。要点は、AIが間違えないということではありません。二つの仕組みが同じ誤読で一致することもあります。要点は、黙って通り過ぎる不一致が表に出るということです——セルの review の理由として、そして data.review.flagged の一行として。

Textract のほうが優れている場面

公平な比較なら、既存サービスが勝る場面もきちんと挙げるべきでしょう。次のような場合は Textract を選んでください。

  • すでにAWSに深く根を張っており、運用中のIAMやSNSとともに S3 → Lambda → Textract に組み込めるOCRが欲しいとき。
  • 書類が英語/ラテン文字系で、フォーム・テーブル・クエリを超大規模に処理する必要があるとき。
  • 自社の書類タイプで学習したカスタムアダプターや、AWSネイティブなコンプライアンス・データレジデンシーの保証が欲しいとき。

これに当てはまるなら、Textract はよく合っており、代替に乗り換えても得られるものはわずかです。

代わりに space-ocr が合う場面

Textract の代替が本領を発揮するのは、次のいずれかが重要なときです。

  • 日本語・韓国語・中国語の書類を処理する。 space-ocr はCJKとラテン文字系を一つのエンジンで処理し、言語は自動判定します——設定する言語パラメータはありません。
  • 信じるのではなく、検証したい。 業務データは data.values に入り、同じパスで data.cells を引くと、boxquad・判定の verified・理由の review・裏付けの evidence が並びます。要確認の一覧は data.review.flagged で、アプリでセルをクリックすればどこから読み取られたかが正確にハイライトされます。
  • ストレージを立ち上げたくない。 結果はサーバー側でクエリできるシート(GET /view)に入り、ワンクリックでCSVにエクスポートできます——データベースもAWSアカウントも不要です。
  • 予測できる料金が欲しい。 一律1枚あたり¥10、カード不要の月100クレジット無料枠、そして月額¥8,980のProプラン——機能ごとにページ料金が積み上がることはありません。
  • AIエージェントで開発する。 同じAPIを https://mcp.space-ocr.com/mcp のMCPエンドポイントとして開いています——claude mcp add --transport http の1行か、mcp.json にURLとBearerヘッダーを1組。インストールするものはありません。

呼び出し全体がHTTPリクエスト1回です——SDKは不要。エンジンはラスター画像を読むので、PDFはページを画像に変換してから送ります(Webアプリではその変換を自動で行います)。

請求書を抽出する——リクエスト1回、Bearerキー、AWS不要
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
curl -s https://api.space-ocr.com/ocr/fields \
  -H "Authorization: Bearer $SPACE_OCR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "image": "https://example.com/invoice.jpg",
    "imageType": "url",
    "fields": [
      { "name": "invoice_no", "type": "string", "required": true },
      { "name": "date",       "type": "date" },
      { "name": "items",      "type": "array",
        "children": [
          { "name": "name",  "type": "string" },
          { "name": "qty",   "type": "string" },
          { "name": "price", "type": "string" }
        ] },
      { "name": "total",      "type": "number", "required": true }
    ]
  }'

値は送ったスキーマそのままの形で data.values に返ります。その形の各パス——totalitems[0].price——がそのまま data.cells のキーになり、box(0〜1000グリッド上の { xmin, ymin, xmax, ymax })と、傾いたスマホ写真に沿う4点の quad、さらに verifiedreviewevidence が並びます。座標の基準となる紙面の幅と高さは data.image です。確認すべきものは data.review.flagged に一箇所へまとまり、各項目が pathreasons の組になっています。datetotal にスカラー型を宣言したので、解釈済みの値が疎な data.normalized として値の隣に届きます。座標モデルの全体像はバウンディングボックス付きOCR APIを、非同期・Webhook主導の側面は請求書データ抽出APIガイドをご覧ください。

どのセルをクリックしても、対応する領域が元画像上で光ります——Textract が別サービスに委ねている、値ごとの検証です。

言語:最もはっきりした分かれ目

書類が日本語の領収書、韓国語の請求書、中国語のフォームなら、たいていこれが決め手になります。Textract の印刷テキスト・フォーム・テーブルの各機能はラテン文字系6言語に対応し、手書き、AnalyzeExpense、AnalyzeID、Queries の各機能は英語のみで——日本語・韓国語・中国語は対応リストに入っていません。space-ocr は複数の文字体系を一つのエンジンで正規化し(全角・半角、ハイフンの異体、CJKの字間、縦書き漢字、混在文字)、言語を自動判定するため、渡すヒントはありません。

料金:機能ごとのページ課金 vs. 1枚あたりの一律料金

Textract は、機能によって単価が変わるページ単位の従量課金です——プレーンテキスト検出はフォーム、テーブル、クエリ、AnalyzeExpense とは別に課金され、1ページで複数機能を呼び出すとコストが積み上がります——しかもすべてAWSアカウントの上にです。space-ocr は、いくつフィールドを取り出しても一律 1枚あたり¥10で、カード不要の月100クレジット無料枠があり、Pro は月額¥8,980で1,100クレジット、シート無制限、100GBのストレージが付きます。抽出に失敗したものは課金されず、保存済みシートへのクエリ(GET /view)は無料です。

Textract の代替として space-ocr を試す手順

  1. キーを取得する——AWSアカウント不要
    無料枠(カード不要、月100クレジット)に登録して spocr_ APIキーを取得します。設定すべきIAMもリージョンもS3もありません。
  2. 画像を送信する
    書類を imageType 'url' または 'base64' で /ocr/fields へPOSTします。エンジンはラスター画像を読むので、PDFはページを画像に変換してから送ってください。言語は自動判定されます。
  3. フィールドを宣言する
    欲しい項目を fields に並べます——それぞれ name と type を与え、明細行には children を持つ array フィールドを使います。書かずに済ませたい場合は autoFields を true にすると、モデルが書類からスキーマを提案します。
  4. 各値を検証する
    パスごとに data.cells[path] を読みます——読み取り元の領域は box と quad、判定は verified、理由は review、裏付けは evidence です。要確認リストはスコアのしきい値ではなく data.review.flagged から組み立てます。アプリではセルをクリックすると、それが読み取られた場所が正確にハイライトされます。
  5. クエリまたはエクスポート——ストレージの構築不要
    /upload で画像をシートに投入し、GET /view(where、sort、select)でサーバー側からクエリするか、明細行を展開したCSVをダウンロードします——データベースも再OCR料金もありません。
無料で使える Amazon Textract の代替はありますか?
space-ocr には、クレジットカード不要・AWSアカウント不要の月100クレジットの無料枠があります。それを超えると一律1枚あたり¥10で、Pro は月額¥8,980で1,100クレジットです。Textract の機能ごと・ページごとのモデルと違い、いくつフィールドを抽出しても料金は変わらず、抽出に失敗したものは課金されません。
space-ocr は、Textract が記載していない日本語・韓国語・中国語に対応していますか?
対応しています。space-ocr は日本語、韓国語、中国語、英語などの文字体系を一つのエンジンで自動判定して処理します——設定する言語パラメータはありません。Amazon Textract の印刷テキスト・フォーム・テーブルの各機能はラテン文字系6言語に対応し、手書き、AnalyzeExpense、AnalyzeID、Queries の各機能は英語のみのため、CJK書類は代替を選ぶよくある理由です。
OCRが抽出した内容はどう検証できますか?
値ごとに、自分のパスで data.cells に項目が入ります。読み取り元の領域を示す box と4点の quad、判定の verified、引っかかったときの理由を持つ review、そして text_match・source・match_ratio などの evidence です。verified は review の鏡で、理由が一つでも付けば false、照合が走って何も付かなければ true、照合する対象がなければ null になります。要確認の一覧は data.review.flagged で、座標を立てられなかった値は理由 nobox として、必須なのに空で返った値は missing として、ここに現れます。アプリではどのセルをクリックしても、それが読み取られた正確な領域がハイライトされます。二つの仕組みが同じ誤読で一致することもあるので、業務ルールの検査は引き続きご用意ください。Textract では認識信頼度スコアが得られ、値ごとの人手レビューは別サービスである Amazon Augmented AI(A2I)が担います。
space-ocr を使うのにAWSアカウントは必要ですか?
不要です。space-ocr は https://api.space-ocr.com にある独立したHTTP REST APIです。各リクエストはBearerキー1本で認証します(IAMもリージョン選択もS3も不要)。同じAPIは https://mcp.space-ocr.com/mcp のMCPエンドポイントとしても開いているので、AIエージェントからツールとして呼べます——claude mcp add --transport http の1行か、mcp.json にURLとBearerヘッダーを1組で、インストールするものはありません。画像をURLまたはbase64で送れば、構造化されたフィールドがそのまま返ってきます。
space-ocr は AnalyzeExpense のように領収書・請求書の明細行を抽出できますか?
できます。明細行は、1行(品名、数量、単価など)を children で記述した 'array' 型のフィールドとしてリクエストするか、autoFields に書類からスキーマを提案させます。各セルは data.cells で自分のパス(items[0].price)を持ち、それぞれの box と quad を保つので、折り返しや結合された明細行でも追跡できます。行のパス items[0] は行全体のユニオンボックスです。しかも AnalyzeExpense と違い、英語に限定されません。
関連記事