For the complete documentation index, see llms.txt. This page is also available as Markdown.

Google Vision OCR

Google Vision APIを使用して画像内のテキストを検出します

Google Vision OCR を使用して画像内のテキストを検出します。

サポートされているテキスト検出の種類:

  • text_detection: より大きな画像内のテキスト領域向けに最適化されています。

  • ocr_text_detection: 密集したテキスト文書向けに最適化されています。

Google Vision API キーを指定するか、値を次のように設定してください rf_key:account (または rf_key:user:<id>)を指定すると、Roboflow の API 経由でリクエストをプロキシします。

型識別子

ステップで次の識別子を使用してください "type" フィールド: roboflow_core/google_vision_ocr@v1 ワークフローにこのブロックをステップとして追加するには。

プロパティ

名前

説明

参照

name

str

このステップの一意の識別子を入力してください。

ocr_type

str

使用する OCR の種類。

api_key

str

Google Vision API キー。

language_hints

List[str]

OCR API に渡す言語コードのオプション一覧。指定しない場合、API は言語を自動的に検出しようとします。指定する場合、言語コードは OCR API でサポートされている必要があります。サポートされている言語コードの一覧は https://cloud.google.com/vision/docs/languages を参照してください。

この 参照 列は、で利用可能な動的値を使ってプロパティをパラメータ化できる可能性を示します ワークフロー 実行時。参照 バインディング 詳細は。

ランタイム互換性

requires_internet - エアギャップ/オフライン環境: このブロックは、完全にオフライン/エアギャップ環境から到達できないサービスに依存しています。

入力と出力のバインディング

利用可能な接続は、そのバインディング種別によって異なります。どのバインディング種別が Google Vision OCR のバージョン v1 あるか確認してください。

入力と出力のバインディング
JSON 定義の例

最終更新

役に立ちましたか?