For the complete documentation index, see llms.txt. This page is also available as Markdown.

GLM-OCR

Serverless Hosted API を通じて画像 OCR に GLM-OCR を使用します

GLM-OCR は、GLM vision-language model ファミリーに基づく OCR モデルです。画像からテキストを文字起こしし、レイアウトが混在する文書、標識、ラベルに適しています。GLM-OCR は、当社の Serverless Hosted API, Dedicated Deployments、および self-hosted Inference.

コードサンプル

GLM-OCR は共有の /infer/lmm エンドポイント経由で動作します。HTTP エンドポイントを直接 curl、または inference-sdk ラッパー。

1

API Key を取得する

Roboflow アカウントを作成し、キーを次の場所で見つけます Roboflow API 設定ページ そしてシェルで利用できるようにします:

export ROBOFLOW_API_KEY="your-key-here"
2

モデルを実行する

次を呼び出します /infer/lmm エンドポイントを使って curl:

curl --location 'https://serverless.roboflow.com/infer/lmm' \
  --header 'Content-Type: application/json' \\
  --data '{
    "api_key": "'"$ROBOFLOW_API_KEY"'",
    "image": {"type": "url", "value": "https://media.roboflow.com/inference/license_plate_1.jpg"},
    "model_id": "glm-ocr",
    "prompt": "OCR",
    "max_new_tokens": 128
  }'

推論速度

〜で測定されたレイテンシ Roboflow Inference 1x NVIDIA L4、バッチサイズ 1、固定プロンプトから greedy decoding でちょうど 128 トークンを生成して測定。レイテンシは出力長に応じて変化するため、他の長さを推定するには tokens/sec を使用してください。

別名
レイテンシ、128 トークン (ms)
トークン/秒

glm-ocr

1850

69

設定する api_url をデプロイ先に合わせてください:

  • https://serverless.roboflow.com Serverless Hosted API 用。

  • http://localhost:9001 ローカルの Inference サーバー用。

  • あなたの Dedicated Deployment プライベートエンドポイントの URL。

最終更新

役に立ちましたか?