For the complete documentation index, see llms.txt. This page is also available as Markdown.

DocTR

हमारे Serverless Cloud API के माध्यम से DocTR OCR मॉडल का उपयोग करें

DocTR हमारे माध्यम से परिनियोजित किया जा सकने वाला एक दस्तावेज़ OCR मॉडल है सर्वरलेस क्लाउड API के माध्यम से समर्थित करते हैं.

कोड नमूना

HTTP एंडपॉइंट के माध्यम से सीधे DocTR चलाएँ curl, या inference-sdk रैपर के साथ।

1

अपनी API कुंजी प्राप्त करें

एक Roboflow खाता बनाएँ, अपनी कुंजी यहाँ ढूँढें Roboflow API सेटिंग्स पेज और इसे अपने शेल में उपलब्ध कराएँ:

export ROBOFLOW_API_KEY="आपकी-कुंजी-यहाँ"
2

मॉडल चलाएँ

को कॉल करें /doctr/ocr एंडपॉइंट के साथ curl:

curl --location 'https://serverless.roboflow.com/doctr/ocr' \
  --header 'Content-Type: application/json' \
  --data '{
    "api_key": "'"$ROBOFLOW_API_KEY"'",
    "image": {"type": "url", "value": "https://media.roboflow.com/inference/license_plate_1.jpg"}
  }'
1

अपनी API कुंजी प्राप्त करें

एक Roboflow खाता बनाएँ, अपनी कुंजी यहाँ ढूँढें Roboflow API सेटिंग्स पेज और इसे अपने शेल में उपलब्ध कराएँ:

export ROBOFLOW_API_KEY="आपकी-कुंजी-यहाँ"
2

निर्भरताएँ इंस्टॉल करें

यह पैकेज मॉडल को कॉल करता है:

pip install -U inference-sdk supervision
3

मॉडल चलाएँ

पाठ वाली छवि पर DocTR चलाएँ:

import os
import supervision as sv
from inference_sdk import InferenceHTTPClient

# पाठ वाली नमूना छवि
image = sv.load_image_from_url("https://media.roboflow.com/inference/license_plate_1.jpg")

client = InferenceHTTPClient(
    api_url="https://serverless.roboflow.com",
    api_key=os.environ["ROBOFLOW_API_KEY"],
)

result = client.ocr_image(inference_input=image, model="doctr")

print(result["result"]) # निकाला गया पाठ

ऊपर दिया गया कोड अनुमान के परिणाम टर्मिनल पर प्रिंट करता है:

श्री
AUTPMATIC
280SE
34 T6511

इन्फरेंस गति

विलंबता मापी गई Roboflow Inference पर 1x NVIDIA L4, बैच आकार 1, वार्मअप के बाद के औसत के साथ।

मॉडल
विलंबता (ms)

doctr

83.5

एक पूर्ण दस्तावेज़ छवि पर मापा गया (पाठ पहचान + मान्यता)।

सेट करें api_url को अपने डिप्लॉयमेंट लक्ष्य से मिलाएँ:

Inference के साथ उपयोग करें (सेल्फ-होस्टेड)

DocTR एक मुख्य मॉडल है Roboflow Inferenceइसलिए यह स्वयं होस्ट किए गए सर्वर पर भी चलता है। एक स्थानीय सर्वर शुरू करें, फिर उसी ocr_image कॉल उसे करें:

प्रतिक्रिया में पहचाना गया पाठ और इन्फ़रेंस समय शामिल है:

अधिक पढ़ें

अंतिम अपडेट

क्या यह उपयोगी था?