Google Vision OCR
Google Vision API का उपयोग करके छवियों में पाठ का पता लगाएँ
अंतिम अपडेट
क्या यह उपयोगी था?
Google Vision API का उपयोग करके छवियों में पाठ का पता लगाएँ
Google Vision OCR का उपयोग करके छवियों में पाठ का पता लगाएँ.
समर्थित पाठ पहचान प्रकार:
text_detection: बड़ी छवि के भीतर पाठ वाले क्षेत्रों के लिए अनुकूलित.
ocr_text_detection: सघन पाठ दस्तावेज़ों के लिए अनुकूलित.
अपनी Google Vision API कुंजी प्रदान करें या मान को rf_key:account (या rf_key:user:<id>) Roboflow के API के माध्यम से अनुरोध प्रॉक्सी करने के लिए।
स्टेप में निम्नलिखित पहचानकर्ता का उपयोग करें "type" फ़ील्ड: roboflow_core/google_vision_ocr@v1 अपने वर्कफ़्लो में ब्लॉक को एक स्टेप के रूप में जोड़ने के लिए।
नाम
प्रकार
विवरण
संदर्भ
name
str
इस स्टेप के लिए एक विशिष्ट पहचानकर्ता दर्ज करें..
❌
ocr_type
str
उपयोग करने के लिए OCR का प्रकार.
❌
api_key
str
आपकी Google Vision API कुंजी.
✅
language_hints
List[str]
OCR API को भेजने के लिए भाषा कोडों की वैकल्पिक सूची। यदि यह प्रदान नहीं की जाती, तो API भाषा को स्वचालित रूप से पहचानने का प्रयास करेगी। यदि यह प्रदान की जाती है, तो भाषा कोड OCR API द्वारा समर्थित होने चाहिए; समर्थित भाषा कोडों की सूची के लिए https://cloud.google.com/vision/docs/languages देखें..
❌
यह संदर्भ स्तंभ यह इंगित करता है कि संपत्ति को वर्कफ़्लो रनटाइम में उपलब्ध गतिशील मानों के साथ पैरामीटराइज़ किया जा सकता है वर्कफ़्लो रनटाइम। देखें बाइंडिंग्स अधिक जानकारी के लिए।
requires_internet - air-gapped / offline deployments : यह ब्लॉक ऐसी सेवा पर निर्भर करता है जो पूरी तरह ऑफ़लाइन / air-gapped deployments से पहुँचा नहीं जा सकता।
उपलब्ध कनेक्शन उसके बाइंडिंग प्रकारों पर निर्भर करते हैं। देखें कि कौन-से बाइंडिंग प्रकार Google Vision OCR संस्करण v1 है।
इनपुट
छवि (छवि): OCR चलाने के लिए छवि.
api_key (Union[ROBOFLOW_MANAGED_KEY, secret, string]): आपकी Google Vision API कुंजी.
आउटपुट
पाठ (string): स्ट्रिंग मान.
भाषा (string): स्ट्रिंग मान.
predictions (object_detection_prediction): sv.Detections(...) ऑब्जेक्ट के रूप में पहचाने गए बाउंडिंग बॉक्स के साथ पूर्वानुमान।
अंतिम अपडेट
क्या यह उपयोगी था?
क्या यह उपयोगी था?
{
"name": "<your_step_name_here>",
"type": "roboflow_core/google_vision_ocr@v1",
"image": "$inputs.image",
"ocr_type": "<block_does_not_provide_example>",
"api_key": "xxx-xxx",
"language_hints": [
"en",
"fr"
]
}