अंतिम अपडेट
क्या यह उपयोगी था?
किसी छवि पर SmolVLM2 चलाएँ।
यह वर्कफ़्लो ब्लॉक SmolVLM2 चलाता है, जो एक बहु-माध्यमिक विज़न-भाषा मॉडल है। आप छवियों के बारे में प्रश्न पूछ सकते हैं -- जिनमें दस्तावेज़ और फ़ोटो शामिल हैं -- और प्राकृतिक भाषा में उत्तर प्राप्त कर सकते हैं।
स्टेप में निम्नलिखित पहचानकर्ता का उपयोग करें "type" फ़ील्ड: roboflow_core/smolvlm2@v1 अपने वर्कफ़्लो में ब्लॉक को एक स्टेप के रूप में जोड़ने के लिए।
नाम
प्रकार
विवरण
संदर्भ
name
str
इस स्टेप के लिए एक विशिष्ट पहचानकर्ता दर्ज करें..
❌
प्रॉम्प्ट
str
SmolVLM2 को अतिरिक्त संदर्भ प्रदान करने के लिए वैकल्पिक टेक्स्ट प्रॉम्प्ट। अन्यथा यह केवल None होगा।
❌
मॉडल संस्करण
str
इन्फ़रेंस के लिए उपयोग किया जाने वाला SmolVLM2 मॉडल..
✅
यह संदर्भ स्तंभ यह इंगित करता है कि संपत्ति को वर्कफ़्लो रनटाइम में उपलब्ध गतिशील मानों के साथ पैरामीटराइज़ किया जा सकता है वर्कफ़्लो रनटाइम। देखें बाइंडिंग्स अधिक जानकारी के लिए।
कठिन - रनटाइम self_hosted_cpu; निष्पादन स्थानीय : एक GPU की आवश्यकता है; run_locally() एक ऐसा मॉडल लोड करता है जिसे CUDA की आवश्यकता होती है।
उपलब्ध कनेक्शन उसके बाइंडिंग प्रकारों पर निर्भर करते हैं। देखें कि कौन-से बाइंडिंग प्रकार SmolVLM2 संस्करण v1 है।
इनपुट
छवियाँ (छवि): जिस छवि पर अनुमान लगाना है..
मॉडल संस्करण (roboflow_model_id): इन्फ़रेंस के लिए उपयोग किया जाने वाला SmolVLM2 मॉडल..
आउटपुट
पार्स किया गया आउटपुट (शब्दकोश): शब्दकोश।
अंतिम अपडेट
क्या यह उपयोगी था?
क्या यह उपयोगी था?
{
"name": "<your_step_name_here>",
"type": "roboflow_core/smolvlm2@v1",
"images": "$inputs.image",
"prompt": "इस छवि में क्या है?",
"model_version": "smolvlm2/smolvlm-2.2b-instruct"
}