For the complete documentation index, see llms.txt. This page is also available as Markdown.

Qwen3-VL

किसी छवि पर Qwen3-VL चलाएँ।

यह वर्कफ़्लो ब्लॉक Qwen3-VL-a विज़न-भाषा मॉडल चलाता है, जो एक छवि और एक वैकल्पिक पाठ प्रॉम्प्ट स्वीकार करता है—और एक वार्तालाप टेम्पलेट के आधार पर पाठ उत्तर देता है।

प्रकार पहचानकर्ता

चरण में निम्नलिखित पहचानकर्ता का उपयोग करें "type" फ़ील्ड: roboflow_core/qwen3vl@v1 अपने वर्कफ़्लो में इस ब्लॉक को एक चरण के रूप में जोड़ने के लिए।

गुण

नाम

प्रकार

विवरण

संदर्भ

नाम

str

इस चरण के लिए एक अद्वितीय पहचानकर्ता दर्ज करें..

संकेत

str

Qwen3-VL को अतिरिक्त संदर्भ देने वाला वैकल्पिक पाठ प्रॉम्प्ट। अन्यथा यह केवल एक डिफ़ॉल्ट प्रॉम्प्ट होगा, जो इच्छित मॉडल व्यवहार को प्रभावित कर सकता है..

मॉडल संस्करण

str

अनुमान के लिए उपयोग किया जाने वाला Qwen3-VL मॉडल..

सिस्टम प्रॉम्प्ट

str

Qwen3-VL को अतिरिक्त संदर्भ देने वाला वैकल्पिक सिस्टम प्रॉम्प्ट..

यह संदर्भ कॉलम यह दर्शाता है कि गुण को वर्कफ़्लो रनटाइम में उपलब्ध गतिशील मानों के साथ पैरामीटराइज़ किया जा सकता है। देखें वर्कफ़्लो रनटाइम। देखें बाइंडिंग्स अधिक जानकारी के लिए।

रनटाइम संगतता

हार्ड - रनटाइम self_hosted_cpu; निष्पादन स्थानीय : GPU की आवश्यकता है; run_locally() CUDA की आवश्यकता वाला मॉडल लोड करता है।

इनपुट और आउटपुट बाइंडिंग्स

उपलब्ध कनेक्शन इसके बाइंडिंग प्रकारों पर निर्भर करते हैं। जाँचें कि Qwen3-VL Qwen3-VL संस्करण में v1 में कौन-कौन से बाइंडिंग प्रकार हैं।

इनपुट और आउटपुट बाइंडिंग्स
  • इनपुट

    • छवियाँ (छवि): जिस छवि पर अनुमान लगाना है..

    • मॉडल संस्करण (roboflow_model_id): अनुमान के लिए उपयोग किया जाने वाला Qwen3-VL मॉडल..

  • आउटपुट

    • पार्स किया गया आउटपुट (शब्दकोश): शब्दकोश।

उदाहरण JSON परिभाषा

अंतिम अपडेट

क्या यह उपयोगी था?