For the complete documentation index, see llms.txt. This page is also available as Markdown.

Multimodal Data annotate करें

यदि आप किसी Multimodal project का हिस्सा होने वाले dataset को label कर रहे हैं, तो images को annotate करने के लिए prefixes का उपयोग किया जाता है.

एक prefix निम्न में से कोई भी हो सकता है:

  • जैसे कोई identifier <PREFIX>जिसका उपयोग एक VLM जैसे Florence-2, या;

  • या "What is in this image?" जैसा कोई प्रश्न, जो GPT-4o जैसे general VQA models के साथ उपयोग के लिए आदर्श है.

उदाहरण के लिए, Florence-2 fine-tuning के लिए, चुना गया prefix उस prefix prompt से मेल खाएगा जो आप model को देते हैं. Florence-2 के लिए, prefixes इस format में होने चाहिए <PREFIX>जैसे <TOTAL>.

GPT-4o के लिए, आपका prefix यह हो सकता है: "इस receipt में total कितना है?".

आप किसी object में, जिसे हम identify करना चाहते हैं, total, subtotal, और tax जैसी विभिन्न features के लिए अलग-अलग prefixes जोड़ना चाह सकते हैं.

Add Prefixes

Prefixes जोड़ने के लिए, Roboflow sidebar में "Classes & Tags" पर क्लिक करें, फिर "Add " button पर क्लिक करें:

फिर, prefix दर्ज करें. यह "What is in the image?" जैसा कोई प्रश्न या "<RECEIPT>" जैसा unique ID हो सकता है, यह इस बात पर निर्भर करता है कि आप किस model को train करना चाहते हैं.

आप "+" button के साथ multiple prefixes जोड़ सकते हैं.

अपने prefixes जोड़ने के लिए “Add Prefixes” पर क्लिक करें.

एक बार जब आपने prefixes set कर दिए, तो वे आपके annotation editor में questions के रूप में उपलब्ध होंगे:

अंतिम अपडेट

क्या यह उपयोगी था?