> For the complete documentation index, see [llms.txt](https://docs.roboflow.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.roboflow.com/roboflow/roboflow-hi/deploy/serverless.md).

# (Legacy) Serverless Hosted API

{% hint style="info" %}
हम **अनुशंसा करते हैं** हमारी Serverless Hosted API के V2 का उपयोग करने की अनुशंसा करते हैं। V2 API तेज़ है।\
\
[नई API के साथ शुरुआत करने के लिए Serverless Hosted API V2 दस्तावेज़ देखें।](/roboflow/roboflow-hi/deploy/serverless-hosted-api-v2.md)
{% endhint %}

## Model समर्थन

{% hint style="warning" %}
नए मॉडल आर्किटेक्चर (जैसे Florence-2, SAM 3, और अन्य) केवल Serverless Hosted API V2 पर उपलब्ध हैं। वे Legacy workspaces जिन्हें क्रेडिट-आधारित योजना में माइग्रेट नहीं किया गया है, उन्हें एक `402` इन मॉडलों का उपयोग करने का प्रयास करने पर त्रुटि मिलेगी। [अपनी योजना अपग्रेड करें](/roboflow/roboflow-hi/billing/plans/purchase-a-plan.md) समर्थित मॉडलों के पूरे सेट तक पहुँचने के लिए, के माध्यम से [Serverless Hosted API V2](/roboflow/roboflow-hi/deploy/serverless-hosted-api-v2.md).
{% endhint %}

निम्नलिखित मॉडल प्रकार Serverless Hosted API (v1) द्वारा समर्थित हैं:

| कार्य प्रकार                                                                                                    | Hosted API (v1) द्वारा समर्थित |
| --------------------------------------------------------------------------------------------------------------- | ------------------------------ |
| [Object Detection](/roboflow/roboflow-hi/deploy/serverless/object-detection.md)                                 | ✅                              |
| [Classification](/roboflow/roboflow-hi/deploy/serverless/classification.md)                                     | ✅                              |
| [Instance Segmentation](/roboflow/roboflow-hi/deploy/serverless/instance-segmentation.md)                       | ✅                              |
| [Semantic Segmentation](/roboflow/roboflow-hi/deploy/serverless/instance-segmentation/semantic-segmentation.md) | ✅                              |
| [कुंजीबिंदु पहचान](/roboflow/roboflow-hi/deploy/serverless/keypoint-detection.md)                               | ✅                              |

## लेटेंसी तुलना (v1 बनाम v2)

Serverless Hosted API को भेजे गए अनुरोधों की एंड-टू-एंड लेटेंसी कई कारकों पर निर्भर करती है:

1. मॉडल आर्किटेक्चर, जिसका निष्पादन समय पर प्रभाव पड़ता है
2. छवियों का आकार और रिज़ॉल्यूशन, जो अपलोड समय और निष्पादन के दौरान मॉडल इन्फ़रेंस समय को प्रभावित करते हैं
3. नेटवर्क लेटेंसी और बैंडविड्थ, जो अनुरोध अपलोड समय और प्रतिक्रिया डाउनलोड समय को प्रभावित करती है।
4. किसी भी विशिष्ट समय पर अन्य उपयोगकर्ताओं द्वारा सेवा सब्सक्रिप्शन और उपयोग, जिसके कारण कतारबद्ध लेटेंसी हो सकती है

<figure><img src="/files/9ecda490ba5d9f82b4de821c04b5f68183cd0ab1" alt=""><figcaption></figcaption></figure>

नीचे दी गई तालिका में हम v1 बनाम v2 Serverless Hosted API के कुछ प्रतिनिधि बेंचमार्क दिखाते हैं। इसमें एंड-टू-एंड लेटेंसी (E2E) के साथ-साथ निष्पादन समय (Exec) भी दिखाया गया है। ये संख्याएँ केवल जानकारी के लिए हैं; हम उपयोगकर्ताओं को का उपयोग करके अपने स्वयं के बेंचमार्क करने के लिए प्रोत्साहित करते हैं [हमारे inference benchmark tools](https://inference.roboflow.com/inference_helpers/cli_commands/benchmark/) या अपने स्वयं के कस्टम बेंचमार्क का।

<table><thead><tr><th width="176.14410400390625">मॉडल</th><th>V2 (E2E)</th><th>V2 (Exec)</th><th>V1 (E2E)</th><th>V1 (Exec)</th></tr></thead><tbody><tr><td>yolov8x-640</td><td>401 ms</td><td>29 ms</td><td>4084 ms</td><td>821 ms</td></tr><tr><td>yolov8m-640</td><td>757 ms</td><td>21 ms</td><td>572 ms</td><td>265 ms</td></tr><tr><td>yolov8n-640</td><td>384 ms</td><td>17 ms</td><td>312 ms</td><td>63 ms</td></tr><tr><td>yolov8x-1280</td><td>483 ms</td><td>97 ms</td><td>6431 ms</td><td>3032 ms</td></tr><tr><td>yolov8m-1280</td><td>416 ms</td><td>52 ms</td><td>1841 ms</td><td>1006 ms</td></tr><tr><td>yolov8n-1280</td><td>428 ms</td><td>35 ms</td><td>464 ms</td><td>157 ms</td></tr></tbody></table>

हम उपयोगकर्ताओं को उनके model inferences और workflows के लिए अपने स्वयं के बेंचमार्क चलाने के लिए प्रोत्साहित करते हैं, ताकि उनके विशिष्ट usecases पर वास्तविक मीट्रिक्स प्राप्त हो सकें।

## सीमाएँ

Serverless Hosted API (v1), विशिष्ट कार्य प्रकार की परवाह किए बिना, 5MB तक की फ़ाइलें स्वीकार करती है। इस सीमा में, लेकिन केवल इन्हीं तक सीमित नहीं, छवि फ़ाइल का आकार तथा संलग्न कोई भी अनुरोध जानकारी शामिल है।

{% hint style="info" %}
जिन मामलों में अनुरोध बहुत बड़े होते हैं, हम संलग्न छवियों का आकार कम करने की अनुशंसा करते हैं। इससे आमतौर पर प्रदर्शन खराब नहीं होगा, क्योंकि हमारी servers पर प्राप्त होने के बाद, छवियों का आकार वैसे भी मॉडल आर्किटेक्चर द्वारा स्वीकार किए जाने वाले input size तक कम कर दिया जाता है।\
\
हमारे कुछ SDKs, जैसे Python SDK, API को भेजे जाने से पहले छवियों का आकार मॉडल आर्किटेक्चर के input size तक स्वचालित रूप से कम कर देते हैं।
{% endhint %}
