> For the complete documentation index, see [llms.txt](https://docs.roboflow.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.roboflow.com/deployment/hi/legacy/legacy-serverless.md).

# Hosted API (Legacy)

{% hint style="info" %}
हम **सिफारिश करते हैं** वर्तमान [Serverless Cloud API](/deployment/hi/roboflow-cloud/serverless-api.md) , जो तेज़ है।\
\
[नई API के साथ शुरू करने के लिए Serverless Cloud API के दस्तावेज़ देखें।](/deployment/hi/roboflow-cloud/serverless-api.md)
{% endhint %}

## मॉडल समर्थन

{% hint style="warning" %}
नए मॉडल आर्किटेक्चर (जैसे Florence-2, SAM 3, और अन्य) केवल वर्तमान Serverless Cloud API पर उपलब्ध हैं। जिन Legacy कार्यस्थानों ने क्रेडिट-आधारित प्लान में माइग्रेट नहीं किया है, उन्हें एक `402` इन मॉडलों का उपयोग करने का प्रयास करते समय त्रुटि मिलेगी। [अपना प्लान अपग्रेड करें](https://docs.roboflow.com/platform/billing-and-plans/plans/purchase-a-plan) के माध्यम से समर्थित मॉडलों के पूरे सेट तक पहुँचने के लिए [Serverless Cloud API](/deployment/hi/roboflow-cloud/serverless-api.md).
{% endhint %}

Hosted API (Legacy) द्वारा निम्नलिखित मॉडल प्रकार समर्थित हैं:

| कार्य प्रकार                                                                                                  | Hosted API (Legacy) द्वारा समर्थित |
| ------------------------------------------------------------------------------------------------------------- | ---------------------------------- |
| [ऑब्जेक्ट डिटेक्शन](/deployment/hi/legacy/legacy-serverless/object-detection.md)                              | ✅                                  |
| [वर्गीकरण](/deployment/hi/legacy/legacy-serverless/classification.md)                                         | ✅                                  |
| [इंस्टेंस सेगमेंटेशन](/deployment/hi/legacy/legacy-serverless/instance-segmentation.md)                       | ✅                                  |
| [सिमैंटिक सेगमेंटेशन](/deployment/hi/legacy/legacy-serverless/instance-segmentation/semantic-segmentation.md) | ✅                                  |
| [कीपॉइंट डिटेक्शन](/deployment/hi/legacy/legacy-serverless/keypoint-detection.md)                             | ✅                                  |

## लेटेंसी तुलना

Hosted API (Legacy) को भेजे गए अनुरोधों की end-to-end लेटेंसी कई कारकों पर निर्भर करती है:

1. मॉडल आर्किटेक्चर, जिसका निष्पादन समय पर प्रभाव पड़ता है
2. छवियों का आकार और रिज़ॉल्यूशन, जो अपलोड समय और निष्पादन के दौरान मॉडल inference समय को प्रभावित करता है
3. नेटवर्क लेटेंसी और बैंडविड्थ, जो अनुरोध अपलोड समय और प्रतिक्रिया डाउनलोड समय को प्रभावित करती है।
4. किसी भी विशेष समय पर सेवा सदस्यता और अन्य उपयोगकर्ताओं द्वारा उपयोग, जिसके कारण queueing latency हो सकती है

<figure><img src="/files/d6c1d2831bd58582b68bb6f6580c24fec6173788" alt=""><figcaption></figcaption></figure>

नीचे दी गई तालिका में हम Hosted API (Legacy) और Serverless Cloud API के कुछ प्रतिनिधि benchmarks दिखाते हैं। इसमें end-to-end latency (E2E) के साथ-साथ execution time (Exec) भी दिखाया गया है। ये संख्याएँ केवल जानकारी के लिए हैं, हम उपयोगकर्ताओं को उपयोग करके अपने स्वयं के benchmarks करने के लिए प्रोत्साहित करते हैं [हमारे inference benchmark tools](https://docs.roboflow.com/reference/inference/inference-cli/benchmark) या अपने स्वयं के custom benchmarks।

<table data-search="false"><thead><tr><th width="176.14410400390625">मॉडल</th><th>V2 (E2E)</th><th>V2 (Exec)</th><th>V1 (E2E)</th><th>V1 (Exec)</th></tr></thead><tbody><tr><td>yolov8x-640</td><td>401 ms</td><td>29 ms</td><td>4084 ms</td><td>821 ms</td></tr><tr><td>yolov8m-640</td><td>757 ms</td><td>21 ms</td><td>572 ms</td><td>265 ms</td></tr><tr><td>yolov8n-640</td><td>384 ms</td><td>17 ms</td><td>312 ms</td><td>63 ms</td></tr><tr><td>yolov8x-1280</td><td>483 ms</td><td>97 ms</td><td>6431 ms</td><td>3032 ms</td></tr><tr><td>yolov8m-1280</td><td>416 ms</td><td>52 ms</td><td>1841 ms</td><td>1006 ms</td></tr><tr><td>yolov8n-1280</td><td>428 ms</td><td>35 ms</td><td>464 ms</td><td>157 ms</td></tr></tbody></table>

हम उपयोगकर्ताओं को उनके विशिष्ट use cases पर वास्तविक मेट्रिक्स प्राप्त करने के लिए अपने model inferences और workflows के लिए अपने स्वयं के benchmarks चलाने के लिए प्रोत्साहित करते हैं।

## सीमाएँ

Hosted API (Legacy), विशिष्ट कार्य प्रकार की परवाह किए बिना, 5MB तक की फ़ाइलें स्वीकार करता है। इस सीमा में, अन्य बातों के अलावा, छवि फ़ाइल का आकार और संलग्न कोई भी अनुरोध जानकारी शामिल है।

{% hint style="info" %}
यदि अनुरोध बहुत बड़े हों, तो हम संलग्न छवियों का आकार कम करने की सलाह देते हैं। इससे आमतौर पर प्रदर्शन खराब नहीं होगा, क्योंकि हमारी सर्वरों पर प्राप्त होने के बाद छवियों का आकार वैसे भी मॉडल आर्किटेक्चर द्वारा स्वीकार किए जाने वाले इनपुट आकार तक कम कर दिया जाता है।\
\
हमारे कुछ SDK, जैसे Python SDK, API को भेजे जाने से पहले छवियों का आकार स्वचालित रूप से मॉडल आर्किटेक्चर के इनपुट आकार तक कम कर देते हैं।
{% endhint %}
