> For the complete documentation index, see [llms.txt](https://docs.roboflow.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.roboflow.com/deployment/hi/production-checklist.md).

# प्रोडक्शन रेडीनेस चेकलिस्ट

Roboflow deployments के लिए production readiness - HTTP error handling और retries, timeouts और cold starts, rate limits, और Dedicated Deployment replica sizing।

एक बार आपने [एक परिनियोजन विकल्प चुना है](/deployment/hi/choosing-a-deployment.md)इसके बाद, इस पृष्ठ का उपयोग अपनी इंटीग्रेशन को उत्पादन ट्रैफ़िक संभालने से पहले मजबूत करने के लिए करें। इसमें त्रुटि प्रबंधन और पुनः प्रयास, टाइमआउट और कोल्ड स्टार्ट, दर सीमाएँ, और इनके लिए रेप्लिका आकार शामिल हैं [समर्पित परिनियोजन](/deployment/hi/roboflow/dedicated-deployments.md).

## स्व-होस्टेड सर्वर एक्सेस

स्व-होस्टेड परिनियोजनों के लिए, सत्यापित करें [नेटवर्क एक्सेस, प्रमाणीकरण, और अवलोकनीयता](/deployment/hi/self-hosted/inference-server/configuration/security.md) दूरस्थ क्लाइंट्स को अनुमति देने से पहले। समीक्षा करें [सुरक्षा कॉन्फ़िगरेशन माइग्रेशन](/deployment/hi/self-hosted/inference-server/configuration/security-migration.md) जब CLI या सर्वर इमेज को अपग्रेड कर रहे हों।

## HTTP त्रुटियाँ और पुनः प्रयास

Roboflow के इन्फ़ेरेंस और प्रबंधन API मानक HTTP स्थिति कोड का उपयोग करते हैं। पूर्ण क्रॉस-टूल तालिका (REST स्थिति कोड, SDK अपवाद, और CLI एग्ज़िट कोड) यहाँ उपलब्ध है [त्रुटियाँ और स्थिति कोड](https://docs.roboflow.com/reference/errors-and-status-codes). उत्पादन के लिए मुख्य नियम है केवल उसी चीज़ को पुनः प्रयास करना जो वास्तव में पुनः प्रयास योग्य हो:

| स्थिति        | पुनः प्रयास करें? | मार्गदर्शन                                                                                                                               |
| ------------- | ----------------- | ---------------------------------------------------------------------------------------------------------------------------------------- |
| `200` / `204` | -                 | सफलता।                                                                                                                                   |
| `400`         | नहीं              | गलत स्वरूप वाला अनुरोध - पेलोड ठीक करें; पुनः प्रयास करने पर वही खराब अनुरोध भेजा जाएगा।                                                 |
| `401` / `403` | नहीं              | प्रमाणीकरण या एक्सेस विफलता। पुनः प्रयास पर कुंजी वैध नहीं होगी; API कुंजी और उसके स्कोप्स की जाँच करें।                                 |
| `402` / `423` | नहीं              | योजना सीमा, कोटा पूरा हो गया, या बिलिंग रोकी गई। इसे [बिलिंग](https://roboflow.com/pricing) पक्ष पर हल करें, लूप में पुनः प्रयास न करें। |
| `404`         | नहीं              | संसाधन मौजूद नहीं है या आपकी कुंजी के लिए दृश्यमान नहीं है।                                                                              |
| `429`         | हाँ               | दर-सीमित। पीछे हटें और घातीय बैकऑफ़ के साथ पुनः प्रयास करें (देखें [दर सीमाएँ](#rate-limits)).                                           |
| `5xx`         | हाँ               | अस्थायी सर्वर त्रुटि। बैकऑफ़ के साथ पुनः प्रयास करना सुरक्षित है।                                                                        |

**बैकऑफ़ पैटर्न।** के लिए `429` और `5xx`के साथ, घातीय बैकऑफ़ और जिटर का उपयोग करके पुनः प्रयास करें (उदाहरण के लिए, 1s, 2s, 4s, 8s के साथ एक यादृच्छिक ऑफ़सेट), और प्रयासों की संख्या सीमित रखें। `401`/`403`/`404`/`400` स्वचालित रूप से - उसके बजाय इन्हें अपने एप्लिकेशन में दिखाएँ।

जब आप [समर्पित परिनियोजन](/deployment/hi/roboflow/dedicated-deployments.md#http-api) प्रबंधन सेवा (`https://roboflow.cloud`) को कॉल करते हैं, तो प्रतिक्रिया कोड को स्पष्ट रूप से जाँचें: एक `200` एक JSON बॉडी लौटाता है, और कोई भी अन्य कोड त्रुटि संदेश को स्ट्रिंग के रूप में लौटाता है।

## टाइमआउट और कोल्ड स्टार्ट

यह [सर्वरलेस क्लाउड API](/deployment/hi/roboflow/serverless-api.md) मॉडल्स को मांग पर लोड करता है। किसी ऐसे मॉडल पर पहला अनुरोध जो पहले से सर्वर पर मौजूद नहीं है ("वॉर्मअप") कई सेकंड ले सकता है, और जो मॉडल निष्क्रिय रहा है (उदाहरण के लिए, इन्फ़ेरेंस के बीच लगभग 10 मिनट) वह अनलोड हो सकता है और अगले कॉल पर उसे फिर से लोड करना पड़ सकता है।

* **उदार क्लाइंट टाइमआउट सेट करें।** इतना कड़ा क्लाइंट टाइमआउट कि वह कोल्ड स्टार्ट पर ही ट्रिप हो जाए, उन अनुरोधों को विफल कर देगा जो अन्यथा सफल हो जाते। पहले अनुरोध पर और निष्क्रिय अवधि के बाद वॉर्मअप के लिए अतिरिक्त समय रखें।
* **मॉडल को प्राइम करें।** यदि अनुमानित विलंबता महत्वपूर्ण है, तो अपनी विलंबता-संवेदनशील ट्रैफ़िक से पहले एक वॉर्मअप अनुरोध भेजें ताकि मॉडल पहले से कैश्ड हो।
* **प्रतिक्रिया हेडर देखें।** सर्वरलेस प्रतिक्रियाएँ शामिल करती हैं `x-model-cold-start` (क्या इस अनुरोध ने लोड लागत चुकाई) और `x-processing-time`. उनका उपयोग कोल्ड-स्टार्ट आवृत्ति और विलंबता की निगरानी के लिए करें। बिलिंग इनमें से किसी पर निर्भर नहीं करती: देखें [मॉडल मूल्य निर्धारण](/deployment/hi/roboflow/serverless-api/model-pricing.md) प्रति-छवि दर के लिए।
* **अपलोड सीमा के भीतर रखें।** सर्वरलेस क्लाउड API अपलोड को अधिकतम **20 MB**तक स्वीकार करता है; बड़ी छवियाँ अस्वीकार कर दी जाती हैं। भेजने से पहले छवियों का आकार घटाएँ (Python SDK यह अपने आप करता है), जो आम तौर पर सटीकता को नुकसान नहीं पहुँचाता क्योंकि वैसे भी छवियों का आकार मॉडल के इनपुट आकार में बदला जाता है। बैच प्रोसेसिंग वही 20 MB प्रति-छवि सीमा लागू करती है।

बिना कोल्ड स्टार्ट के निरंतर कम विलंबता के लिए, [समर्पित परिनियोजन](/deployment/hi/roboflow/dedicated-deployments.md) या [स्व-होस्टेड इन्फ़ेरेंस](/deployment/hi/self-hosted/self-hosted.md) का उपयोग साझा सर्वरलेस एंडपॉइंट के बजाय करें।

## दर सीमाएँ

* **सर्वरलेस क्लाउड API।** एक पर `429`, धीमा हो जाएँ और घातीय बैकऑफ़ के साथ पुनः प्रयास करें। यदि आप लगातार सीमाएँ हिट करते हैं या अधिक थ्रूपुट की आवश्यकता है, तो अपने एंटरप्राइज़ सपोर्ट संपर्क या [Roboflow फ़ोरम](https://discuss.roboflow.com)से संपर्क करें, या एक [समर्पित परिनियोजन](/deployment/hi/roboflow/dedicated-deployments.md).
* **डिप्लॉयमेंट मैनेजर API।** एज-डिवाइस प्रबंधन एंडपॉइंट स्पष्ट प्रति-एंडपॉइंट सीमाएँ लागू करते हैं और सीमा पार होने पर `429` लौटाते हैं - उदाहरण के लिए, डिवाइस लॉग सीमित हैं **प्रति IP प्रति मिनट 5 अनुरोध** और **वैश्विक रूप से प्रति मिनट 50**तक, और टेलीमेट्री रीड्स **प्रति डिवाइस प्रति मिनट 60 अनुरोध** तक 10-सेकंड में 10 अनुरोधों के बर्स्ट के साथ। देखें [डिप्लॉयमेंट मैनेजर API](/deployment/hi/self-hosted/enterprise/deployment-manager.md#errors) अपनी इंटीग्रेशन में पोलिंग जोड़ने से पहले सटीक सीमाएँ और त्रुटि स्वरूप देखें।

जब आपके पथ के लिए कोई दस्तावेज़ित संख्या मौजूद न हो, तो `429` को निश्चित बजट मानने के बजाय पीछे हटने के संकेत के रूप में लें, और [सपोर्ट से संपर्क करें](https://roboflow.com/sales) यदि आपको उच्च सीमा चाहिए।

## समर्पित परिनियोजन रेप्लिका आकार निर्धारण

जब आप एक [समर्पित परिनियोजन](/deployment/hi/roboflow/dedicated-deployments.md#http-api)बनाते हैं, तो आप सेट कर सकते हैं `min_replicas` और `max_replicas` (दोनों का डिफ़ॉल्ट है `1`):

* **`min_replicas`** रन में रखी जाने वाली रेप्लिकाओं की संख्या है। अधिक न्यूनतम बर्स्टी लोड के तहत कोल्ड-स्टार्ट विलंबता को कम करता है, लेकिन हमेशा-चालू क्षमता की कीमत पर।
* **`max_replicas`** लोड के तहत परिनियोजन कितना स्केल आउट करेगा, इसे सीमित करता है। अधिक पीक थ्रूपुट के लिए इसे बढ़ाएँ।

स्थिर ट्रैफ़िक के लिए, `min_replicas` और `max_replicas` का `1` सबसे सरल शुरुआती बिंदु है; बढ़ाएँ `max_replicas` जब एकल रेप्लिका पीक लोड के साथ नहीं निभा पा रही हो, और बढ़ाएँ `min_replicas` यदि निष्क्रियता के बाद पहला अनुरोध बहुत धीमा है।

### ऑटो-पॉज़ के साथ अंतःक्रिया

समर्पित परिनियोजन **निष्क्रियता की अवधि के बाद ऑटो-पॉज़** - के लिए 1 घंटे पर तय `dev-cpu` और `dev-gpu` प्रकार - और जब आप अपनी API कुंजी के साथ अनुरोध भेजते हैं तो फिर से शुरू हो जाते हैं। एक पॉज़्ड परिनियोजन रेप्लिकाएँ सर्व नहीं कर रहा होता, इसलिए उसे फिर से शुरू करने वाला अनुरोध एक पुनःआरंभ विलंबता चुकाता है।

* का उपयोग करें **स्थायी `prod-cpu` / `prod-gpu`** उत्पादन ट्रैफ़िक के लिए प्रकार जो हमेशा तैयार होने चाहिए।
* क्षणिक `dev-cpu` / `dev-gpu` प्रकार परीक्षण और प्रोटोटाइपिंग के लिए आरक्षित रखें - वे कुछ घंटों के बाद अपने आप भी हटा दिए जाते हैं।
* यदि आपको अपटाइम के बजाय अनुरोध संख्या आधारित बिलिंग, या कस्टम पॉज़/रेप्लिका नीति चाहिए, [सेल्स से संपर्क करें](https://roboflow.com/sales).

## लाइव होने से पहले

* पुनः प्रयास हर आउटबाउंड कॉल को कवर करते हैं, केवल `429` और `5xx` बैकऑफ़ के साथ।
* क्लाइंट टाइमआउट इतने उदार हैं कि सर्वरलेस कोल्ड स्टार्ट्स को समाहित कर सकें।
* 20 MB अपलोड सीमा के भीतर रखने के लिए छवियों का आकार घटाया जाता है।
* API कुंजियाँ आवश्यक न्यूनतम [स्कोप्स](https://docs.roboflow.com/reference/authentication/authentication/scoped-api-keys) का उपयोग करती हैं और हार्ड-कोडेड नहीं, बल्कि सीक्रेट्स के रूप में संग्रहीत की जाती हैं।
* समर्पित परिनियोजनों के लिए, `min_replicas` / `max_replicas` आपके लोड के अनुसार आकारित हैं और आपने एक `prod-*` प्रकार हमेशा-चालू ट्रैफ़िक के लिए चुना है।
* आप परिनियोजनों की निगरानी करते हैं - देखें [मॉडल मॉनिटरिंग](/deployment/hi/monitoring-and-analytics/model-monitoring.md) - और त्रुटि-दर तथा विलंबता में गिरावट पर अलर्ट करें।
