थर्ड-पार्टी / घरेलू मॉडल को जोड़ना
Claude Code को चलाने के लिए DeepSeek जैसे घरेलू / थर्ड-पार्टी मॉडल का उपयोग करें, और अपने बिलों में भारी कटौती करें
📚 सीरीज़ नेविगेशन: पिछले लेख 04 · API कॉन्फ़िगरेशन में बताया गया था कि आधिकारिक API Key का उपयोग करके Claude Code को कैसे कनेक्ट किया जाए। यह लेख एक अलग दृष्टिकोण अपनाता है — पीछे के "ब्रेन" को पूरी तरह से बदलना, और पैसे बचाने के लिए DeepSeek जैसे घरेलू मॉडल का उपयोग करना।
⚠️ इस लेख की शुरुआत में एक चेतावनी: Claude Code को चलाने के लिए थर्ड-पार्टी मॉडल का उपयोग करना एक "प्रयोगात्मक तरीका" है। आधिकारिक दस्तावेज़ केवल "LLM गेटवे" और Bedrock / Vertex जैसे होस्ट किए गए Claude को कवर करते हैं, और किसी भी गैर-Anthropic मॉडल का समर्थन नहीं करते हैं। इस लेख में जो कुछ भी आधिकारिक तौर पर उल्लिखित है (पर्यावरण चर अर्थ, डिफ़ॉल्ट व्यवहार), मैंने स्रोत को चिह्नित किया है; DeepSeek वाला हिस्सा मुख्य रूप से सामुदायिक समाधानों और वास्तविक परीक्षण पर आधारित है, इंटरफ़ेस एड्रेस और मॉडल नाम कभी भी बदल सकते हैं, कृपया DeepSeek आधिकारिक जानकारी का संदर्भ लें।
भाइयों, मुझे पहले कुछ ऐसा कहने दीजिए जो शायद विवादास्पद हो: ज्यादातर लोगों को थर्ड-पार्टी मॉडल के साथ बिल्कुल भी परेशान होने की आवश्यकता नहीं है।
इंटरनेट पर कई ट्यूटोरियल "Claude Code को DeepSeek से जोड़ने" को एक बेहतरीन पैसे बचाने वाला हैक बताते हैं, जिससे ऐसा लगता है कि अगर आप इसे नहीं जोड़ते हैं, तो आप बेवकूफ बन रहे हैं। लेकिन सच कहूं तो — यदि आपने पहले ही Claude सब्सक्रिप्शन (Pro / Max) खरीद लिया है, या आपका मासिक API खर्च केवल कुछ दर्जन रुपये है, तो आप इसे सेट करने में जितना पैसा बचाते हैं, वह पर्यावरण चरों (environment variables) को डिबग करने में लगने वाले समय के लायक भी नहीं है।
तो यह लेख क्यों लिखा जा रहा है? क्योंकि दो प्रकार के लोग हैं जिन्हें वास्तव में इसकी आवश्यकता है: पहला वो हैवी यूजर जिसका API बैलेंस तेज़ी से ख़त्म हो रहा है, जिसके रोज़ाना लाखों token आते-जाते हैं; दस गुना सस्ते मॉडल पर स्विच करने से उन्हें हर महीने सैकड़ों या हज़ारों की बचत हो सकती है। दूसरा वो घरेलू (domestic) उपयोगकर्ता है जो आधिकारिक साइट से कनेक्ट नहीं हो सकता, और जादुई इंटरनेट (VPN) का उपयोग नहीं करना चाहता; DeepSeek जैसे घरेलू डायरेक्ट-कनेक्शन इंटरफेस उनके लिए सबसे परेशानी मुक्त विकल्प हैं।
अगर आप इन दोनों में से एक हैं — तो पढ़ते रहें। यदि नहीं, तो बस सिद्धांत पर एक नज़र डाल लें, और इसे बदलने के लिए जल्दबाज़ी न करें।
इस लेख को पढ़ने के बाद, आपको मिलेगा:
- एक "आधिकारिक API बनाम थर्ड-पार्टी मॉडल" ट्रेड-ऑफ़ तुलना तालिका, जिससे आप पहले यह तय कर सकें कि आपको स्विच करना चाहिए या नहीं
- एक DeepSeek कनेक्शन कॉन्फ़िगरेशन सेट जिसे आप सीधे कॉपी करके चला सकते हैं (Mac / Windows दोनों के लिए)
- 4 प्रमुख पर्यावरण चरों (environment variables) की समझ और वे वास्तव में क्या करते हैं, जो किसी भी थर्ड-पार्टी मॉडल के लिए सार्वभौमिक हैं
- कुछ सामान्य नुकसान (pitfalls): अप्रचलित (deprecated) चर,
/statusसत्यापन, और कब इसका उपयोग न करें
01 पहले समझें: मॉडल बदलने का वास्तव में क्या मतलब है
निष्कर्ष से शुरू करते हैं: Claude Code "शेल (shell)" है, मॉडल "ब्रेन" है, और थर्ड-पार्टी कनेक्शन जो करता है वह है ब्रेन को किसी और के ब्रेन से बदलना।
आपके द्वारा इंस्टॉल किया गया Claude Code, संक्षेप में, टर्मिनल में चलने वाला एक क्लाइंट है — यह आपके कोड को पढ़ने, टूल को कॉल करने, संदर्भ को प्रबंधित करने और उस "सोचें → करें → देखें" एजेंट लूप को चलाने के लिए ज़िम्मेदार है। लेकिन यह स्वयं नहीं सोच सकता; इसे हर चरण में एक लार्ज मॉडल को अनुरोध भेजना होता है और उसके जवाब का इंतज़ार करना होता है। डिफ़ॉल्ट रूप से, यह मॉडल Anthropic का Claude है।
सादृश्य: एक कार का इंजन बदलना। Claude Code कार का शेल है — स्टीयरिंग व्हील, सीटें, डैशबोर्ड समान रहते हैं, और आपकी ऑपरेटिंग आदतों को बिल्कुल भी बदलने की आवश्यकता नहीं है। मॉडल इंजन है। मूल कारखाने का इंजन (Claude) सबसे शक्तिशाली है लेकिन इसमें ईंधन की लागत अधिक है; यदि आप पैसे बचाना चाहते हैं, कमजोर होने के लिए, तो आप इसे निकाल सकते हैं और घरेलू इंजन (DeepSeek) लगा सकते हैं। कार अभी भी वही कार है, और ड्राइविंग का अनुभव लगभग समान है, बस शक्ति और ईंधन की खपत बदल गई है।
तो आप विशेष रूप से "इंजन कैसे बदलते हैं"? कोड को संशोधित करके नहीं, बल्कि कुछ पर्यावरण चरों (environment variables) पर भरोसा करके। उनमें से सबसे मुख्य का नाम ANTHROPIC_BASE_URL है — यह निर्धारित करता है कि Claude Code अनुरोध को किस पते पर भेजता है।
यहाँ एक बिंदु है जिस पर आधिकारिक दस्तावेज़ विशेष रूप से ज़ोर देते हैं, लेकिन 90% ट्यूटोरियल स्पष्ट रूप से नहीं समझाते हैं:
ANTHROPIC_BASE_URLयह बदलता है कि अनुरोध कहाँ भेजे जाते हैं, न कि कौन सा मॉडल उनका उत्तर देता है। (आधिकारिक "मॉडल कॉन्फ़िगरेशन" से मूल पाठ)
इसका क्या मतलब है? ANTHROPIC_BASE_URL केवल "पत्र कहाँ भेजना है" बदलता है, यह "जवाब कौन देगा" इसके लिए ज़िम्मेदार नहीं है। यदि आप पता बदलकर DeepSeek का इंटरफ़ेस कर देते हैं, तो क्या DeepSeek इसे स्वीकार करने के लिए तैयार है और वह किस मॉडल का उपयोग करके उत्तर देता है, यह इंटरफ़ेस पता + मॉडल नाम दोनों द्वारा एक साथ तय किया जाता है। इसलिए केवल URL बदलना पर्याप्त नहीं है, मॉडल का नाम भी कॉन्फ़िगर किया जाना चाहिए — यह बाद में होने वाली समस्याओं का एक प्रमुख क्षेत्र है, इसलिए इसे अभी याद रखें।
तो DeepSeek सीधे कैसे जुड़ सकता है? क्योंकि DeepSeek एक "Anthropic प्रोटोकॉल संगत" इंटरफ़ेस प्रदान करता है — पता https://api.deepseek.com/anthropic है। स्पष्ट रूप से कहें तो, DeepSeek खुद को Anthropic के रूप में प्रच्छन्न करता है, जिससे Claude Code को लगता है कि वह अभी भी आधिकारिक (official) से बात कर रहा है, जबकि वास्तव में DeepSeek पृष्ठभूमि (background) में गणना कर रहा है। Claude Code के स्रोत कोड की एक पंक्ति को भी बदलने की आवश्यकता नहीं है।
💡 एक वाक्य का सारांश: मॉडल बदलना = "इंजन" को बदलने के लिए कुछ पर्यावरण चरों को बदलना, जबकि कार का शेल (Claude Code) अछूता रहता है;
ANTHROPIC_BASE_URLनियंत्रित करता है कि "इसे कहाँ भेजा जाए", और मॉडल का नाम नियंत्रित करता है कि "कौन जवाब देगा", और दोनों को मेल खाना चाहिए।
02 क्या आपको बदलना चाहिए? पहले इस तालिका को देखें
शुरू करने से पहले, पाँच मिनट के लिए शांत हो जाएँ। थर्ड-पार्टी मॉडल मुफ़्त लंच नहीं हैं; वे पैसे बचाते हैं, लेकिन आप कुछ चीज़ें खो भी देंगे।
मैंने दो सप्ताह के लिए एक वास्तविक प्रोजेक्ट पर उनकी तुलना की: एक ही कोडबेस, समान कार्य, पहले सप्ताह में आधिकारिक Sonnet का उपयोग किया गया, और दूसरे सप्ताह में DeepSeek पर स्विच किया गया। नीचे दी गई तालिका वास्तविक उपयोग के आधार पर सबसे प्रामाणिक भावना है, न कि केवल पैरामीटर शीट से कॉपी की गई।
| आयाम (Dimension) | आधिकारिक Claude (Anthropic API) | थर्ड-पार्टी / घरेलू मॉडल (जैसे DeepSeek) |
|---|---|---|
| कीमत | महँगा, Opus विशेष रूप से पैसा खर्च करवाता है | ✅ सस्ता, अक्सर एक परिमाण क्रम (order of magnitude) तक सस्ता |
| घरेलू डायरेक्ट कनेक्शन | अधिकांश को जादुई इंटरनेट की आवश्यकता होती है | ✅ DeepSeek जैसे घरेलू डायरेक्ट कनेक्शन, शून्य बाधा |
| कोडिंग क्षमता | ✅ वर्तमान में टॉप टियर, जटिल रीफैक्टरिंग में स्थिर | पर्याप्त है, जटिल कार्यों में कभी-कभी लड़खड़ा जाता है |
| टूल कॉलिंग / Agent क्षमता | ✅ नेटिव (Native) सबसे स्थिर है, मल्टी-स्टेप कार्य विफल नहीं होते | ⚠️ मॉडल पर निर्भर करता है, संगत इंटरफेस में कभी-कभी असामान्य (edge) व्यवहार होते हैं |
| कॉन्फ़िगरेशन लागत | बस एक Key दर्ज करें | पर्यावरण चरों का एक सेट कॉन्फ़िगर करना होता है, नुकसान (pitfalls) की संभावना होती है |
| आधिकारिक समर्थन | ✅ प्रथम श्रेणी का नागरिक | ❌ प्रयोगात्मक, कुछ गलत होने पर कोई बैकअप नहीं |
क्या आप समझे? सस्तापन और घरेलू डायरेक्ट कनेक्शन थर्ड-पार्टी मॉडल के दो ट्रंप कार्ड हैं; कीमत है कोडिंग की सीमा, Agent की स्थिरता और "कोई बैकअप न होना"।
इन दो हफ्तों की तुलना से वास्तविक निष्कर्ष: दैनिक CRUD कार्यों, परीक्षण लिखने, दस्तावेज़ीकरण जोड़ने और कोड समझाने के लिए, DeepSeek पूरी तरह से पर्याप्त है, और अनुभव Sonnet से बहुत अलग नहीं है, लेकिन लागत अंश मात्र है। लेकिन जब बात "पाँच या छह फ़ाइलों के कॉल संबंधों को पढ़ने और एक बड़े क्रॉस-मॉड्यूल रीफ़ैक्टर को करने" जैसे कठिन कार्यों की आती है, तो DeepSeek ने दो बार महत्वपूर्ण निर्भरताओं (dependencies) को छोड़ दिया, जबकि Claude ने उसी प्रॉम्प्ट के साथ इसे पहली बार में सही कर दिया।
इसलिए, अधिक व्यावहारिक दृष्टिकोण यह है कि उन्हें मिलाया जाए: मोटे काम सस्ते मॉडल को दें, और कठिन काम के लिए Claude पर वापस जाएँ — विशेष रूप से इसे कैसे विभाजित किया जाए, इसके लिए खंड 05 में एक कॉन्फ़िगरेशन प्रदान किया गया है जिसे सीधे कॉपी किया जा सकता है।
यह तय करने के लिए एक वाक्य का निर्णय कि बदलना है या नहीं:
- ✅ बदलना चाहिए: हैवी यूज़र जिनका API बिल हर महीने सैकड़ों या हज़ारों का आता है; घरेलू उपयोगकर्ता जिन्हें आधिकारिक साइट से कनेक्ट होने में कठिनाई होती है और जादुई इंटरनेट का उपयोग नहीं करना चाहते हैं; जो लोग केवल अभ्यास करना चाहते हैं और मॉडल के छोटे अंतरों की परवाह नहीं करते हैं।
- ❌ परेशान न हों: जिन्होंने पहले ही Claude सब्सक्रिप्शन खरीद लिया है (सब्सक्रिप्शन एक निश्चित लागत है, API पर स्विच करने में अतिरिक्त पैसा खर्च होगा, जिसे अगले लेख 06 में विस्तार से समझाया जाएगा); जो लोग मुख्य रूप से जटिल आर्किटेक्चर और कठिन डिबगिंग पर काम करते हैं (परिणाम की गुणवत्ता से समझौता करके थोड़े से पैसे बचाना इसके लायक नहीं है)।
अभी भी संकोच कर रहे हैं? पहले नेटवर्क को बोलने दें
उपरोक्त "बदलना चाहिए या नहीं" सूची में, "क्या घरेलू रूप से आधिकारिक साइट से जुड़ना कठिन है" यह खुद तय करना सबसे कठिन आइटम है — आपको लगता है कि आपने जादुई इंटरनेट चालू कर दिया है और यह स्थिर है, लेकिन कुछ कदम चलने के बाद Claude Code अचानक 502 या 400 फेंक देता है; क्या यह खराब व्यवहार कर रहा है या आपके नेटवर्क को जोखिम नियंत्रण (risk control) द्वारा चिह्नित किया गया है? अनुमान लगाना बेकार है, पहले एक परीक्षण चलाएँ:
ipcheck एक छोटा नेटवर्क वातावरण डायग्नोस्टिक टूल है जिसे मैंने पहले लिखा था; एक कमांड IP / DNS / प्रॉक्सी / जोखिम नियंत्रण का परीक्षण करती है, और आपको सीधे बताती है कि आपका वर्तमान नेटवर्क आधिकारिक API से साफ तौर पर कनेक्ट हो सकता है या नहीं।
- यदि परीक्षण पूरा लाल / पीला आता है (DNS प्रदूषण, प्रॉक्सी पहचान, जोखिम नियंत्रण हिट) → संकोच न करें, थर्ड-पार्टी के लिए जाएँ, और अपने आप को अनगिनत रहस्यमय समस्या निवारण (troubleshooting) से बचाएँ।
- यदि परीक्षण पूरा हरा आता है → ईमानदारी से आधिकारिक वाले का उपयोग करें, और थोड़े से पैसे बचाने के लिए पर्यावरण चरों के एक और सेट के साथ परेशान न हों।
💡 एक वाक्य का सारांश: थर्ड-पार्टी मॉडल "पैसे बचाने + घरेलू डायरेक्ट कनेक्शन" का व्यापार "कोडिंग सीमा + बैकअप" के लिए करते हैं; हैवी यूज़र और घरेलू डायरेक्ट कनेक्शन पार्टी को बदलना चाहिए, सब्सक्रिप्शन पार्टी और हार्डकोर रीफैक्टरिंग पार्टी को इसमें नहीं पड़ना चाहिए।
03 कार्रवाई: DeepSeek को Claude Code से जोड़ना
ठीक है, मान लीजिए आपने बदलने की पुष्टि कर दी है। यह खंड एक कॉन्फ़िगरेशन प्रदान करता है जिसे आप सीधे कॉपी करके चला सकते हैं।
नीचे मैं उदाहरण के लिए DeepSeek का उपयोग करूँगा (घरेलू रूप से सबसे परेशानी मुक्त)। अन्य थर्ड-पार्टी मॉडल (Kimi, Zhipu, विभिन्न एग्रीगेटर ट्रांज़िट स्टेशन...) को जोड़ने की प्रक्रिया बिल्कुल वैसी ही है, बस
ANTHROPIC_BASE_URLऔर मॉडल के नाम को संबंधित प्लेटफ़ॉर्म के नामों से बदल दें — ये उनके संबंधित आधिकारिक दस्तावेज़ों के अधीन हैं।
पूर्वापेक्षा (Prerequisite): एक DeepSeek API Key प्राप्त करें
शर्त यह है कि आपने पहले ही Claude Code स्थापित कर लिया है (यदि नहीं, तो 02 · स्थापना और उपयोग पर वापस जाएँ)। फिर:
- DeepSeek ओपन प्लेटफ़ॉर्म खोलें, रजिस्टर / लॉगिन करें
- एक API Key बनाएँ, इसे कॉपी करें और सुरक्षित रूप से सहेजें (जैसे
sk-xxxxxxxx)
🔑 API Key आपके खाते के वॉलेट की चाबी के बराबर है। इसे Git रिपॉजिटरी में सबमिट न करें, इसे ग्रुप चैट में न भेजें, और इसे कोड में न लिखें। नीचे हम इसे प्रबंधित करने के लिए पर्यावरण चरों का उपयोग करेंगे, जो स्वाभाविक रूप से कोड में प्रवेश नहीं करते हैं।
चरण 1: पर्यावरण चर (Environment Variables) कॉन्फ़िगर करें
पर्यावरण चर "स्विच और पतों का एक सेट हैं जो सिस्टम के पढ़ने के लिए लिखे गए हैं"; जब Claude Code शुरू होता है, तो वह यह तय करने के लिए उन्हें पढ़ेगा कि कहाँ भेजना है और किस मॉडल का उपयोग करना है।
सादृश्य: एक कूरियर वेयबिल (waybill) भरना। ANTHROPIC_BASE_URL प्राप्तकर्ता का पता है, ANTHROPIC_AUTH_TOKEN आपका आईडी कार्ड है (पहचान सत्यापित होने पर ही वे इसे भेजेंगे), और वह स्ट्रिंग ANTHROPIC_*_MODEL "यह निर्दिष्ट करना है कि कौन सा कूरियर वितरित करेगा" के लिए है। यदि फॉर्म सही ढंग से भरा गया है, तो पैकेज (आपका अनुरोध) सही स्थान पर पहुँच सकता है और सही व्यक्ति द्वारा नियंत्रित किया जा सकता है।
Mac / Linux
टर्मिनल खोलें, और लाइन दर लाइन निष्पादित करें ( <आपकी DeepSeek API Key> को असली Key से बदलें):
export ANTHROPIC_BASE_URL=https://api.deepseek.com/anthropic
export ANTHROPIC_AUTH_TOKEN=<आपकी DeepSeek API Key>
export ANTHROPIC_MODEL=deepseek-chat
export ANTHROPIC_DEFAULT_OPUS_MODEL=deepseek-chat
export ANTHROPIC_DEFAULT_SONNET_MODEL=deepseek-chat
export ANTHROPIC_DEFAULT_HAIKU_MODEL=deepseek-chatWindows (PowerShell)
$env:ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic"
$env:ANTHROPIC_AUTH_TOKEN="<आपकी DeepSeek API Key>"
$env:ANTHROPIC_MODEL="deepseek-chat"
$env:ANTHROPIC_DEFAULT_OPUS_MODEL="deepseek-chat"
$env:ANTHROPIC_DEFAULT_SONNET_MODEL="deepseek-chat"
$env:ANTHROPIC_DEFAULT_HAIKU_MODEL="deepseek-chat"⚠️ मॉडल नाम के बारे में: ऊपर लिखा गया
deepseek-chatएक उदाहरण प्लेसहोल्डर है। DeepSeek का विशिष्ट मॉडल नाम (और यह किस क्षमता स्तर से मेल खाता है) DeepSeek आधिकारिक दस्तावेज़ के अधीन है; जब प्लेटफ़ॉर्म अपग्रेड होता है तो नाम बदल जाएगा, इसलिए इसे हार्डकोड न करें। मॉडल का नाम "वेयबिल पर भरा गया कूरियर नंबर" है; यदि आप इसे गलत भरते हैं, तो सिस्टम इसे नहीं पहचानेगा, और यह स्टार्टअप पर त्रुटि की रिपोर्ट करेगा।

उपरोक्त आरेख का पूरा लिंक (link) व्यक्त करना चाहता है: आपका निर्देश → Claude Code इसे एक अनुरोध में पैक करता है → BASE_URL प्राप्तकर्ता का पता DeepSeek में बदलता है → AUTH_TOKEN पहचान सत्यापित करता है → DeepSeek मॉडल गणना करता है → परिणाम उसी पथ के साथ टर्मिनल पर वापस आता है। Claude Code "शेल" बीच में पूरी प्रक्रिया में अपरिवर्तित रहता है।
चरण 2: कॉन्फ़िगरेशन को स्थायी रूप से प्रभावी बनाएँ (वैकल्पिक लेकिन अत्यधिक अनुशंसित)
उपरोक्त export / $env: केवल वर्तमान टर्मिनल विंडो में प्रभावी हैं; यदि आप विंडो बंद करते हैं, तो वे चले जाते हैं — यह शुरुआती लोगों के लिए पहला बड़ा गड्ढा है: "मैंने स्पष्ट रूप से इसे कॉन्फ़िगर किया था, जब मैं टर्मिनल फिर से खोलता हूँ तो यह काम क्यों नहीं करता है?"
इसे स्थायी रूप से प्रभावी बनाने के लिए:
- Mac (zsh, डिफ़ॉल्ट): उन
exportलाइनों को~/.zshrcके अंत में जोड़ें, फिरsource ~/.zshrcनिष्पादित करें - Linux (bash): उन्हें
~/.bashrcके अंत में जोड़ें,source ~/.bashrcनिष्पादित करें - Windows: "सिस्टम गुण (System Properties) → पर्यावरण चर (Environment Variables)" में उपयोगकर्ता चर (User variables) जोड़ें, या उन्हें PowerShell के
$PROFILEमें लिखें
💡 एक वाक्य का सारांश: DeepSeek से जुड़ना = Key प्राप्त करना + पर्यावरण चरों का एक सेट कॉन्फ़िगर करना (पता + आईडी कार्ड + मॉडल नाम); अस्थायी export विंडो बंद होने पर अमान्य हो जाते हैं, दीर्घकालिक उपयोग के लिए उन्हें
~/.zshrcमें लिखें।
04 सत्यापन: क्या यह वास्तव में जुड़ा हुआ है
कॉन्फ़िगरेशन के ठीक बाद इसका उपयोग करने की जल्दबाज़ी न करें, पहले सत्यापित करें। यदि आप बिना सत्यापन के काम करना शुरू कर देते हैं, तो संभावना है कि आप लंबे समय तक कोड करेंगे, केवल यह पता लगाने के लिए कि अनुरोध अभी भी आधिकारिक मार्ग से जा रहे हैं और बिल्कुल स्विच नहीं हुए हैं — आपका समय बर्बाद हो रहा है।
सत्यापन केवल एक कमांड है। किसी भी प्रोजेक्ट निर्देशिका में प्रवेश करें, Claude Code प्रारंभ करें, और /status दर्ज करें:
cd /path/to/your-project
claudeअंदर जाने के बाद, संवाद बॉक्स में टाइप करें:
/statusयदि यह कनेक्ट है, तो आपको आउटपुट में इस तरह की कुछ पंक्तियाँ दिखाई देंगी (Base URL और मॉडल पर ध्यान दें):
Base URL: https://api.deepseek.com/anthropic
Model: deepseek-chatजब आप देखते हैं कि Base URL, DeepSeek के पते में बदल गया है, तो इसका मतलब है कि "इंजन" वास्तव में बदल दिया गया है। /status आपके खाते की जानकारी और वर्तमान मॉडल भी प्रदर्शित करेगा, जो इस तरह की समस्याओं का निवारण करने का सबसे तेज़ तरीका है — आधिकारिक दस्तावेज़ भी विशेष रूप से "यह सत्यापित करने के लिए कि आपका प्रॉक्सी और गेटवे कॉन्फ़िगरेशन सही ढंग से लागू किया गया है" इसका उपयोग करने का उल्लेख करते हैं।
यदि यह अभी भी आधिकारिक पता प्रदर्शित करता है, या सीधे त्रुटि की रिपोर्ट करता है, तो इन उच्च-आवृत्ति (high-frequency) कारणों की एक-एक करके जाँच करें:
| लक्षण (Phenomenon) | संभावित कारण | इसे कैसे ठीक करें |
|---|---|---|
| Base URL अभी भी आधिकारिक है | पर्यावरण चरों ने प्रभाव नहीं डाला (संभवतः एक नया टर्मिनल खोला गया था) | फिर से source करें, या पुष्टि करें कि वे कॉन्फ़िगरेशन फ़ाइल में लिखे गए थे |
| स्टार्टअप रिपोर्ट करता है कि मॉडल मौजूद नहीं है | मॉडल का नाम गलत लिखा गया है / प्लेटफ़ॉर्म का नाम बदल गया है | नवीनतम मॉडल नाम देखने के लिए DeepSeek आधिकारिक दस्तावेज़ देखें |
| 401 / प्रमाणीकरण (Authentication) विफल | API Key गलत है या समाप्त हो गई है | एक नई Key बनाएँ, जाँचे कि क्या आपने अतिरिक्त रिक्त स्थान (spaces) कॉपी किए हैं |
| claude.ai पर लॉग सेन करने के लिए संकेत देता है | क्लाइंट अभी भी आधिकारिक लॉगिन का उपयोग करना चाहता है | नीचे स्पष्टीकरण देखें |
उस आखिरी वाले के बारे में एक बात: कुछ थर्ड-पार्टी कनेक्शन परिदृश्यों में, Claude Code स्टार्टअप अभी भी आधिकारिक लॉगिन प्रॉम्प्ट को पॉप अप करेगा। एक सामान्य समाधान ~/.claude.json को संशोधित करना और ऑनबोर्डिंग को छोड़ने के लिए "hasCompletedOnboarding": true की एक पंक्ति जोड़ना है। यह एक प्रयोगात्मक बायपास (experimental bypass) है और आधिकारिक दस्तावेज़ों में प्रलेखित मानक अभ्यास नहीं है; नए संस्करणों में व्यवहार बदल सकता है — यदि संभव हो तो इसे न बदलें, और केवल तभी प्रयास करें जब आप वास्तव में फंस गए हों।
💡 एक वाक्य का सारांश: क्या यह देखने के लिए
/statusदेखें कि Base URL बदल गया है या नहीं; यदि यह कनेक्ट नहीं होता है, तो आँख बंद करके अनुमान न लगाएँ, एक-एक करके समस्या निवारण (troubleshooting) तालिका देखें।
05 उन्नत (Advanced): मॉडल का स्तरीय (Layered) उपयोग करें, पैसे बचाएँ और श्रृंखला (chain) को न तोड़ें
यह खंड सबसे मूल्यवान तरकीब है, और यह खंड 02 में उल्लिखित "उन्हें मिलाकर उपयोग करने" का विशिष्ट कार्यान्वयन भी है।
क्या आपको खंड 01 में ANTHROPIC_*_MODEL चर का वह समूह याद है? उन्हें केवल बेतरतीब ढंग से बार-बार नहीं भरा जाता है — Claude Code आंतरिक रूप से कार्यों को तीन गियर (gears) में विभाजित करता है, और आप प्रत्येक गियर के लिए अलग-अलग मॉडल असाइन कर सकते हैं।
| चर (Variable) | आधिकारिक अर्थ | किस तरह के काम के लिए उपयुक्त है |
|---|---|---|
ANTHROPIC_DEFAULT_OPUS_MODEL | मॉडल जो opus उपनाम से रिज़ॉल्व होता है | सबसे जटिल: आर्किटेक्चर डिज़ाइन, कठिन डिबगिंग |
ANTHROPIC_DEFAULT_SONNET_MODEL | मॉडल जो sonnet उपनाम से रिज़ॉल्व होता है | दैनिक: सुविधाएँ लिखना, कोड बदलना |
ANTHROPIC_DEFAULT_HAIKU_MODEL | मॉडल जो haiku उपनाम से रिज़ॉल्व होता है / पृष्ठभूमि सुविधाएँ (जैसे स्वचालित title, आदि) | हल्का: त्वरित प्रश्न और उत्तर, पृष्ठभूमि के छोटे काम |
CLAUDE_CODE_SUBAGENT_MODEL | सभी सब-एजेंट / agent team द्वारा उपयोग किया जाने वाला मॉडल | उप-कार्य (Sub-tasks), एक सस्ता और तेज़ कार्य देने की अनुशंसा की जाती है |
उपरोक्त सभी अर्थ आधिकारिक "मॉडल कॉन्फ़िगरेशन" दस्तावेज़ से आते हैं। यह तंत्र DeepSeek के लिए विशिष्ट नहीं है; यह Claude Code के लिए नेटिव है — थर्ड-पार्टी को जोड़ते समय, आप बस इन उपनामों (aliases) को थर्ड-पार्टी मॉडल की ओर इशारा कर रहे होते हैं।
सादृश्य: रेस्तरां शेड्यूलिंग। मुख्य रसोइए (सबसे मजबूत मॉडल) का वेतन अधिक होता है, इसलिए उसे केवल सिग्नेचर हार्ड डिश बनाने दें; घर जैसी हलचल-तलना (stir-fries) सामान्य रसोइयों (मिड-रेंज मॉडल) को सौंपें; और चाय परोसना, पानी डालना और सब्जियां धोना (पृष्ठभूमि के छोटे काम, उप-कार्य) अप्रेंटिस (सस्ता और तेज़ मॉडल) को भेजा जा सकता है। पूरी दुकान में मुख्य रसोइयों का उपयोग करें? भोजन स्वादिष्ट होता है, लेकिन आप वेतन नहीं दे सकते।
तो इसे कॉन्फ़िगर करने का वास्तव में सही तरीका "सभी के लिए एक मॉडल भरना" नहीं है, बल्कि परत (layering) है — मान लीजिए कि एक निश्चित प्लेटफ़ॉर्म में एक ही समय में एक "मजबूत तर्क (strong reasoning) मॉडल" और एक "तेज़ और सस्ता मॉडल" दोनों हैं:
# जटिल कार्यों के लिए मजबूत वाले का प्रयोग करें
export ANTHROPIC_DEFAULT_OPUS_MODEL=<मजबूत तर्क मॉडल का नाम>
export ANTHROPIC_DEFAULT_SONNET_MODEL=<मजबूत तर्क मॉडल का नाम>
# छोटे कार्यों और सब-एजेंटों के लिए पैसे बचाने के लिए सस्ते और तेज़ वाले का उपयोग करें
export ANTHROPIC_DEFAULT_HAIKU_MODEL=<तेज़ और सस्ता मॉडल नाम>
export CLAUDE_CODE_SUBAGENT_MODEL=<तेज़ और सस्ता मॉडल नाम>इस तरह से कॉन्फ़िगर करने के लाभ: जब आप Claude Code में "हैवी गियर" पर स्विच करने के लिए /model opus का उपयोग करते हैं, तो यह मजबूत मॉडल चलाता है; सामान्यतः, यह डिफ़ॉल्ट रूप से सस्ता वाला चलाता है, और सब-एजेंटों (subagents) जैसे उच्च-आवृत्ति पृष्ठभूमि (high-frequency background) कॉल स्वचालित रूप से सबसे सस्ते रास्ते पर जाते हैं — बिल तुरंत कम हो जाएगा।
"सोच की गहराई" को नियंत्रित करने वाला एक अन्य चर CLAUDE_CODE_EFFORT_LEVEL है, आधिकारिक तौर पर low / medium / high / xhigh / max / auto का समर्थन करता है (auto का अर्थ है मॉडल के डिफ़ॉल्ट गियर को पुनर्स्थापित करना; कौन से गियर उपलब्ध हैं यह मॉडल पर निर्भर करता है)। यदि आप चाहते हैं कि मॉडल थोड़ी देर और सोचे और परिणाम अधिक स्थिर हों, तो आप इसे बढ़ा सकते हैं; यदि आप token सहेजना चाहते हैं और इसे तेज़ बनाना चाहते हैं, तो इसे कम करें।
कॉन्फ़िगर करने का एक अच्छा तरीका: डिफ़ॉल्ट गियर को सस्ते मॉडल +
mediumeffort के साथ भरें दैनिक कार्यों को चलाने के लिए; जब आप किसी कठिन समस्या का सामना करते हैं, तो हार्ड गियर पर स्विच करने के लिए मैन्युअल रूप से/modelका उपयोग करें + अस्थायी रूप से इसेhighपर खींचें। इस तरह के सेटअप से मासिक API बिल शायद मूल के एक तिहाई तक कम हो जाएगा, और दैनिक अनुभव में लगभग कोई अंतर नहीं होगा।
💡 एक वाक्य का सारांश: सभी गियर (gears) में एक मॉडल न भरें — मोटे काम सस्ते वाले को दें, कठिन काम मजबूत वाले को दें, और सब-एजेंट सबसे सस्ते रास्ते पर जाएँ; स्तरीकरण (layering) के बाद, आप पैसे बचा सकते हैं और एक ही समय में गुणवत्ता प्राप्त कर सकते हैं।
06 शुरुआती लोगों (Beginners) के लिए दो अनिवार्य नुकसान (Pitfalls)
अंत में, आइए दो नुकसानों (pitfalls) को निकालें जिनमें शुरुआती लोग आमतौर पर गिरते हैं, और विशेष रूप से उनके बारे में बात करते हैं।
नुकसान एक: ऐसे चर (variable) नाम की प्रतिलिपि बनाना जिसे आधिकारिक तौर पर हटा (deprecated) दिया गया है
ऑनलाइन (कुछ ट्यूटोरियल्स की "संदर्भ कॉन्फ़िगरेशन" तालिकाओं सहित), आप "तेज़ छोटे मॉडल" को निर्दिष्ट करने के लिए एक चर ANTHROPIC_SMALL_FAST_MODEL देखेंगे।
यह चर आधिकारिक तौर पर "अप्रचलित (deprecated)" के रूप में चिह्नित किया गया है, और सही एक ANTHROPIC_DEFAULT_HAIKU_MODEL है। जब बहुत से लोग इसे पहली बार कॉन्फ़िगर करते हैं, तो वे पुराने ट्यूटोरियल के आधार पर ANTHROPIC_SMALL_FAST_MODEL कॉपी करते हैं; हालाँकि यह उस समय भी चल सकता है, उन्हें हमेशा इस बात को लेकर अनिश्चितता रहती है — यदि आप आधिकारिक "पर्यावरण चर" दस्तावेज़ को देखते हैं, तो आप पाएंगे कि इसे बदल दिया गया है।
निष्कर्ष: नए कॉन्फ़िगरेशन को हमेशा ANTHROPIC_DEFAULT_HAIKU_MODEL का उपयोग करना चाहिए, और जब आप पुराने ट्यूटोरियल में ANTHROPIC_SMALL_FAST_MODEL देखते हैं, तो इसे सीधे बदल दें, इसे न रखें।
नुकसान दो: AUTH_TOKEN और API_KEY के बीच अंतर करने में असमर्थता
थर्ड-पार्टी मॉडल को जोड़ते समय, प्रमाणीकरण (authentication) के लिए किस चर का उपयोग किया जाना चाहिए? ये दोनों एक जैसे दिखते हैं, लेकिन इनका व्यवहार पूरी तरह से अलग है — सीधे आधिकारिक स्पष्टीकरण देखें:
| चर (Variable) | आधिकारिक व्यवहार | थर्ड-पार्टी को जोड़ते समय किसका उपयोग करें |
|---|---|---|
ANTHROPIC_AUTH_TOKEN | एक Authorization हेडर के रूप में भेजा जाता है, मान स्वचालित रूप से Bearer उपसर्ग (prefix) के साथ जुड़ जाता है | ✅ DeepSeek जैसे थर्ड-पार्टी मॉडल को जोड़ते समय इसका उपयोग करें |
ANTHROPIC_API_KEY | एक X-Api-Key हेडर के रूप में भेजा जाता है; गैर-इंटरैक्टिव मोड (-p) में, जब तक यह मौजूद है, इसका उपयोग करने के लिए मजबूर किया जाता है | आधिकारिक Anthropic API का उपयोग करते समय उपयोग करें |
थर्ड-पार्टी मॉडल ANTHROPIC_AUTH_TOKEN की अनुशंसा क्यों करते हैं? क्योंकि DeepSeek जैसे संगत इंटरफेस मानक Authorization: Bearer <key> का उपयोग करते हैं, जो पूरी तरह से मेल खाता है। यही कारण है कि सामुदायिक समाधान (community solutions) और वास्तविक परीक्षण दोनों ANTHROPIC_AUTH_TOKEN का उपयोग करते हैं।
जागरूक होने के लिए एक और छोटा जुड़ा हुआ नुकसान है: आधिकारिक दस्तावेज़ स्पष्ट रूप से बताता है कि, जब ANTHROPIC_BASE_URL "प्रथम-पक्ष (first-party) होस्ट" (यानी, गैर-आधिकारिक पता) की ओर इशारा करता है, तो MCP टूल खोज डिफ़ॉल्ट रूप से बंद हो जाएगी। सीधे शब्दों में कहें — किसी थर्ड-पार्टी मॉडल को जोड़ने के बाद, आधिकारिक साइट पर निर्भर कुछ उन्नत सुविधाओं (advanced features) का व्यवहार अलग हो सकता है या वे अनुपयोगी भी हो सकती हैं। यह खंड 02 के वाक्यांश "प्रयोगात्मक, कोई बैकअप नहीं" को भी प्रतिध्वनित (echoes) करता है। आप दैनिक प्रोग्रामिंग में इसका अधिक उपयोग नहीं करेंगे, लेकिन यदि आप MCP पर बहुत अधिक निर्भर हैं, तो आपको इस बात का ध्यान रखना चाहिए।
💡 एक वाक्य का सारांश: प्रमाणीकरण (authentication) के लिए
ANTHROPIC_AUTH_TOKENकी तलाश करें, और छोटे मॉडल के लिएANTHROPIC_DEFAULT_HAIKU_MODELकी तलाश करें; पुराने ट्यूटोरियल में अप्रचलित चरों को सीधे बदलें, और थर्ड-पार्टी मॉडल को जोड़ने के बाद कुछ उन्नत सुविधाएँ कम हो जाएंगी।
07 सारांश (Summary)
इस लेख ने केवल एक काम किया है: Claude Code के "ब्रेन" को आधिकारिक Claude से एक सस्ते थर्ड-पार्टी मॉडल में बदलना।
आइए मुख्य बिंदुओं को एक साथ रखें:
| चरण (Link) | मुख्य क्रिया (Key Action) |
|---|---|
| स्पष्ट रूप से सोचें | केवल हैवी यूज़र्स / घरेलू डायरेक्ट कनेक्शन पार्टी को बदलना चाहिए, सब्सक्रिप्शन पार्टी को परेशान नहीं होना चाहिए |
| कनेक्ट करें | ANTHROPIC_BASE_URL + ANTHROPIC_AUTH_TOKEN + मॉडल का नाम कॉन्फ़िगर करें |
| सत्यापित करें | यह देखने के लिए /status का उपयोग करें कि Base URL बदला है या नहीं |
| वहाँ सहेजें जहाँ यह मायने रखता है | मॉडल को परतों (layers) में भरें, मोटे काम सस्ते वाले को दें, कठिन काम मजबूत वाले को दें, और सब-एजेंट (subagent) सबसे सस्ता हो |
| नुकसान से बचें | अप्रचलित ANTHROPIC_SMALL_FAST_MODEL का उपयोग न करें; प्रमाणीकरण के लिए AUTH_TOKEN का उपयोग करें |
अब आपको सक्षम होना चाहिए: DeepSeek (या किसी भी थर्ड-पार्टी मॉडल जो Anthropic प्रोटोकॉल के अनुकूल हो) को स्वतंत्र रूप से Claude Code से कनेक्ट करें, कनेक्शन की पुष्टि करें, और बिल को कम करने के लिए कार्य स्तरों के अनुसार कॉन्फ़िगर करें।
उस प्रति-सहज (anti-intuitive) बात पर फिर से ज़ोर दें: यह पैसे बचाने का एक साधन है, कोई आवश्यक पाठ्यक्रम नहीं। क्या यह प्रयास के लायक है यह इस बात पर निर्भर करता है कि क्या आप वास्तव में अपने API बिलों से आहत हैं — अधिकांश हल्के उपयोगकर्ताओं (light users) के लिए ईमानदारी से आधिकारिक मॉडल का उपयोग करना ही ठीक है।
अगला लेख 06 · Coding Plan: सब्सक्रिप्शन पैकेज और बिलिंग — चूंकि यह लेख "पैसे बचाने" के बारे में बात कर रहा है, तो चलिए अंत तक गणना करते हैं: Claude का सब्सक्रिप्शन पैकेज (Pro / Max) या पे-एज़-यू-गो (pay-as-you-go) API, कौन सा अधिक लागत प्रभावी (cost-effective) है? आपके लिए पहले सोचने के लिए एक प्रश्न: यदि आप हर दिन Claude Code का भारी उपयोग करते हैं, तो क्या आपको सब्सक्रिप्शन खरीदना चाहिए, या थर्ड-पार्टी API से जुड़ना अधिक किफायती (economical) है? अगला लेख पढ़ने के बाद आपके पास उत्तर होगा।