Claude Code ला Bedrock किंवा Vertex AI वर कसे चालवावे?
Claude Code ला Amazon Bedrock किंवा Google Vertex AI शी कनेक्ट करण्यासाठी आवश्यक environment variables आणि क्रेडेंशियल्सची माहिती घ्या. बिलिंग आणि मॉडेल्समधील फरक जाणून घ्या.
जेव्हा Claude Code तुमच्या स्वतःच्या क्लाउड अकाउंटवर चालते तेव्हा काय बदल होते
तुम्ही Claude Code ला Amazon Bedrock किंवा Google Vertex AI वर चालवू शकता. यासाठी फक्त दोन किंवा तीन environment variables आणि तुमच्या टीमकडे आधीपासून असलेली क्लाउड credentials बदलण्याची गरज असते. स्थानिक पातळीवर सर्व काही पूर्वीप्रमाणेच काम करते: CLI, subagents, hooks, skills, MCP servers आणि तुमच्या CLAUDE.md फाइल्स. फक्त model call ची जागा बदलते आणि त्यासोबत चार गोष्टी बदलतात: विनंती ज्या नेटवर्कवरून जाते ते नेटवर्क, ज्या अकाउंटमधून त्याचे पैसे दिले जातात ते अकाउंट, तुम्हाला वापरण्याची परवानगी असलेले Claude मॉडेल्स आणि उपलब्ध असलेली सर्व्हर-साइड वैशिष्ट्ये.
हे काम करेल का, हा प्रश्न क्वचितच असतो. ते काम करतेच. प्रश्न हा आहे की, या चार गोष्टींपैकी तुम्हाला सर्वात जास्त कशाची काळजी आहे.
तीन राउटिंग पर्याय आणि त्यांची किंमत
Anthropic डायरेक्ट सबस्क्रिप्शनसह. तुम्ही Pro, Max, Team किंवा Enterprise प्लॅनवर claude.ai अकाउंटद्वारे साइन इन करता. विनंत्या Anthropic च्या API कडे जातात. तुम्ही प्रति सीट पैसे भरता आणि वापर हा टोकननुसार मोजण्याऐवजी प्लॅनच्या मर्यादेनुसार नियंत्रित असतो. हे एकमेव राउटिंग आहे जे अकाउंटवर आधारित इंटरफेसपर्यंत पोहोचते, जसे की वेबवरील Claude Code, मोबाइल ॲप, डेस्कटॉप आणि रिमोट कंट्रोल. टीमसाठी, Claude Enterprise प्लॅन यामध्ये सिंगल साइन-ऑन आणि व्यवस्थापित पॉलिसी सेटिंग्जची जोड देतो.
Anthropic डायरेक्ट API की (key) सह. तुम्ही Anthropic Console मध्ये एक की तयार करता आणि प्रति टोकन पैसे भरता. यामध्ये सबस्क्रिप्शनसारखीच इन्फ्रास्ट्रक्चर आणि रिजन असतात, परंतु कोणतेही सीट नसते आणि वापर Anthropic च्या स्वतःच्या डॅशबोर्डवर दिसतो. या दोनपैकी कोणता पर्याय स्वस्त आहे हे एजंट दिवसातून किती तास प्रत्यक्षात चालतो यावर अवलंबून असते, जो API विरुद्ध सबस्क्रिप्शन खर्चाची तुलना आणि Claude Code चा प्रत्यक्ष खर्च या विषयाचा मुख्य भाग आहे.
Bedrock किंवा Vertex वरील थर्ड-पार्टी एंडपॉइंट. तुमचे स्वतःचे AWS किंवा Google Cloud अकाउंट मॉडेल सर्व्ह करते. इन्फरन्सच्या वेळी Anthropic विनंतीच्या मार्गामध्ये नसते. टोकन्सचे बिल तुम्हाला आधीच मिळणाऱ्या बिलामध्ये समाविष्ट होते, जे तुम्ही आधीच वापरत असलेल्या IAM (identity and access management) पॉलिसी आणि ऑडिट लॉग्सच्या अंतर्गत येते. आणखी दोन थर्ड-पार्टी पर्याय उपलब्ध आहेत, Microsoft Foundry आणि AWS वरील Claude Platform, आणि ते याच स्वरूपाचे आहेत: एक एन्व्हायर्नमेंट व्हेरिएबल प्रोव्हायडर निवडते आणि क्लाउड अकाउंटद्वारे पेमेंट केले जाते.
नामकरणाबाबत टीप, ऑगस्ट 2026 पर्यंत: Google ने Vertex AI चे नाव बदलून Google Cloud's Agent Platform असे केले आहे. Anthropic च्या डॉक्युमेंटेशनमध्ये नवीन नाव वापरले आहे, Claude Code लॉगिन प्रॉम्प्टमध्ये अजूनही Google Vertex AI असे दिसते आणि एन्व्हायर्नमेंट व्हेरिएबल्समध्ये अजूनही VERTEX असेच नमूद आहे.
डेटा रेसिडेन्सी हेच यासाठीचे मुख्य कारण आहे
Bedrock वर विनंती तुमच्या स्वतःच्या खात्यातील, तुम्ही निवडलेल्या AWS रिजनमधील Bedrock एंडपॉइंटवर जाते. डेटा 'at rest' असताना AWS-managed कीजद्वारे AES-256 ने एनक्रिप्ट केला जातो आणि तुम्ही AWS KMS (key management service) द्वारे स्वतःची की देखील वापरू शकता. Vertex वर यासाठी Google-managed एनक्रिप्शन कीज उपलब्ध आहेत, तसेच CMEK (customer-managed encryption keys) चा पर्यायही मिळतो. ॲक्सेसवर तुमच्या सध्याच्या IAM रोल्सचे नियंत्रण असते आणि इतर कोणत्याही API कॉलप्रमाणे हे कॉल्स CloudTrail किंवा Cloud Audit Logs मध्ये दिसतात. नियमन (regulated) क्षेत्रात काम करणाऱ्या टीमसाठी हाच मुख्य युक्तिवाद आहे आणि तो समर्थनीय आहे.
दोन तांत्रिक बाबींमुळे हे मार्केटिंगमध्ये सांगितल्याइतके पूर्णपणे निर्दोष नाही.
क्रॉस-रिजन इन्फरन्स प्रोफाइल म्हणजे एकच रिजन नव्हे. Bedrock वर, Claude Code त्याच्या अंगभूत डीफॉल्ट मॉडेल्सना क्रॉस-रिजन इन्फरन्स प्रोफाइल IDs मध्ये रिझॉल्व्ह करते. ज्या रिजनमध्ये हे रिझॉल्व्ह होते, त्यानुसार ते प्रीफिक्स निवडते: us. हे us-* रिजनमध्ये, eu. हे eu-* रिजनमध्ये, apac. हे ap-* रिजनमध्ये आणि us-gov. हे GovCloud मध्ये वापरले जाते. क्रॉस-रिजन प्रोफाइल त्या भौगोलिक क्षेत्रातील दुसऱ्या रिजनमधून विनंती पूर्ण करू शकते, त्यामुळे तुम्हाला मिळणारी हमी ही एका शहराची नसून संपूर्ण भौगोलिक क्षेत्राची असते. जर तुमच्या गरजेनुसार एकच विशिष्ट रिजन आवश्यक असेल, तर application inference profile द्वारे राउटिंग करा आणि ANTHROPIC_MODEL मध्ये त्याचा ARN सेट करा.
काही ट्रॅफिक अजूनही Anthropic कडे जाते, पण त्यात तुमचा कोड नसतो. Bedrock आणि Vertex या दोन्हीवर टेलिमेट्री, एरर रिपोर्टिंग आणि /feedback कमांड डीफॉल्टनुसार बंद असतात. तसेच, /feedback काहीही अपलोड करण्याऐवजी तुमच्या स्वतःच्या मशीनवर ~/.claude/feedback-bundles/ अंतर्गत एक आर्काइव्ह तयार करते. प्रत्येक प्रोव्हायडरवर दोन अपवाद लागू होतात. URL फेच करण्यापूर्वी, WebFetch टूल सुरक्षितता ब्लॉकलिस्ट तपासण्यासाठी फक्त होस्टनेम api.anthropic.com कडे पाठवते. सेशन क्वालिटी सर्व्हे देखील अजूनही दिसू शकतात. तुमच्या सेटिंग्ज फाईलमध्ये skipWebFetchPreflight वापरून पहिले फीचर आणि CLAUDE_CODE_DISABLE_FEEDBACK_SURVEY=1 वापरून दुसरे फीचर बंद करा, किंवा CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC वापरून सर्व अनावश्यक ट्रॅफिक एकाच वेळी बंद करा.
ट्रेनिंगबाबत: व्यावसायिक अटींनुसार, Anthropic Claude Code द्वारे पाठवलेल्या कोड किंवा प्रॉम्प्ट्सवर मॉडेल्सना ट्रेन करत नाही आणि थर्ड-पार्टी प्लॅटफॉर्मचा वापर व्यावसायिक स्वरूपाचा असतो. 'Development Partner Program', जो ट्रेनिंगसाठी परवानगी देणारा opt-in पर्याय आहे, तो Bedrock किंवा Vertex वापरकर्त्यांना उपलब्ध नाही. या एंडपॉइंट्सवर डेटा किती काळ साठवला जातो, हे तुमच्या AWS किंवा Google सोबतच्या करारावर अवलंबून असते.
Claude Code ला Amazon Bedrock शी कनेक्ट करणे
कोणत्याही क्लायंट कॉन्फिगरेशनपूर्वी प्रत्येक AWS अकाउंटसाठी दोन गोष्टी करणे आवश्यक आहे. Amazon Bedrock कन्सोल उघडा, मॉडेल कॅटलॉगमधून Anthropic मॉडेल निवडा आणि 'use case' फॉर्म सबमिट करा: सबमिशननंतर लगेच प्रवेश (access) मिळतो. त्यानंतर, Claude Code द्वारे केल्या जाणाऱ्या कॉल्सना परवानगी देणारी IAM पॉलिसी जोडा.
bedrock:InvokeModelbedrock:InvokeModelWithResponseStreambedrock:ListInferenceProfilesbedrock:GetInferenceProfile
ListInferenceProfiles मुळे Claude Code स्टार्टअपच्या वेळी हे तपासू शकते की तुमचे अकाउंट प्रत्यक्षात कोणती मॉडेल्स वापरू शकते. GetInferenceProfile मुळे ते ॲप्लिकेशन इन्फरन्स प्रोफाइल ARN ला त्यामागील फाउंडेशन मॉडेलमध्ये रिझॉल्व्ह करू शकते, जेणेकरून ते योग्य रिक्वेस्ट फॉरमॅट निवडू शकेल. हे नसल्यास, रिक्वेस्ट तरीही यशस्वी होतात, कारण Claude Code दुसऱ्या फॉरमॅटसह एकदा पुन्हा प्रयत्न (retry) करते. याचे लक्षण म्हणजे प्रत्येक नवीन मॉडेलसाठी एक अतिरिक्त राऊंड ट्रिप होणे, एरर येणे नव्हे.
क्लायंटसाठी सर्वात जलद मार्ग म्हणजे विझार्ड. claude रन करा, 3rd-party platform आणि त्यानंतर Amazon Bedrock निवडा, किंवा आधीच साइन-इन असलेल्या सेशनमध्ये /setup-bedrock टाइप करा. हे तुमच्या ~/.aws डिरेक्टरीमधील प्रोफाइल्स वाचते, तुम्ही कोणती मॉडेल्स वापरू शकता याची पडताळणी करते आणि निकाल ~/.claude/settings.json च्या env ब्लॉक मध्ये लिहितो, त्यामुळे कशासाठीही तुमच्या शेल प्रोफाइलवर अवलंबून राहावे लागत नाही.
स्क्रिप्टेड रोलआउटसाठी, व्हेरिएबल्स स्वतः सेट करा.
export CLAUDE_CODE_USE_BEDROCK=1
export AWS_REGION=us-east-1क्रेडेंशियल्स मानक AWS SDK क्रेडेंशियल चेनमधून येतात, त्यामुळे जे काही aws CLI साठी आधीच काम करत आहे ते येथेही काम करेल: aws configure, SSO प्रोफाइल, अझ्युम्ड रोल (assumed role), किंवा Bedrock API की.
aws sso login --profile=your-profile-name
export AWS_PROFILE=your-profile-nameexport AWS_BEARER_TOKEN_BEDROCK=your-bedrock-api-keyबेअरर टोकन (bearer token) हा सर्वात सोपा पर्याय आहे आणि तो काळजीपूर्वक हाताळला पाहिजे, कारण हे एक दीर्घकाळ टिकणारे सिक्रेट आहे जे एनवायरमेंट व्हेरिएबलमध्ये असते. शेअर केलेल्या बिल्ड बॉक्सवर, कालबाह्य होणारा (expires) रोल वापरणे अधिक सुरक्षित आहे. एजंट वाचू शकेल अशा इतर सर्व क्रेडेंशियल्ससाठीही हाच तर्क लागू होतो, जो एआय एजंटच्या आवाक्याबाहेर सिक्रेट्स ठेवणे या विषयाचा भाग आहे.
रिजन ट्रॅप (The region trap). Claude Code या क्रमाने रिजन रिझॉल्व्ह करते: AWS_REGION, त्यानंतर AWS_DEFAULT_REGION, त्यानंतर तुमच्या सक्रिय AWS प्रोफाइलवरील region, आणि शेवटी us-east-1. शेवटची पायरी ही डीफॉल्ट आहे, एरर नाही. त्यामुळे ज्या टीमने कुठेही रिजन सेट केलेले नाही आणि युरोपियन राउटिंग गृहीत धरले आहे, त्यांच्या रिक्वेस्ट कोणत्याही वॉर्निंगशिवाय US रिजनमध्ये पाठवल्या जातील. रिझॉल्व्ह झालेला रिजन आणि तो कोठून आला आहे हे पाहण्यासाठी Claude Code मध्ये /status रन करा. तुमच्या अकाउंटवरून एखाद्या रिजनमध्ये काय कॉल करता येईल हे कन्फर्म करण्यासाठी, aws bedrock list-inference-profiles --region your-region रन करा.
Google Vertex AI वर Claude Code चालवणे
API सक्षम करा आणि क्रेडेंशियल्स मिळवा.
gcloud config set project YOUR-PROJECT-ID
gcloud services enable aiplatform.googleapis.com
gcloud auth application-default loginModel Garden मध्ये तुम्हाला हवे असलेल्या Claude मॉडेल्ससाठी ॲक्सेसची विनंती करा. मंजुरी त्वरित मिळत नाही, त्यामुळे 24 ते 48 तासांचा वेळ द्या. roles/aiplatform.user प्रदान करा, ज्यामध्ये aiplatform.endpoints.predict ही परवानगी समाविष्ट असते, जी मॉडेल इनव्होकेशन आणि टोकन मोजणी या दोन्हीसाठी वापरली जाते.
त्यानंतर प्रोव्हायडर निवडा.
export CLAUDE_CODE_USE_VERTEX=1
export CLOUD_ML_REGION=global
export ANTHROPIC_VERTEX_PROJECT_ID=YOUR-PROJECT-IDCLOUD_ML_REGION साठी global आवश्यक असते, जे eu किंवा us सारखे मल्टी-रिजन लोकेशन किंवा एखादे सिंगल रिजन असू शकते. ग्लोबल एंडपॉईंट सर्वोत्तम उपलब्धता देते, परंतु विनंती कोठे सर्व्ह केली जाते यावर कमी नियंत्रण असते. त्यामुळे, डेटा रेसिडेन्सीच्या अटी असल्यास सहसा विशिष्ट लोकेशन देणे आवश्यक असते. तिन्ही प्रकारांमध्ये मॉडेल कव्हरेज वेगळे असते. जेव्हा तुम्हाला आवश्यक असलेले एखादे मॉडेल ग्लोबल एंडपॉईंटवर उपलब्ध नसते, तेव्हा त्या मॉडेलला त्याच्या VERTEX_REGION_CLAUDE_* व्हेरिएबलसह एका विशिष्ट लोकेशनवर पिन करा आणि बाकी सर्व ग्लोबल ठेवा. जुन्या माहितीवर विश्वास ठेवण्याऐवजी सध्याचे Vertex AI locations पेज तपासा.
प्रोजेक्ट ट्रॅप. ANTHROPIC_VERTEX_PROJECT_ID हा प्रोजेक्ट ID मिळवण्याचा सर्वात कमी प्राधान्याचा स्रोत आहे. GCLOUD_PROJECT, GOOGLE_CLOUD_PROJECT आणि GOOGLE_APPLICATION_CREDENTIALS द्वारे निर्देशित केलेली क्रेडेंशियल फाईल या सर्वांना यापेक्षा जास्त प्राधान्य असते. ज्या मशीनवर यापैकी एखादे आधीच एक्सपोर्ट केलेले असते, तिथे चार्जेस त्या दुसऱ्या प्रोजेक्टवर आकारले जातात आणि सेशनमध्ये याची कोणतीही सूचना मिळत नाही.
प्रोव्हायडर बदलल्यानंतर पडताळणी करा. /status रन करा: API provider ओळ Google Vertex AI वाचते आणि GCP project, Default region व Model ओळी Claude Code ने प्रत्यक्षात काय रिझॉल्व्ह केले आहे ते दर्शवतात. जर प्रोव्हायडर ओळ दिसत नसेल, तर व्हेरिएबल्स प्रोसेसपर्यंत पोहोचत नाहीत, कारण ते claude लाँच करणाऱ्या शेलपेक्षा वेगळ्या शेलमध्ये एक्सपोर्ट केलेले असतात. त्यांना सेटिंग फाईलच्या env ब्लॉक मध्ये हलवा; अशा प्रकारे तुम्ही AWS_PROFILE सारखे व्हॅल्यू इतर कोणत्याही प्रोसेसपासून दूर ठेवू शकता.
तुम्हाला कोणते मॉडेल्स मिळतात आणि ते किती उशिरा उपलब्ध होतात
sonnet आणि opus सारखे aliases म्हणजे सर्वात नवीन मॉडेल्स असा अर्थ होत नाही. थर्ड-पार्टी एंडपॉइंटवर ते त्या प्रोव्हायडरसाठी Claude Code च्या डीफॉल्ट सेटिंगवर रिझॉल्व्ह होतात, जे सध्याच्या रिलीजपेक्षा मागे असू शकतात किंवा तुमच्या अकाउंटमध्ये कदाचित इनेबल नसतील. जेव्हा डीफॉल्ट मॉडेल उपलब्ध नसते, तेव्हा Claude Code त्या सेशनसाठी जुन्या किंवा खालच्या श्रेणीतील मॉडेलवर स्विच होते आणि तशी सूचना देते. हा फॉलबॅक सेव्ह केला जात नाही, त्यामुळे पुढच्या सेशनमध्ये पुन्हा प्रयत्न केला जातो आणि पुन्हा सूचना दिली जाते.
टीममध्ये रोलआउट करण्यासाठी, व्हर्जन्स पिन करा.
# Copy the exact IDs from your provider's own model catalog.
export ANTHROPIC_DEFAULT_OPUS_MODEL='<provider model id>'
export ANTHROPIC_DEFAULT_SONNET_MODEL='<provider model id>'
export ANTHROPIC_DEFAULT_HAIKU_MODEL='<provider model id>'models overview मधून आणि तुमच्या प्रोव्हायडरच्या कॅटलॉगमधून IDs घ्या, कारण प्रोव्हायडरनुसार फॉरमॅट बदलतो: Bedrock ला inference profile ID किंवा ARN ची अपेक्षा असते, तर Vertex ला साध्या मॉडेल नावाच्या फॉरमॅटची. हे IDs कोणत्याही लेखातून कॉपी करू नका, यात समाविष्ट असलेल्या लेखातूनही नाही. पिनिंग हे खर्चावर नियंत्रण ठेवण्याचेही एक साधन आहे, कारण डीफॉल्ट प्रायमरी मॉडेल हे Opus-श्रेणीतील असते आणि Sonnet च्या तुलनेत Opus चा प्रति टोकन खर्च जास्त असतो. त्यामुळे, काहीही पिन न केलेले डिप्लॉयमेंट जास्त दराने बिल केले जाते. त्याऐवजी, सेशन डीफॉल्ट म्हणून एक मॉडेल निश्चित करण्यासाठी, ANTHROPIC_MODEL ला त्याच्या पूर्ण ID वर सेट करा.
या तुलनेत मॉडेलची उपलब्धता हा सर्वात महत्त्वाचा फरक आहे. Anthropic च्या स्वतःच्या API वर मॉडेल लाँच झाल्याच्या दिवशीच काम करते. Bedrock आणि Vertex वर ते तेव्हाच काम करते जेव्हा तुमचा क्लाउड प्रोव्हायडर ते तुमच्या रिजनमध्ये इनेबल करतो आणि तुमच्या अकाउंटला प्रवेश मिळतो; यासाठी किमान काही दिवस किंवा कधीकधी त्यापेक्षा जास्त वेळ लागतो. जर काही काम सर्वात नवीन मॉडेलवरच करणे आवश्यक असेल, तर एक राउटिंग असे ठेवा जे तिथे पोहोचू शकेल. वेगवेगळ्या कामांसाठी वेगवेगळे मॉडेल्स राउट करणे यासाठी हे व्यावहारिक कारण आहे.
Bedrock आणि Vertex वर तुम्ही काय गमावता
सर्व स्थानिक (local) घटक सर्व प्रोव्हाइडर्सवर काम करतात: subagents, hooks, slash commands, skills, plugins, checkpoints, sandboxing, व्यवस्थापित settings फाईल आणि OpenTelemetry metrics. त्रुटी फक्त सर्व्हर-साइडवर आहेत.
दोन्ही एंडपॉइंट्सवर खालील गोष्टी उपलब्ध नाहीत: fast mode, Advisor, Channels, cross-session messaging, analytics dashboard आणि सर्व्हर-व्यवस्थापित settings. तसेच, ज्या गोष्टींसाठी claude.ai अकाउंटची आवश्यकता असते, त्या देखील उपलब्ध नाहीत; यामध्ये वेबवरील Claude Code, मोबाईल ॲप, Desktop, Remote Control, routines आणि artifacts यांचा समावेश होतो.
केवळ Bedrock साठी: तिथे WebSearch टूल अस्तित्वात नाही, त्यामुळे Bedrock कडे राउट केलेल्या सेशनमधून Claude सर्च करू शकत नाही. तुम्ही URL दिल्यास ते WebFetch द्वारे पेज वाचू शकते. Vertex वर Claude 4 जनरेशन मॉडेल्स आणि त्यानंतरच्या मॉडेल्ससाठी वेब सर्च काम करते.
दोन्हींवर अंशतः उपलब्ध: auto mode फक्त नवीन मॉडेल्सच्या मर्यादित संचावर चालतो आणि /loop साठी स्पष्ट interval देणे आवश्यक असते, कारण ते स्वतःहून एकही interval निवडू शकत नाही. तुमच्या टीमला एखाद्या फीचरचे आश्वासन देण्यापूर्वी Anthropic चे feature availability पेज तपासा, कारण ही यादी बदलत असते.
बिल कोणाच्या खात्यावर आकारले जाते
सबस्क्रिप्शन आणि थर्ड-पार्टी एंडपॉईंट हे दोन स्वतंत्र खरेदीचे प्रकार आहेत. एक दुसऱ्याची जागा घेऊ शकत नाही.
हे स्पष्टपणे नमूद करणे आवश्यक आहे, कारण यातील चूक शांतपणे घडते. जर तुम्ही अशा मशीनवर CLAUDE_CODE_USE_BEDROCK=1 सेट केले जिथे तुम्ही आधीच Max सीटसह साइन-इन आहात, तर प्रत्येक टोकनचे मोजमाप AWS द्वारे Bedrock च्या दरांवर केले जाईल. सीटसाठी दरमहा शुल्क आकारले जात राहील, परंतु त्यातून कोणत्याही ट्रॅफिकचे पैसे भरले जाणार नाहीत. तसेच, दोन्हीचा एकत्रित तपशील उपलब्ध नसतो: खर्च AWS Cost Explorer किंवा Google Cloud Billing मध्ये दिसतो आणि Anthropic ॲनालिटिक्स डॅशबोर्ड कोणत्याही प्रोव्हायडरवर उपलब्ध नसतो. /logout कमांड देखील अदृश्य होते, कारण तिथे समाप्त करण्यासाठी कोणतेही Anthropic सत्र नसते. क्रेडेंशियल हे क्लाउड क्रेडेंशियल असते.
दर हे प्रोव्हायडरच्या स्वतःच्या पेजवर असतात आणि ते बदलू शकतात, त्यामुळे कोणत्याही लेखातील आकड्यांवर अवलंबून राहण्याऐवजी Amazon Bedrock pricing किंवा Vertex AI pricing वाचा. एक संरचनात्मक बाब बदलत नाही: या एंडपॉईंट्सवर तुम्ही प्रति-टोकन इन्फरन्स खरेदी करता, त्यामुळे दिवसभर चालू राहिलेल्या एजंटचा खर्च त्याच्या वापराप्रमाणे होतो, आणि तो थांबवण्यासाठी कोणतीही प्लॅन कॅप नसते.
प्रत्येक राउटिंगवर रेट लिमिट्स आणि कोटा वेगळ्या पद्धतीने काम करतात
सबस्क्रिप्शनवर, लिमिट्स खात्याशी संबंधित असतात, एका ठराविक वेळापत्रकानुसार रिसेट होतात आणि ती ओलांडल्यास तुम्हाला प्रतीक्षा करावी लागते. या वर्तनाबद्दलची माहिती वापर मर्यादा कशा काम करतात यामध्ये दिली आहे.
Anthropic API key वर, लिमिट्स संस्थेशी संबंधित असतात, ती प्रति मिनिट विनंत्या (requests) आणि टोकन्सच्या स्वरूपात व्यक्त केली जातात आणि तुमच्या वापराच्या टियरनुसार ती वाढतात.
Bedrock आणि Vertex वर, लिमिट्स हे क्लाउड कोटा असतात, जे प्रति खाते किंवा प्रोजेक्ट, प्रति मॉडेल आणि प्रति रिजन यानुसार ठरवलेले असतात. यांचा Anthropic प्लॅनशी कोणताही संबंध नसतो. 429 एररचा अर्थ असा की त्या खात्याने त्या रिजनमधील त्या मॉडेलसाठीचा कोटा ओलांडला आहे. त्यामुळे याचे निराकरण प्रोव्हायडरच्या कन्सोलमध्येच करावे लागते: कोटा वाढवण्याची विनंती करा किंवा जिथे क्षमता उपलब्ध आहे अशा ठिकाणी स्थलांतर करा. Bedrock मध्ये कोटा हा फ्लॅट विनंती संख्येऐवजी token burndown नियमावर आधारित असतो आणि रिझर्व्ह्ड कॅपॅसिटी ही provisioned throughput म्हणून खरेदी केली जाते. Vertex वर, 429 एररचा अर्थ अनेकदा असा असतो की तुमचे सिंगल-रिजन एंडपॉइंट प्राथमिक मॉडेल आणि लहान वेगवान मॉडेल या दोन्हीला सर्व्ह करत नाही, म्हणूनच CLOUD_ML_REGION=global हे दस्तऐवजीकरणानुसार सुरुवातीचे पाऊल आहे. Google चे quotas पेज कोटा वाढवण्याच्या विनंतीची प्रक्रिया स्पष्ट करते.
अपयशाचे प्रकार आणि दिसणारे संदेश
Could not load the default credentials, Vertex वर. Application Default Credentials गहाळ आहेत किंवा त्यांची मुदत संपली आहे. gcloud auth application-default login चालवा, किंवा GOOGLE_APPLICATION_CREDENTIALS ला सर्व्हिस अकाउंट की फाईलकडे निर्देशित करा.
Vertex वर मॉडेलचे नाव दर्शवणारी 404 त्रुटी. ते मॉडेल त्या प्रोजेक्टसाठी Model Garden मध्ये सक्षम केलेले नाही, किंवा तुम्ही सेट केलेल्या लोकेशनवर ते उपलब्ध नाही. काही मॉडेल्स फक्त ग्लोबल एंडपॉईंटवर किंवा eu सारख्या मल्टी-रिजन लोकेशनवर उपलब्ध असतात, विशिष्ट रिजनमध्ये कधीही नसतात.
on-demand throughput isn't supported, Bedrock वर. तुम्ही अशा फाउंडेशन मॉडेलसाठी थेट मॉडेल ID वापरला आहे जे फक्त इन्फरन्स प्रोफाईलद्वारे सर्व्ह केले जाते. त्याऐवजी इन्फरन्स प्रोफाईल ID वापरा.
AWS default-chain credential resolve timed out. AWS क्रेडेंशियल साखळीतील एक टप्पा थांबला आहे, बहुतेकदा एखादा credential_process हेल्पर अशा इनपुटची वाट पाहत असतो जे त्याला कधीही मिळणार नाही. साखळीतील प्रत्येक रिझॉल्व्ह 60 सेकंदांनंतर टाईम-आऊट होतो. जर तुमच्या साखळीला खरोखर जास्त वेळ लागत असेल, उदाहरणार्थ रॅपरच्या मागे MFA (मल्टी-फॅक्टर ऑथेंटिकेशन) सह ब्राउझर SSO फ्लो, तर CLAUDE_CODE_AWS_CHAIN_RESOLVE_TIMEOUT_MS वापरून ही मर्यादा मिलिसेकंदमध्ये वाढवा.
Bedrock streaming response has content-type सुरू करताना त्रुटी. Claude Code आणि Bedrock च्या दरम्यान काहीतरी स्ट्रीम पुन्हा लिहित (rewrite) आहे. Bedrock हे application/vnd.amazon.eventstream कंटेंट टाईपसह बायनरी इव्हेंट-स्ट्रीम फॉरमॅटमध्ये स्ट्रीम करते, त्यामुळे जे गेटवे त्याला सर्व्हर-सेंट इव्हेंट्स म्हणून पुन्हा उत्सर्जित (re-emit) करतात, ते असा बॉडी देतात जो Claude Code डिकोड करू शकत नाही. गेटवे दुरुस्त करा जेणेकरून तो रिस्पॉन्स बॉडी आणि त्याचा Content-Type हेडर जसाच्या तसा पुढे पाठवेल.
AWS SSO दरम्यान ब्राउझर टॅब्स लूपमध्ये उघडणे. कॉर्पोरेट VPN किंवा TLS-इन्स्पेक्टिंग प्रॉक्सी साइन-इनमध्ये व्यत्यय आणत आहे, Claude Code तुटलेल्या कनेक्शनला ऑथेंटिकेशन अयशस्वी झाल्याचे समजते, awsAuthRefresh कमांड पुन्हा चालवते आणि हे सतत घडत राहते. तुमच्या सेटिंग फाईलमधून awsAuthRefresh काढून टाका आणि Claude Code सुरू करण्यापूर्वी aws sso login मॅन्युअली चालवा.
राउटिंग निवडणे
जेव्हा तुम्हाला लाँचच्या दिवशी नवीन मॉडेल्स आणि संपूर्ण फिचर सेट हवा असेल, तेव्हा Anthropic direct निवडा. जेव्हा तुम्हाला सीट खरेदी न करता प्रति-टोकन बिलिंग हवे असेल, तेव्हा API key निवडा. जेव्हा तुमची गरज अशी असते की इन्फरन्स (inference) तुमच्या आधीच नियंत्रित असलेल्या क्लाउड अकाउंटमध्येच व्हावा, तेव्हा Bedrock किंवा Vertex निवडा; यासाठी तुम्हाला संथ मॉडेल पाइपलाइन आणि मर्यादित फिचर लिस्ट स्वीकारणे आवश्यक आहे. Amazon Bedrock आणि Google Vertex AI साठी Anthropic ची स्वतःची सेटअप पेजेस, तसेच AWS ची models by region ची यादी बुकमार्क करून ठेवणे फायदेशीर आहे.
या तिन्ही पर्यायांपैकी कशाचीही निवड केली तरी एजंट प्रत्यक्ष कुठे कार्यान्वित होतो, यात बदल होत नाही. Claude Code ही एक स्थानिक प्रक्रिया (local process) आहे, जी तुमच्या फाइल्स वाचते आणि तुमचे कमांड्स रन करते, मग ते कोणत्याही एंडपॉइंटद्वारे का प्रतिसाद देत असेना. म्हणूनच ज्या टीम्सना हा एजंट लॅपटॉपव्यतिरिक्त इतर कुठे चालवायचा असतो, त्या coding agent ला VPS वर ठेवतात आणि तिथेच हे व्हेरिएबल्स एक्सपोर्ट करतात.
FAQ
माझे Claude सबस्क्रिप्शन Bedrock किंवा Vertex वरील Claude Code साठी पैसे भरते का?
नाही. Pro, Max, Team किंवा Enterprise सीट आणि थर्ड-पार्टी एंडपॉइंट हे स्वतंत्र खरेदीचे प्रकार आहेत आणि एक दुसऱ्याची भरपाई करत नाही. CLAUDE_CODE_USE_BEDROCK=1 किंवा CLAUDE_CODE_USE_VERTEX=1 सेट केलेले असताना, प्रत्येक टोकनचे शुल्क AWS किंवा Google Cloud द्वारे त्यांच्या दराप्रमाणे आकारले जाते आणि ते त्या क्लाउड बिलमध्ये येते, तर सीटचे मासिक शुल्क ते ज्या सेवा कव्हर करते त्यासाठी सुरूच राहते. खर्चाचा मागोवा घेण्यासाठी AWS Cost Explorer किंवा Google Cloud Billing वापरावे लागते, कारण Anthropic डॅशबोर्ड या दोन्ही प्रोव्हायडरवर उपलब्ध नाही.
Amazon Bedrock वर Claude Code माझ्या विनंत्या कोणत्या रिजनमध्ये पाठवते?
ज्या रिजनमध्ये ते रिझॉल्व्ह झाले आहे, जे तुम्हाला /status मध्ये दिसेल. Claude Code प्रथम AWS_REGION तपासते, त्यानंतर AWS_DEFAULT_REGION, त्यानंतर तुमच्या सक्रिय AWS प्रोफाईलवरील region तपासते आणि यापैकी काहीही सेट नसल्यास us-east-1 वर परत येते. त्याचे इन-बिल्ट डीफॉल्ट मॉडेल्स त्यानंतर क्रॉस-रिजन इन्फरन्स प्रोफाईल्सवर रिझॉल्व्ह होतात ज्यांचा प्रीफिक्स त्या रिजननुसार असतो, जसे की us. किंवा eu., आणि क्रॉस-रिजन प्रोफाईल एकाच भौगोलिक क्षेत्रातील दुसऱ्या रिजनमधून विनंती पूर्ण करू शकते. जेव्हा एखादे विशिष्ट रिजन अनिवार्य असते, तेव्हा तुमच्या नियंत्रणाखालील ॲप्लिकेशन इन्फरन्स प्रोफाईल वापरा आणि ANTHROPIC_MODEL वर त्याचा ARN सेट करा.
माझ्या Bedrock किंवा Vertex अकाउंटमध्ये नवीन Claude मॉडेल का दिसत नाही?
कारण प्रत्येक क्लाउड प्रोव्हायडर स्वतःच्या वेळापत्रकानुसार मॉडेल्स उपलब्ध करून देतो आणि त्याव्यतिरिक्त तुमच्या अकाउंटला त्यासाठी ॲक्सेस मिळणे आवश्यक असते. Vertex वर तुम्हाला Model Garden मध्ये ॲक्सेससाठी विनंती करावी लागते आणि मंजुरी मिळण्यासाठी 24 ते 48 तास लागू शकतात. तोपर्यंत, sonnet आणि opus सारखे अलायसेस त्या प्रोव्हायडरसाठी Claude Code च्या डीफॉल्ट मॉडेलवर रिझॉल्व्ह होतात. जेव्हा ते डीफॉल्ट मॉडेल तुमच्या अकाउंटमध्ये उपलब्ध नसते, तेव्हा Claude Code त्या सेशनसाठी जुन्या किंवा खालच्या श्रेणीतील मॉडेलवर परत येते आणि एक सूचना दाखवते. ANTHROPIC_DEFAULT_SONNET_MODEL आणि त्याच्याशी संबंधित मॉडेल्सना अशा ID वर पिन करा जे तुम्ही इनेबल केल्याची खात्री केली आहे.
Amazon Bedrock वरील Claude Code मध्ये वेब सर्च उपलब्ध आहे का?
नाही. WebSearch टूल Bedrock वर उपलब्ध नाही, त्यामुळे Claude तिथे राउट केलेल्या सेशनमधून सर्च करू शकत नाही. तुम्ही URL दिल्यास ते WebFetch द्वारे विशिष्ट पेज वाचू शकते. Google Vertex AI वर वेब सर्च काम करते, Claude 4 जनरेशन मॉडेल्स आणि त्यानंतरच्या मॉडेल्ससाठी, ही काही मोजक्या क्षमतांपैकी एक आहे जी Vertex च्या बाजूने जाते.
Bedrock किंवा Vertex वर Claude Code चालवण्यासाठी मला Anthropic अकाउंटची गरज आहे का?
नाही. ऑथेंटिकेशनसाठी तुमचे AWS किंवा Google Cloud क्रेडेंशियल वापरले जाते, म्हणूनच /logout दोन्ही प्रोव्हायडरवर उपलब्ध नाही. तुम्ही कोणताही प्रोव्हायडर वापरला तरी Anthropic शी एक कनेक्शन कायम राहते: URL फेच करण्यापूर्वी, WebFetch टूल होस्टनेम, आणि फक्त होस्टनेम, api.anthropic.com कडे पाठवते जेणेकरून ते सेफ्टी ब्लॉकलिस्टच्या विरुद्ध तपासले जाऊ शकेल. ते बंद करण्यासाठी तुमच्या सेटिंग्ज फाईलमध्ये skipWebFetchPreflight सेट करा आणि जर तुम्हाला Claude कोणत्या डोमेनपर्यंत पोहोचू शकेल हे मर्यादित ठेवायचे असेल, तर त्यासोबत WebFetch परवानगी नियम वापरा.