SSD Nodes Learn 🎉 VPS od $5.50/mies.
Przewodniki Matt ConnorAutor: Matt Connor

Claude Code: konfiguracja Amazon Bedrock i Vertex AI

Dowiedz się, jak uruchomić Claude Code przez Amazon Bedrock lub Google Vertex AI. Sprawdź wymagane zmienne środowiskowe, sposób rozliczania kosztów oraz różnice w dostępnych modelach.

Co zmienia się, gdy Claude Code działa na własnym koncie w chmurze

Claude Code można uruchomić w środowisku Amazon Bedrock lub Google Vertex AI. Zmiana konfiguracji wymaga jedynie ustawienia dwóch lub trzech zmiennych środowiskowych oraz wykorzystania poświadczeń chmurowych, którymi zespół już dysponuje. Wszystkie lokalne elementy działają w ten sam sposób: CLI, subagenty, hooki, umiejętności, serwery MCP oraz pliki CLAUDE.md. Zmienia się jedynie miejsce wywołania modelu, co wiąże się z czterema aspektami: siecią, przez którą przechodzi żądanie, kontem obciążanym kosztami, dostępnymi modelami Claude oraz funkcjami dostępnymi po stronie serwera.

Pytanie rzadko dotyczy tego, czy to rozwiązanie działa. Ono działa. Pytanie brzmi, który z tych czterech aspektów jest dla użytkownika najważniejszy.

Trzy ścieżki routingu i związane z nimi koszty

Bezpośrednie połączenie z Anthropic w ramach subskrypcji. Logujesz się na konto claude.ai w planie Pro, Max, Team lub Enterprise. Żądania trafiają do API Anthropic. Płacisz za stanowisko, a wykorzystanie jest ograniczone limitami planu, a nie rozliczane za token. Jest to jedyna ścieżka routingu, która obsługuje interfejsy zbudowane w oparciu o konto, takie jak Claude Code w przeglądarce, aplikacja mobilna, wersja Desktop oraz Remote Control. W przypadku zespołów, plan Claude Enterprise dodaje do tego logowanie jednokrotne (SSO) oraz zarządzane ustawienia polityk.

Bezpośrednie połączenie z Anthropic przy użyciu klucza API. Tworzysz klucz w Anthropic Console i płacisz za każdy token. Infrastruktura i regiony są identyczne jak w przypadku subskrypcji, nie ma opłat za stanowisko, a wykorzystanie widoczne jest w panelu Anthropic. To, która z tych dwóch opcji jest tańsza, zależy od liczby godzin dziennie, w których agent faktycznie pracuje. Jest to główny temat porównania kosztów API względem subskrypcji oraz rzeczywistych kosztów Claude Code.

Punkt końcowy strony trzeciej w Bedrock lub Vertex. Model jest obsługiwany przez Twoje własne konto AWS lub Google Cloud. Anthropic nie znajduje się na ścieżce żądania w momencie wnioskowania (inference). Tokeny są doliczane do faktury, którą już otrzymujesz, zgodnie z politykami IAM (zarządzanie tożsamością i dostępem) oraz logami audytowymi, które już prowadzisz. Istnieją dwie dodatkowe opcje stron trzecich: Microsoft Foundry oraz Claude Platform w AWS. Działają one w ten sam sposób: jedna zmienna środowiskowa wskazuje dostawcę, a płatność następuje z poziomu konta chmurowego.

Uwaga dotycząca nazewnictwa, stan na sierpień 2026: Google zmieniło nazwę Vertex AI na Google Cloud's Agent Platform. Dokumentacja Anthropic używa nowej nazwy, monit logowania Claude Code nadal wyświetla Google Vertex AI, a zmienne środowiskowe nadal używają VERTEX.

Rezydencja danych to rzeczywisty powód, dla którego zespoły podejmują takie działania

W usłudze Bedrock żądanie trafia do punktu końcowego Bedrock w wybranym regionie AWS, wewnątrz Twojego własnego konta. Dane w spoczynku są szyfrowane algorytmem AES-256 przy użyciu kluczy zarządzanych przez AWS, a użytkownik może dostarczyć własny klucz za pośrednictwem AWS KMS (key management service). W usłudze Vertex odpowiednikiem jest szyfrowanie zarządzane przez Google, z dostępną opcją CMEK (customer-managed encryption keys). Dostęp jest regulowany przez role IAM, z których już korzystasz, a wywołania pojawiają się w CloudTrail lub Cloud Audit Logs tak samo, jak każde inne wywołanie API. Dla zespołu podlegającego regulacjom jest to kluczowy argument i jest on w pełni uzasadniony.

Dwa szczegóły sprawiają, że sytuacja nie jest tak jednoznaczna, jak sugerują materiały marketingowe.

Profil wnioskowania międzyregionalnego (cross-region inference profile) nie ogranicza się do jednego regionu. W usłudze Bedrock narzędzie Claude Code przypisuje wbudowane modele domyślne do identyfikatorów profili wnioskowania międzyregionalnego, a preferowany prefiks pochodzi z regionu, w którym nastąpiło rozpoznanie: us. w regionie us-*, eu. w regionie eu-*, apac. w regionie ap-* oraz us-gov. w GovCloud. Profil międzyregionalny może obsłużyć żądanie z innego regionu w obrębie tej samej geografii, więc gwarancja dotyczy obszaru geograficznego, a nie konkretnego miasta. Jeśli wymogi narzucają konkretny region, należy skierować ruch przez profil wnioskowania aplikacji, nad którym masz kontrolę, i ustawić ANTHROPIC_MODEL na jego ARN.

Część ruchu nadal dociera do Anthropic, ale nie zawiera on Twojego kodu. Telemetria, raportowanie błędów oraz polecenie /feedback są domyślnie wyłączone zarówno w Bedrock, jak i Vertex, a /feedback zapisuje archiwum w lokalizacji ~/.claude/feedback-bundles/ na Twojej maszynie, zamiast przesyłać cokolwiek na zewnątrz. Istnieją dwa wyjątki występujące u każdego dostawcy. Przed pobraniem adresu URL narzędzie WebFetch wysyła nazwę hosta – i tylko nazwę hosta – do api.anthropic.com w celu sprawdzenia listy blokad bezpieczeństwa. Nadal pojawiają się również ankiety dotyczące jakości sesji. Pierwszą funkcję można wyłączyć za pomocą skipWebFetchPreflight w pliku ustawień, a drugą za pomocą CLAUDE_CODE_DISABLE_FEEDBACK_SURVEY=1, lub wyłączyć cały nieistotny ruch jednocześnie za pomocą CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC.

W kwestii trenowania: zgodnie z warunkami komercyjnymi firma Anthropic nie trenuje modeli na kodzie ani promptach przesyłanych przez Claude Code, a korzystanie z platform zewnętrznych ma charakter komercyjny. Program Development Partner Program, czyli opcja dobrowolna pozwalająca na trenowanie, w ogóle nie jest oferowana użytkownikom Bedrock ani Vertex. Brak retencji danych w tych punktach końcowych zależy od Twojej umowy z AWS lub Google.

Wskazanie Amazon Bedrock dla Claude Code

Dwie czynności muszą zostać wykonane raz dla każdego konta AWS, zanim konfiguracja klienta zacznie mieć znaczenie. Należy otworzyć konsolę Amazon Bedrock, wybrać model Anthropic z katalogu modeli i przesłać formularz dotyczący przypadku użycia: dostęp jest przyznawany natychmiast po przesłaniu. Następnie należy dołączyć politykę IAM, która zezwala na wywołania wykonywane przez Claude Code.

  • bedrock:InvokeModel
  • bedrock:InvokeModelWithResponseStream
  • bedrock:ListInferenceProfiles
  • bedrock:GetInferenceProfile

ListInferenceProfiles pozwala Claude Code sprawdzić przy starcie, które modele mogą być faktycznie wywoływane przez konto. GetInferenceProfile umożliwia rozwiązanie ARN profilu wnioskowania aplikacji (inference profile) na bazowy model podstawowy, dzięki czemu narzędzie może wybrać właściwy format żądania. Bez tego żądania nadal kończą się powodzeniem, ponieważ Claude Code ponawia próbę raz z użyciem drugiego formatu. Objawem jest dodatkowa runda komunikacji dla każdego nowego modelu, a nie błąd.

Najszybszą ścieżką konfiguracji klienta jest kreator. Należy uruchomić claude, wybrać 3rd-party platform, a następnie Amazon Bedrock, lub wpisać /setup-bedrock w sesji, w której użytkownik jest już zalogowany. Narzędzie odczytuje profile z katalogu ~/.aws, weryfikuje, które modele można wywoływać, i zapisuje wynik w bloku env pliku ~/.claude/settings.json, dzięki czemu działanie nie zależy od profilu powłoki.

W przypadku wdrożenia skryptowego należy samodzielnie ustawić zmienne.

export CLAUDE_CODE_USE_BEDROCK=1
export AWS_REGION=us-east-1

Poświadczenia pochodzą ze standardowego łańcucha poświadczeń AWS SDK, więc wszystko, co działa dla CLI aws, zadziała również tutaj: aws configure, profil SSO, przyjęta rola (assumed role) lub klucz API Bedrock.

aws sso login --profile=your-profile-name
export AWS_PROFILE=your-profile-name
export AWS_BEARER_TOKEN_BEDROCK=your-bedrock-api-key

Token bearer jest najprostszą opcją, z którą należy obchodzić się ostrożnie, ponieważ jest to długożyjący sekret przechowywany w zmiennej środowiskowej. Na współdzielonym serwerze budowania (build box) należy preferować rolę, która wygasa. To samo rozumowanie dotyczy każdego innego poświadczenia, które może odczytać agent, co jest przedmiotem ochrony sekretów przed dostępem agenta AI.

Pułapka regionu. Claude Code rozwiązuje region w następującej kolejności: AWS_REGION, następnie AWS_DEFAULT_REGION, potem region w aktywnym profilu AWS, a na końcu us-east-1. Ostatni krok jest wartością domyślną, a nie błędem, więc zespół, który nie ustawił regionu nigdzie i założył routing europejski, wyśle żądania do regionu w USA bez wyświetlenia ostrzeżenia. Należy uruchomić /status wewnątrz Claude Code, aby zobaczyć rozwiązany region oraz źródło, z którego pochodzi. Aby potwierdzić, co konto może wywołać w danym regionie, należy uruchomić aws bedrock list-inference-profiles --region your-region.

Uruchamianie Claude Code w Google Vertex AI

Włącz API i pobierz dane uwierzytelniające.

gcloud config set project YOUR-PROJECT-ID
gcloud services enable aiplatform.googleapis.com
gcloud auth application-default login

Poproś o dostęp do wybranych modeli Claude w Model Garden. Zatwierdzenie nie jest natychmiastowe, dlatego należy przewidzieć od 24 do 48 godzin. Przyznaj rolę roles/aiplatform.user, która zawiera uprawnienie aiplatform.endpoints.predict, wykorzystywane zarówno do wywoływania modeli, jak i zliczania tokenów.

Następnie wybierz dostawcę.

export CLAUDE_CODE_USE_VERTEX=1
export CLOUD_ML_REGION=global
export ANTHROPIC_VERTEX_PROJECT_ID=YOUR-PROJECT-ID

CLOUD_ML_REGION przyjmuje global, czyli lokalizację wieloregionalną, taką jak eu lub us, albo pojedynczy region. Globalny punkt końcowy zapewnia najlepszą dostępność i najmniejszą kontrolę nad tym, gdzie żądanie jest obsługiwane, więc wymóg rezydencji danych zazwyczaj wymusza wskazanie konkretnej lokalizacji. Dostępność modeli różni się w zależności od wybranego wariantu. Jeśli potrzebny model nie jest dostępny w globalnym punkcie końcowym, przypisz go do konkretnej lokalizacji za pomocą zmiennej VERTEX_REGION_CLAUDE_*, pozostawiając resztę konfiguracji globalną. Sprawdź aktualną stronę lokalizacji Vertex AI, zamiast polegać na nieaktualnych listach.

Pułapka projektu. ANTHROPIC_VERTEX_PROJECT_ID jest źródłem identyfikatora projektu o najniższym priorytecie. GCLOUD_PROJECT, GOOGLE_CLOUD_PROJECT oraz plik poświadczeń wskazany przez GOOGLE_APPLICATION_CREDENTIALS mają nad nim pierwszeństwo. Na maszynie, na której jedna z tych wartości jest już wyeksportowana, opłaty zostaną naliczone dla innego projektu, a sesja nie wyświetli żadnego komunikatu w tej sprawie.

Zweryfikuj konfigurację po każdej zmianie dostawcy. Uruchom /status: wiersz API provider powinien zawierać Google Vertex AI, a wiersze GCP project, Default region oraz Model pokażą, co faktycznie zostało rozpoznane przez Claude Code. Jeśli wiersz dostawcy jest nieobecny, zmienne nie docierają do procesu, ponieważ zostały wyeksportowane w innej powłoce niż ta, która uruchomiła claude. Przenieś je do bloku env w pliku ustawień; jest to również sposób na uniknięcie przekazywania wartości takiej jak AWS_PROFILE do każdego innego uruchamianego procesu.

Dostępne modele i czas ich udostępnienia

Aliasy takie jak sonnet oraz opus nie oznaczają najnowszych wersji. W przypadku punktów końcowych innych firm rozwiązują się one do domyślnego modelu wbudowanego w Claude Code dla danego dostawcy, co może wiązać się z opóźnieniem względem bieżącego wydania lub brakiem aktywacji w koncie użytkownika. Gdy model domyślny jest niedostępny, Claude Code przełącza się na wcześniejszy lub niższy model w ramach danej sesji i wyświetla stosowny komunikat. Mechanizm ten nie zapisuje wyboru, więc każda kolejna sesja podejmuje próbę ponownie, wyświetlając komunikat za każdym razem.

W przypadku wdrożeń zespołowych należy przypiąć konkretne wersje.

# Copy the exact IDs from your provider's own model catalog.
export ANTHROPIC_DEFAULT_OPUS_MODEL='<provider model id>'
export ANTHROPIC_DEFAULT_SONNET_MODEL='<provider model id>'
export ANTHROPIC_DEFAULT_HAIKU_MODEL='<provider model id>'

Identyfikatory należy pobierać z przeglądu modeli oraz katalogu dostawcy, ponieważ format różni się w zależności od platformy: Bedrock wymaga identyfikatora profilu wnioskowania (inference profile ID) lub ARN, natomiast Vertex oczekuje zwykłej nazwy modelu. Nie należy kopiować ich z artykułów, w tym z niniejszego. Przypięcie modelu pozwala również kontrolować koszty, ponieważ domyślnym modelem głównym jest model klasy Opus, który jest droższy za token niż Sonnet. Wdrożenie bez przypiętego modelu jest rozliczane według wyższej stawki. Aby ustawić konkretny model jako domyślny dla sesji, należy przypisać jego pełny identyfikator do ANTHROPIC_MODEL.

Czas udostępnienia modelu jest najbardziej zauważalną różnicą w tym zestawieniu. W przypadku bezpośredniego API Anthropic model działa w dniu premiery. W usługach Bedrock i Vertex model staje się dostępny dopiero wtedy, gdy dostawca chmury udostępni go w danym regionie, a użytkownik otrzyma odpowiednie uprawnienia – co w najlepszym przypadku trwa kilka dni, a bywa, że znacznie dłużej. Jeśli określone zadania wymagają najnowszego modelu, należy zachować ścieżkę routingu, która zapewnia do niego dostęp. Jest to praktyczne uzasadnienie dla kierowania różnych modeli do różnych zadań.

Z czego rezygnujesz korzystając z Bedrock i Vertex

Wszystkie funkcje lokalne działają u każdego dostawcy: subagenty, hooki, slash commands, umiejętności, wtyczki, punkty kontrolne (checkpoints), piaskownica (sandboxing), zarządzany plik ustawień oraz metryki OpenTelemetry. Braki dotyczą wyłącznie strony serwerowej.

Niedostępne w obu punktach końcowych: tryb fast, Advisor, Channels, komunikacja między sesjami, pulpit nawigacyjny analityki oraz ustawienia zarządzane przez serwer. Niedostępne jest również wszystko, co wymaga konta claude.ai, co obejmuje Claude Code w przeglądarce, aplikację mobilną, wersję Desktop, Remote Control, procedury (routines) oraz artefakty.

Tylko w Bedrock: narzędzie WebSearch nie istnieje w tym środowisku, więc Claude nie może przeprowadzić wyszukiwania z sesji skierowanej do Bedrock. Nadal może jednak odczytać stronę za pomocą WebFetch, jeśli podasz mu adres URL. W Vertex wyszukiwanie internetowe działa dla modeli generatywnych Claude 4 i nowszych.

Ograniczenia w obu przypadkach: tryb auto działa tylko na ograniczonej liczbie nowszych modeli, a /loop wymaga jawnego określenia interwału, ponieważ nie może wybrać go samodzielnie. Przed zadeklarowaniem dostępności funkcji swojemu zespołowi sprawdź stronę dostępności funkcji firmy Anthropic, ponieważ lista ta ulega zmianom.

Kogo obciąża rachunek

Subskrypcja oraz punkt końcowy (endpoint) zewnętrznego dostawcy to odrębne zakupy. Żaden z nich nie zastępuje drugiego.

Warto to wyraźnie zaznaczyć, ponieważ błąd ten nie generuje żadnych powiadomień. Ustawienie CLAUDE_CODE_USE_BEDROCK=1 na maszynie, na której użytkownik jest jednocześnie zalogowany za pomocą licencji Max, powoduje, że każdy token jest rozliczany przez AWS według stawek Bedrock. Licencja nadal jest opłacana miesięcznie i nie pokrywa żadnej części tego ruchu. Nie istnieje również wspólny widok kosztów: wydatki przenoszą się do AWS Cost Explorer lub Google Cloud Billing, a panel analityczny Anthropic nie jest dostępny u żadnego z tych dostawców. Polecenie /logout również znika, ponieważ nie ma sesji Anthropic do zakończenia. Poświadczeniem jest w tym przypadku poświadczenie chmurowe.

Stawki znajdują się na stronach poszczególnych dostawców i ulegają zmianom, dlatego należy sprawdzać cennik Amazon Bedrock lub cennik Vertex AI, zamiast polegać na wartościach podanych w artykułach. Jedna kwestia strukturalna pozostaje niezmienna: w przypadku tych punktów końcowych płaci się za wnioskowanie (inference) według liczby tokenów, więc agent pozostawiony włączony przez cały dzień generuje koszty zgodnie z zużyciem, bez limitu planu, który mógłby je zatrzymać.

Limity szybkości i przydziały działają inaczej w zależności od metody routingu

W przypadku subskrypcji limity są przypisane do konta, resetują się zgodnie z harmonogramem, a ich przekroczenie wymaga odczekania. To zachowanie opisano w sposób działania limitów użycia.

W przypadku klucza Anthropic API limity są przypisane do organizacji, wyrażane jako liczba żądań i tokenów na minutę oraz rosną wraz z poziomem wykorzystania.

W usługach Bedrock i Vertex limity stanowią przydziały chmurowe, przypisane do konta lub projektu, modelu oraz regionu, bez związku z jakimkolwiek planem Anthropic. Błąd 429 oznacza, że konto osiągnęło przydział dla danego modelu w tym regionie, dlatego rozwiązanie znajduje się w konsoli dostawcy: należy wnioskować o zwiększenie przydziału lub przenieść się do lokalizacji z dostępnymi zasobami. Bedrock rozlicza przydział zgodnie z zasadą token burndown, a nie stałą liczbą żądań, natomiast zarezerwowaną przepustowość kupuje się jako provisioned throughput. W Vertex błędy 429 często oznaczają, że punkt końcowy w jednym regionie nie obsługuje jednocześnie modelu głównego oraz małego, szybkiego modelu, dlatego CLOUD_ML_REGION=global jest wskazanym punktem wyjścia. Strona quotas firmy Google zawiera informacje o sposobie wnioskowania o zwiększenie limitów.

Tryby awarii i odpowiadające im komunikaty

Could not load the default credentials w Vertex. Brak danych uwierzytelniających Application Default Credentials lub utrata ich ważności. Uruchom gcloud auth application-default login lub wskaż GOOGLE_APPLICATION_CREDENTIALS plik klucza konta serwisowego.

Błąd 404 z nazwą modelu w Vertex. Model nie został włączony w Model Garden dla danego projektu lub nie jest dostępny w wybranej lokalizacji. Niektóre modele są udostępniane wyłącznie przez globalny punkt końcowy lub lokalizacje wieloregionowe, takie jak eu, a nie w konkretnym regionie.

on-demand throughput isn't supported w Bedrock. Przekazano identyfikator podstawowego modelu (foundation model ID) dla modelu, który jest dostępny wyłącznie przez profil wnioskowania (inference profile). Należy użyć identyfikatora profilu wnioskowania.

AWS default-chain credential resolve timed out. Jeden z etapów łańcucha uwierzytelniania AWS uległ zawieszeniu; najczęściej jest to pomocnik credential_process oczekujący na dane wejściowe, których nie może otrzymać. Każda próba rozwiązania łańcucha kończy się przekroczeniem czasu po 60 sekundach. Jeśli łańcuch faktycznie wymaga więcej czasu, na przykład w przypadku przepływu SSO w przeglądarce z MFA (uwierzytelnianiem wieloskładnikowym) za wrapperem, należy zwiększyć limit w milisekundach za pomocą CLAUDE_CODE_AWS_CHAIN_RESOLVE_TIMEOUT_MS.

Błąd podczas uruchamiania Bedrock streaming response has content-type. Element pośredniczący między Claude Code a Bedrock dokonuje modyfikacji strumienia. Bedrock przesyła dane w binarnym formacie event-stream z typem zawartości application/vnd.amazon.eventstream, więc bramka, która reemituje je jako server-sent events, zwraca treść, której Claude Code nie potrafi zdekodować. Należy skonfigurować bramkę tak, aby przekazywała treść odpowiedzi oraz nagłówek Content-Type bez zmian.

Pętla otwierania kart przeglądarki podczas AWS SSO. Korporacyjna sieć VPN lub proxy dokonujące inspekcji TLS przerywa proces logowania. Claude Code interpretuje zerwane połączenie jako błąd uwierzytelnienia, ponownie wykonuje polecenie awsAuthRefresh i powtarza ten proces w nieskończoność. Należy usunąć awsAuthRefresh z pliku ustawień i uruchomić aws sso login ręcznie przed rozpoczęciem pracy z Claude Code.

Wybór metody routingu

Wybierz bezpośrednie połączenie z Anthropic, jeśli wymagasz dostępu do nowych modeli w dniu premiery oraz pełnego zestawu funkcji. Wybierz klucz API, jeśli preferujesz rozliczenia za tokeny bez konieczności wykupowania licencji stanowiskowych. Wybierz Bedrock lub Vertex, jeśli wymagane jest, aby wnioskowanie odbywało się wewnątrz konta chmurowego, którym już zarządzasz, akceptując w zamian wolniejszy cykl aktualizacji modeli oraz ograniczoną listę funkcji. Strony konfiguracyjne warte dodania do zakładek to oficjalne dokumentacje Anthropic dla Amazon Bedrock oraz Google Vertex AI, a także lista AWS zawierająca modele według regionów.

Żadna z tych trzech metod nie zmienia miejsca wykonywania agenta. Claude Code jest procesem lokalnym, który odczytuje pliki i uruchamia polecenia niezależnie od tego, który punkt końcowy odpowiada na zapytania. Dlatego zespoły, które chcą uruchamiać go poza laptopem, umieszczają agenta programistycznego na VPS i eksportują tam te same zmienne.

FAQ

Czy moja subskrypcja Claude obejmuje Claude Code w usługach Bedrock lub Vertex?

Nie. Subskrypcja Pro, Max, Team lub Enterprise oraz zewnętrzny punkt końcowy to oddzielne zakupy i żaden z nich nie pokrywa kosztów drugiego. Przy ustawionych zmiennych CLAUDE_CODE_USE_BEDROCK=1 lub CLAUDE_CODE_USE_VERTEX=1 każdy token jest rozliczany przez AWS lub Google Cloud według ich stawek i trafia na rachunek u danego dostawcy chmury, podczas gdy opłata za subskrypcję pozostaje stałym miesięcznym kosztem za dostęp do usług Anthropic. Śledzenie wydatków odbywa się w AWS Cost Explorer lub Google Cloud Billing, ponieważ pulpit nawigacyjny analityki Anthropic nie jest dostępny u żadnego z tych dostawców.

Do którego regionu Claude Code wysyła moje żądania w Amazon Bedrock?

Do regionu, który został rozpoznany, co pokaże polecenie /status. Claude Code sprawdza AWS_REGION, następnie AWS_DEFAULT_REGION, potem region w aktywnym profilu AWS, a w przypadku braku tych ustawień korzysta z us-east-1. Wbudowane modele domyślne są następnie kierowane do profili wnioskowania międzyregionalnego (cross-region inference), których prefiks odpowiada danemu regionowi, na przykład us. lub eu.. Profil międzyregionalny może obsłużyć żądanie z innego regionu w obrębie tej samej lokalizacji geograficznej. Jeśli wymagany jest konkretny region, należy użyć własnego profilu wnioskowania aplikacji i ustawić ANTHROPIC_MODEL na jego ARN.

Dlaczego najnowszy model Claude nie jest dostępny na moim koncie Bedrock lub Vertex?

Ponieważ każdy dostawca chmury udostępnia modele według własnego harmonogramu, a dodatkowo wymagane jest przyznanie uprawnień do modelu na poziomie konta. W Vertex dostęp należy zgłosić w Model Garden, a zatwierdzenie może potrwać od 24 do 48 godzin. Do tego czasu aliasy takie jak sonnet i opus wskazują na domyślny model Claude Code dla danego dostawcy. Jeśli domyślny model nie jest dostępny na koncie, Claude Code automatycznie przełącza się na wcześniejszy lub niższy model dla danej sesji i wyświetla powiadomienie. Przypisz ANTHROPIC_DEFAULT_SONNET_MODEL oraz powiązane z nim modele do identyfikatorów, których dostępność została potwierdzona.

Czy wyszukiwanie w sieci jest dostępne w Claude Code w Amazon Bedrock?

Nie. Narzędzie WebSearch nie jest dostępne w Bedrock, więc Claude nie może przeprowadzić wyszukiwania w sesji skierowanej do tej usługi. Nadal może jednak odczytać określoną stronę za pomocą WebFetch, jeśli podasz adres URL. W Google Vertex AI wyszukiwanie w sieci działa dla modeli generacji Claude 4 i nowszych, co stanowi jedną z niewielu różnic w funkcjonalności na korzyść Vertex.

Czy potrzebuję konta Anthropic, aby uruchomić Claude Code w Bedrock lub Vertex?

Nie. Uwierzytelnianie odbywa się za pomocą poświadczeń AWS lub Google Cloud, dlatego /logout jest niedostępne u obu tych dostawców. Jedno połączenie z Anthropic pozostaje niezależne od używanego dostawcy: przed pobraniem adresu URL narzędzie WebFetch wysyła nazwę hosta (i tylko nazwę hosta) do api.anthropic.com w celu sprawdzenia jej na liście blokowanych domen ze względów bezpieczeństwa. Ustaw skipWebFetchPreflight w pliku konfiguracyjnym, aby wyłączyć to sprawdzanie, i połącz to z regułami uprawnień WebFetch, jeśli nadal chcesz ograniczyć domeny, do których Claude może uzyskiwać dostęp.