Przejdź do głównej zawartości

Gdzie działa model: bramki, chmury, rezydencja danych i zero retencji

Hosting modelu dla agentów kodujących to wybór miejsca inferencji: własne API dostawcy; trasa chmurowa, taka jak Amazon Bedrock, Agent Platform w Google Cloud, dawniej Vertex AI, Microsoft Foundry lub Claude Platform on AWS; bramka LLM przed jedną z nich; albo samodzielnie hostowane modele open-weight. Od trasy zależą rezydencja danych, retencja, rozliczenia i to, które funkcje agenta działają.

Dział prawny właśnie podpisał umowę z klientem, według której kod źródłowy jest przetwarzany w UE i nie jest przechowywany przez podprocesorów. Twoje zespoły używają Claude Code na planie Team, Codeksa przez ChatGPT i Cursora. Dział zakupów pyta o każde narzędzie: „dokąd trafia nasz kod i na jak długo?”, i nikt nie umie odpowiedzieć z dowodami w ręku.

Ta strona jest dla CTO, który odpowiada za tę odpowiedź. Trasa decyduje też o tym, kto wystawia fakturę, więc czytaj ją razem z zarządzaniem kosztami AI. Konfiguracja per narzędzie jest opisana w konfiguracji bramki LLM dla Claude Code, a wersje i ceny modeli w przeglądzie modeli.

Co rozstrzygasz, wybierając miejsce działania modelu

Dział zatytułowany „Co rozstrzygasz, wybierając miejsce działania modelu”
  • Pięć tras, kto obsługuje inferencję na każdej z nich i jakie funkcje każda ci odbiera.
  • Kontrolę regionu na każdej trasie, w tym miejsca, w których trasowanie „global” wyprowadza ruch z zakładanego regionu.
  • Które modele działają przy zero retencji danych (ZDR) i co ZDR wyłącza lub czego nigdy nie obejmuje.
  • Konfigurację zarządzaną dla każdego narzędzia, rejestr decyzji i kwartalny dowód trasy.

Fakty sprawdzono 26 września 2026 r. w dokumentacji Anthropic, w Claude Code 2.1.283 i w Codeksie 0.157.1. Dokumentacja AWS i Google Cloud oraz openai.com były tego dnia niedostępne, więc ich warunki retencji występują tu jako pytania, a nie fakty.

W praktyce każde wdrożenie mieści się w pięciu trasach. Pierwsze cztery to miejsca, w których działa inferencja; bramka to warstwa, którą stawiasz przed dowolną z nich.

TrasaKto obsługuje inferencjęRozliczenieCo zyskujeszCo tracisz
Bezpośrednio u dostawcy: Claude Team lub Enterprise, API Anthropic, workspace ChatGPT dla Codeksa, backend CursoraDostawcaStanowiska lub tokeny u dostawcyKażdą funkcję w dniu premiery, w tym sesje w chmurze i zarządzany code reviewWybór rezydencji należy do dostawcy (Anthropic: tylko us lub global)
Claude Platform on AWSAnthropic, z uwierzytelnianiem AWSAWS MarketplaceModele i funkcje Claude API w tym samym rytmie, płatne przez AWSOsobną organizację Anthropic powiązaną z kontem AWS; poświadczenia się nie przenoszą
Chmury partnerskie: Amazon Bedrock, Agent Platform w Google Cloud, Microsoft FoundrySwoje trasy obsługują AWS i Google; Foundry obsługuje Anthropic, na Azure albo na własnej infrastrukturzeTwój rachunek chmurowyTwój IAM, logi audytowe (CloudTrail, Cloud Audit Logs, Azure Monitor) i wybór regionuSesje w chmurze, Routines, Remote Control, Ultrareview i zarządzany Code Review, które wymagają subskrypcji Claude
Bramka LLM (Claude apps gateway od Anthropic, LiteLLM, własna)Upstream, do którego bramka przekazuje ruchKonto upstreamu, za tokenyJedno miejsce na poświadczenia, atrybucję, budżety, audyt i zmianę dostawcyUsługę, którą aktualizujesz z każdym wydaniem agenta, oraz część funkcji
Własny hosting modeli open-weightTyTwój sprzętNic nie opuszcza twojej sieciJakość modelu, którą musisz udowodnić własnymi ewaluacjami; Anthropic nie wspiera Claude Code na modelach innych niż Claude przez żadną bramkę

Dwa wiersze zaskakują najczęściej. Wdrożenia Foundry „hosted on Azure” trzymają prompty i odpowiedzi w Azure; do Anthropic trafiają tylko metadane użycia i treści oznaczone przez systemy bezpieczeństwa. Z kolei poświadczenie bramki zastępuje subskrypcję claude.ai programisty, więc użycie jest rozliczane za tokeny na właściciela poświadczenia dostawcy. Zaplanuj na to budżet; Anthropic szacuje firmowe użycie Claude Code na około 13 USD na programistę za aktywny dzień i 150–250 USD na programistę miesięcznie (strona kosztów Claude Code, sprawdzone 26 września 2026 r.).

Ustawienia domyślne przedkładają dostępność nad geografię. Najpierw zapisz wymaganie (UE, USA albo brak), a potem wybierz trasę, która potrafi je wymusić, a nie tylko dopuszcza. Cursor nie ma własnej kontroli regionu; zobacz jego zakładkę w sekcji o konfiguracji.

Modele Claude: cztery trasy, cztery różne kontrole regionu

Dział zatytułowany „Modele Claude: cztery trasy, cztery różne kontrole regionu”
TrasaKontrola regionuCzy da się wymusić inferencję tylko w UE?Pułapka
API Anthropic i Claude Platform on AWSinference_geo per żądanie albo default_inference_geo i allowed_inference_geos per workspaceNie. Istnieją tylko "us" i "global", a workspace geo (przechowywanie danych) to wyłącznie "us""global" jest wartością domyślną: inferencja „may run in any available geography”
Amazon BedrockRegion plus prefiks profilu cross-region inference: Claude Code preferuje eu. w regionach eu-*, us. w us-*, apac. w ap-*, a global. wszędzie indziejTak, z profilami eu.Prefiks to preferencja, a nie gwarancja
Agent Platform w Google CloudCLOUD_ML_REGION: global, lokalizacja wieloregionowa taka jak eu albo region taki jak europe-west1Tak, z eu lub regionem w UEBłędnie sformatowana wartość jest traktowana jak brak ustawienia i spada na us-east5; dostępność modeli różni się między lokalizacjami
Microsoft FoundryTyp wdrożenia: Global Standard albo US Data Zone StandardBrak strefy danych UE dla ClaudeUS Data Zone obejmuje tylko wdrożenia hostowane na Azure

Na Bedrocku ANTHROPIC_BEDROCK_REGION_PREFIX (Claude Code 2.1.224 lub nowszy) to według dokumentacji „a preference, not a guarantee”: model bez profilu eu. przechodzi na dowolny pasujący profil, więc region wymuszaj przypiętymi identyfikatorami profili i IAM. Na Foundry Fable 5.1 jest dostępny wyłącznie w wariancie hostowanym przez Anthropic, więc nie skorzysta z US Data Zone.

Rezydencja kosztuje: inferencja tylko w USA (inference_geo: "us" albo US Data Zone na Foundry) kosztuje 1,1x stawki na modelach Claude 4.6 i nowszych, a regionalne endpointy na Bedrocku i Google Cloud mają 10% narzutu względem globalnych (strony cennika i rezydencji danych Anthropic, sprawdzone 26 września 2026 r.).

Modele OpenAI w Codeksie: rezydencja w USA to przełącznik zarządzany

Dział zatytułowany „Modele OpenAI w Codeksie: rezydencja w USA to przełącznik zarządzany”

W Codeksie 0.157.1 enforce_residency = "us" w /etc/codex/requirements.toml dołącza nagłówek rezydencji USA do każdego żądania do modelu; każda inna wartość, na przykład "eu", kończy start błędem unknown variant `eu`, expected `us` . Ten sam plik może przypiąć model_provider, więc trasa nie zależy od config.toml na każdym laptopie.

Codex 0.157.1 potrafi wymusić tylko rezydencję w USA. Materiały OpenAI wspominają o rezydencji danych w UE, więc zanim na niej oprzesz umowę, uzyskaj warunki dla UE od OpenAI na piśmie.

Których modeli możesz używać przy zero retencji danych?

Dział zatytułowany „Których modeli możesz używać przy zero retencji danych?”

Zero retencji danych oznacza, że dostawca nie przechowuje promptów i odpowiedzi po zwróceniu odpowiedzi, z wyjątkiem sytuacji wymaganych przez prawo lub walkę z nadużyciami. W Claude Code ZDR jest węższe, niż zakłada większość umów.

Kto może je dostać. Kwalifikujące się konta Claude for Enterprise. ZDR włącza zespół opiekunów klienta w Anthropic, osobno dla każdej organizacji, bez przełącznika dla administratora; nowa organizacja go nie dziedziczy. Obejmuje też klucze API organizacji komercyjnej objętej ZDR, a Claude Platform on AWS oferuje ZDR na żądanie. Strona o ZDR w Claude Code obejmuje wyłącznie bezpośrednią platformę Anthropic. Na Bedrocku i Google Cloud podmiotem przetwarzającym jest dostawca chmury; dla Foundry strona Anthropic o retencji w API wskazuje Anthropic, więc warunki Foundry dla Claude Code uzyskaj na piśmie.

Które modele. Wszystko, do czego ma dostęp twoja organizacja z ZDR, pozostaje dostępne, z wyjątkiem Covered Models, które domyślnie wymagają 30-dniowej retencji:

ModelPrzy ZDR (bezpośrednio u Anthropic)Jak mimo to z niego korzystać
Claude Opus 5.5 (domyślny w Claude Code od v2.1.280, kanał latest), Sonnet 5, Haiku 4.5 i starsze modele Opus i SonnetDostępne—
Claude Fable 5.1, Fable 5Tylko tam, gdzie zezwoli Anthropic; według Anthropic uprawnieni klienci mogą używać Fable 5.1 przy ZDR, dopóki nie pojawią się Enterprise Frontier SafeguardsWłącz 30-dniową retencję dla jednego workspace’u w Claude Console > Settings > Workspaces > Privacy controls; pozostałe workspace’y zachowują ZDR
Claude Mythos 5.1, Mythos 5Ta sama zasada; i tak dostępne tylko na zaproszenie—

Tam, gdzie Fable jest niedostępny, alias best wskazuje Opusa. Covered Model wywołany bez retencji zwraca „In order to access this model, your organization or workspace must have data retention enabled.”

Co ZDR wyłącza. Sesje w chmurze (także uruchamiane z aplikacji Desktop), Claude Tag, Artifacts, /feedback, /bug, /share, Remote Control, zarządzany Code Review i Ultrareview. Zaplanuj code review wokół lokalnego /code-review i agentów uruchamianych w CI, zanim podpiszesz umowę.

Czego ZDR nigdy nie obejmuje. Czatu na claude.ai, Cowork, metadanych analitycznych, zarządzania stanowiskami oraz każdego serwera MCP i integracji zewnętrznej, z której korzysta agent. Transkrypty sesji zostają też na każdym laptopie jako zwykły tekst w ~/.claude/projects/, domyślnie przez 30 dni (cleanupPeriodDays), a treści oznaczone jako naruszenie zasad użytkowania mogą być przechowywane do dwóch lat.

Warunków retencji Codeksa i Cursora nie dało się sprawdzić 26 września 2026 r. Zapytaj każdego dostawcę na piśmie, które modele lub funkcje wymagają retencji i czy agenci w chmurze podlegają tym samym warunkom.

Bramka to proxy między agentem a dostawcą modelu: programiści mają poświadczenie bramki, a bramka trzyma poświadczenie dostawcy, atrybucję, budżety, logi audytowe i zmianę dostawcy.

Claude apps gateway od Anthropic jest wbudowana w binarkę claude (claude gateway --config gateway.yaml, Claude Code 2.1.195 lub nowszy). Programiści logują się przez twojego dostawcę tożsamości OIDC, grupy IdP mapują się na listy dozwolonych modeli po stronie serwera i na polityki ustawień zarządzanych, a bramka eksportuje metryki OpenTelemetry i przełącza się awaryjnie między trasami chmurowymi i API Anthropic. Jej warstwa danych nie wysyła niczego do Anthropic, chyba że API Anthropic jest skonfigurowanym upstreamem. Udokumentowane ograniczenia:

  • Tylko SSO w przeglądarce, bez przepływu z tokenem usługowym, więc potoki CI uwierzytelniają się bezpośrednio u dostawcy.
  • Tylko OIDC, jeden wystawca na bramkę, serwery wyłącznie na Linuksie, brak panelu administracyjnego.
  • Brak wyszukiwania w sieci po stronie serwera, Remote Control i /import w sesjach przez bramkę.
  • Prompt caching działa tylko z TTL 5 minut, więc długie sesje częściej wczytują kontekst bez cache’u; po przełączeniu obserwuj koszt sesji.
  • Tylko adres w sieci prywatnej: /login odrzuca bramkę, której nazwa wskazuje (w DNS) na publiczny adres IP; publiczne pule używane wewnętrznie wpisz do gatewayInternalNetworks (Claude Code 2.1.268 lub nowszy).

Inne bramki działają, jeśli udostępniają obsługiwany format API i przekazują nagłówki oraz pola żądania wysyłane przez Claude Code; bramka nienadążająca za wydaniami Claude Code psuje funkcje, których pola usuwa. Traktuj bramkę jak element łańcucha dostaw: 24 marca 2026 r. wydania litellm 1.82.7 i 1.82.8 na PyPI okazały się złośliwym oprogramowaniem kradnącym poświadczenia i zostały usunięte (zgłoszenie BerriAI/litellm 24518). Przypinaj wersje i weryfikuj skróty. Porównanie produktów znajdziesz w przewodniku bramki i modele lokalne; odpowiednik po stronie narzędzi opisuje strona rejestry i bramki MCP.

Własny hosting to osobna decyzja. Codex uruchamia modele lokalne bezpośrednio (codex --oss --local-provider ollama lub lmstudio); Claude Code tego nie robi. Zanim model open-weight przejmie prawdziwą pracę, przeprowadź własne ewaluacje i sprawdź licencję wag; zobacz modele open-weight.

Dostarczaj trasę przez konfigurację zarządzaną, nigdy przez stronę w wiki. Te same pliki niosą resztę twojej polityki zarządzanej dla agentów.

Bedrock z inferencją w UE, w bloku env pliku ustawień zarządzanych:

{
"env": {
"CLAUDE_CODE_USE_BEDROCK": "1",
"AWS_REGION": "eu-central-1",
"ANTHROPIC_BEDROCK_REGION_PREFIX": "eu",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "eu.anthropic.claude-opus-5-5",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "eu.anthropic.claude-sonnet-5"
}
}

Prefiks wyraża tylko preferencję. Claude Code nie przepisuje przypiętych identyfikatorów profili inferencji, więc przypnij każdą dozwoloną rodzinę modeli do profilu eu., który istnieje na twoim koncie: blok przypina Opusa i Sonneta, a Haiku, jeśli go dopuszczasz, potrzebuje takiego samego wpisu ANTHROPIC_DEFAULT_HAIKU_MODEL. Ogranicz Resource w polityce IAM do ARN-ów tych profili, żeby wszystko inne kończyło się odmową.

Agent Platform w Google Cloud w lokalizacji wieloregionowej UE (eu):

{
"env": {
"CLAUDE_CODE_USE_VERTEX": "1",
"CLOUD_ML_REGION": "eu",
"ANTHROPIC_VERTEX_PROJECT_ID": "acme-ai-prod"
}
}

Własna bramka, z kluczem dla każdego programisty pobieranym z magazynu sekretów:

{
"env": {
"ANTHROPIC_BASE_URL": "https://llm-gateway.internal.example.com"
},
"apiKeyHelper": "/usr/local/bin/get-gateway-key"
}

Zarządzanego ANTHROPIC_BASE_URL programista nie nadpisze eksportem w powłoce. Nie łącz takiego poświadczenia bramki z forceLoginMethod ani forceLoginOrgUUID: każdy z tych kluczy blokuje ANTHROPIC_API_KEY, ANTHROPIC_AUTH_TOKEN i apiKeyHelper, i nikt nie uruchomi sesji. Wyjątkiem jest Claude apps gateway od Anthropic, wybierana przez forceLoginMethod: "gateway" i forceLoginGatewayUrl. Na trasach chmurowych przypnij wszystkie trzy zmienne ANTHROPIC_DEFAULT_*_MODEL, żeby nowy model domyślny pojawiał się wtedy, kiedy ty zdecydujesz. /status pokazuje dostawcę, region i bazowy URL, których sesja faktycznie używa. Pełna konfiguracja: konfiguracja bramki LLM i konfiguracja firmowego proxy.

Wypełnij po jednej kolumnie na narzędzie i daj do podpisu liderowi bezpieczeństwa oraz inspektorowi ochrony danych; o ten dokument poprosi audytor lub klient.

PoleClaude CodeCodexCursor
Dozwolone klasy danych (zob. prywatność i dane)
Trasa (bezpośrednio u dostawcy, Claude Platform on AWS, Bedrock, Google Cloud, Foundry, bramka, własny hosting)
Region inferencji i sposób wymuszenia (nazwa ustawienia, plik zarządzany)
Retencja: ZDR, 30 dni lub polityka dostawcy; odwołanie do klauzuli umowy
Dozwolone modele, w tym Covered Models dopuszczone z retencją
Funkcje utracone na tej trasie i ich zastępstwo
Kto wystawia fakturę i kto odpowiada za budżet
Źródło dowodów (logi bramki, CloudTrail, Cloud Audit Logs, Azure Monitor)
Data przeglądu (co najmniej raz na kwartał i przy każdej zmianie modelu lub planu)

Trasa na papierze nie jest mechanizmem kontrolnym. Udowodnij ją dowodami generowanymi przez maszyny, sprawdzanymi według harmonogramu.

  1. Sprawdź efektywną konfigurację na próbce maszyn. W Claude Code /status pokazuje dostawcę, region, bazowy URL i źródła ustawień; brak źródła zarządzanego oznacza, że dystrybucja zawiodła. codex doctor wypisuje aktywnego dostawcę, czy poświadczenie jest ustawione i endpoint odpowiada, oraz każde nadpisujące wymaganie.

  2. Przeczytaj zapis po stronie dostawcy. Żądania do Bedrocka widać w CloudTrail, do Google Cloud w Cloud Audit Logs, do Foundry w Azure Monitor, a przez bramkę w jej logach lub eksporcie OpenTelemetry. W API Anthropic pole usage.inference_geo w odpowiedzi mówi, gdzie inferencja faktycznie się odbyła.

  3. Zablokuj obejście na poziomie sieci. Dopuszczaj ruch do endpointów modeli tylko z bramki lub z zatwierdzonej trasy chmurowej. Niezależnie od dostawcy narzędzie WebFetch w Claude Code wysyła każdą nazwę hosta do api.anthropic.com w celu sprawdzenia bezpieczeństwa; wyłącza to tylko skipWebFetchPreflight: true (CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC nie). Zapisz, czy dopuszczasz ten host, czy wyłączasz sprawdzanie.

  4. Co kwartał uruchom test kanarkowy. Jedno skryptowe żądanie na każde narzędzie i trasę, z linią logu i regionem zapisanymi jako dowód, przekazanymi też do obserwowalności agentów.

  5. Przed zmianą trasy lub modelu powtórz ewaluacje. Trasy chmurowe nie nadążają za ustawieniami domyślnymi dostawcy (na Foundry Claude Code domyślnie używa Sonnet 4.5, a opus wskazuje Opus 4.6); bramkę ewaluacyjną opisuje playbook nowego modelu.

Za kroki 1–4 odpowiada zespół platformowy, lider bezpieczeństwa podpisuje kwartalne dowody, a CTO każdą zmianę trasy (model operacyjny).

Co się psuje po przeniesieniu agentów na trasę chmurową lub bramkę?

Dział zatytułowany „Co się psuje po przeniesieniu agentów na trasę chmurową lub bramkę?”

Ruch opuszcza region przez ustawienie domyślne. Każda pułapka z tabeli regionów wyprowadza ruch bez żadnego błędu. Naprawa: przypnij identyfikatory profili lub lokalizacje w ustawieniach zarządzanych, ogranicz do nich IAM i potwierdź to przez /status oraz log audytowy dostawcy.

Po wdrożeniu bramki nikt nie może uruchomić sesji. Komunikat brzmi „This machine’s managed settings require a first-party login”. Naprawa: usuń forceLoginMethod i forceLoginOrgUUID stojące obok poświadczenia bramki zewnętrznej, jak wyjaśnia zakładka Claude Code.

Polityka przestaje docierać do programistów. Ustawienia zarządzane z serwera wymagają bezpośredniego połączenia z api.anthropic.com, więc omijają sesje przez bramkę. Naprawa: dostarcz te same klucze przez plikowe ustawienia zarządzane.

Po przejściu na bramkę rosną koszty. Rozliczenie przechodzi na stawki za tokeny, a Claude apps gateway wymusza TTL cache’u 5 minut. Naprawa: ustaw limity wydatków per grupa w bramce i porównaj koszt na zaakceptowaną zmianę w dwóch tygodniach przed zmianą i po niej, tak jak opisuje zarządzanie kosztami.

Zmiana trasy po cichu zmienia model. Dostawcy chmurowi udostępniają i wycofują modele we własnym rytmie, a tryb auto działa tam tylko z Sonnet 5, Opus 4.7 i nowszymi oraz Fable, więc domyślna sesja na Foundry z Sonnet 4.5 startuje w trybie Manual. Naprawa: przypnij wersje modeli dla każdej trasy i powtórz ewaluacje przed każdą zmianą.