Gdzie działa model: bramki, chmury, rezydencja danych i zero retencji
Hosting modelu dla agentów kodujących to wybór miejsca inferencji: własne API dostawcy; trasa chmurowa, taka jak Amazon Bedrock, Agent Platform w Google Cloud, dawniej Vertex AI, Microsoft Foundry lub Claude Platform on AWS; bramka LLM przed jedną z nich; albo samodzielnie hostowane modele open-weight. Od trasy zależą rezydencja danych, retencja, rozliczenia i to, które funkcje agenta działają.
Dział prawny właśnie podpisał umowę z klientem, według której kod źródłowy jest przetwarzany w UE i nie jest przechowywany przez podprocesorów. Twoje zespoły używają Claude Code na planie Team, Codeksa przez ChatGPT i Cursora. Dział zakupów pyta o każde narzędzie: „dokąd trafia nasz kod i na jak długo?”, i nikt nie umie odpowiedzieć z dowodami w ręku.
Ta strona jest dla CTO, który odpowiada za tę odpowiedź. Trasa decyduje też o tym, kto wystawia fakturę, więc czytaj ją razem z zarządzaniem kosztami AI. Konfiguracja per narzędzie jest opisana w konfiguracji bramki LLM dla Claude Code, a wersje i ceny modeli w przeglądzie modeli.
Co rozstrzygasz, wybierając miejsce działania modelu
Dział zatytułowany „Co rozstrzygasz, wybierając miejsce działania modelu”- Pięć tras, kto obsługuje inferencję na każdej z nich i jakie funkcje każda ci odbiera.
- Kontrolę regionu na każdej trasie, w tym miejsca, w których trasowanie „global” wyprowadza ruch z zakładanego regionu.
- Które modele działają przy zero retencji danych (ZDR) i co ZDR wyłącza lub czego nigdy nie obejmuje.
- Konfigurację zarządzaną dla każdego narzędzia, rejestr decyzji i kwartalny dowód trasy.
Fakty sprawdzono 26 września 2026 r. w dokumentacji Anthropic, w Claude Code 2.1.283 i w Codeksie 0.157.1. Dokumentacja AWS i Google Cloud oraz openai.com były tego dnia niedostępne, więc ich warunki retencji występują tu jako pytania, a nie fakty.
Jakie trasy hostingu mają agenci kodujący?
Dział zatytułowany „Jakie trasy hostingu mają agenci kodujący?”W praktyce każde wdrożenie mieści się w pięciu trasach. Pierwsze cztery to miejsca, w których działa inferencja; bramka to warstwa, którą stawiasz przed dowolną z nich.
| Trasa | Kto obsługuje inferencję | Rozliczenie | Co zyskujesz | Co tracisz |
|---|---|---|---|---|
| Bezpośrednio u dostawcy: Claude Team lub Enterprise, API Anthropic, workspace ChatGPT dla Codeksa, backend Cursora | Dostawca | Stanowiska lub tokeny u dostawcy | Każdą funkcję w dniu premiery, w tym sesje w chmurze i zarządzany code review | Wybór rezydencji należy do dostawcy (Anthropic: tylko us lub global) |
| Claude Platform on AWS | Anthropic, z uwierzytelnianiem AWS | AWS Marketplace | Modele i funkcje Claude API w tym samym rytmie, płatne przez AWS | Osobną organizację Anthropic powiązaną z kontem AWS; poświadczenia się nie przenoszą |
| Chmury partnerskie: Amazon Bedrock, Agent Platform w Google Cloud, Microsoft Foundry | Swoje trasy obsługują AWS i Google; Foundry obsługuje Anthropic, na Azure albo na własnej infrastrukturze | Twój rachunek chmurowy | Twój IAM, logi audytowe (CloudTrail, Cloud Audit Logs, Azure Monitor) i wybór regionu | Sesje w chmurze, Routines, Remote Control, Ultrareview i zarządzany Code Review, które wymagają subskrypcji Claude |
| Bramka LLM (Claude apps gateway od Anthropic, LiteLLM, własna) | Upstream, do którego bramka przekazuje ruch | Konto upstreamu, za tokeny | Jedno miejsce na poświadczenia, atrybucję, budżety, audyt i zmianę dostawcy | Usługę, którą aktualizujesz z każdym wydaniem agenta, oraz część funkcji |
| Własny hosting modeli open-weight | Ty | Twój sprzęt | Nic nie opuszcza twojej sieci | Jakość modelu, którą musisz udowodnić własnymi ewaluacjami; Anthropic nie wspiera Claude Code na modelach innych niż Claude przez żadną bramkę |
Dwa wiersze zaskakują najczęściej. Wdrożenia Foundry „hosted on Azure” trzymają prompty i odpowiedzi w Azure; do Anthropic trafiają tylko metadane użycia i treści oznaczone przez systemy bezpieczeństwa. Z kolei poświadczenie bramki zastępuje subskrypcję claude.ai programisty, więc użycie jest rozliczane za tokeny na właściciela poświadczenia dostawcy. Zaplanuj na to budżet; Anthropic szacuje firmowe użycie Claude Code na około 13 USD na programistę za aktywny dzień i 150–250 USD na programistę miesięcznie (strona kosztów Claude Code, sprawdzone 26 września 2026 r.).
Która trasa trzyma inferencję w twoim regionie?
Dział zatytułowany „Która trasa trzyma inferencję w twoim regionie?”Ustawienia domyślne przedkładają dostępność nad geografię. Najpierw zapisz wymaganie (UE, USA albo brak), a potem wybierz trasę, która potrafi je wymusić, a nie tylko dopuszcza. Cursor nie ma własnej kontroli regionu; zobacz jego zakładkę w sekcji o konfiguracji.
Modele Claude: cztery trasy, cztery różne kontrole regionu
Dział zatytułowany „Modele Claude: cztery trasy, cztery różne kontrole regionu”| Trasa | Kontrola regionu | Czy da się wymusić inferencję tylko w UE? | Pułapka |
|---|---|---|---|
| API Anthropic i Claude Platform on AWS | inference_geo per żądanie albo default_inference_geo i allowed_inference_geos per workspace | Nie. Istnieją tylko "us" i "global", a workspace geo (przechowywanie danych) to wyłącznie "us" | "global" jest wartością domyślną: inferencja „may run in any available geography” |
| Amazon Bedrock | Region plus prefiks profilu cross-region inference: Claude Code preferuje eu. w regionach eu-*, us. w us-*, apac. w ap-*, a global. wszędzie indziej | Tak, z profilami eu. | Prefiks to preferencja, a nie gwarancja |
| Agent Platform w Google Cloud | CLOUD_ML_REGION: global, lokalizacja wieloregionowa taka jak eu albo region taki jak europe-west1 | Tak, z eu lub regionem w UE | Błędnie sformatowana wartość jest traktowana jak brak ustawienia i spada na us-east5; dostępność modeli różni się między lokalizacjami |
| Microsoft Foundry | Typ wdrożenia: Global Standard albo US Data Zone Standard | Brak strefy danych UE dla Claude | US Data Zone obejmuje tylko wdrożenia hostowane na Azure |
Na Bedrocku ANTHROPIC_BEDROCK_REGION_PREFIX (Claude Code 2.1.224 lub nowszy) to według dokumentacji „a preference, not a guarantee”: model bez profilu eu. przechodzi na dowolny pasujący profil, więc region wymuszaj przypiętymi identyfikatorami profili i IAM. Na Foundry Fable 5.1 jest dostępny wyłącznie w wariancie hostowanym przez Anthropic, więc nie skorzysta z US Data Zone.
Rezydencja kosztuje: inferencja tylko w USA (inference_geo: "us" albo US Data Zone na Foundry) kosztuje 1,1x stawki na modelach Claude 4.6 i nowszych, a regionalne endpointy na Bedrocku i Google Cloud mają 10% narzutu względem globalnych (strony cennika i rezydencji danych Anthropic, sprawdzone 26 września 2026 r.).
Modele OpenAI w Codeksie: rezydencja w USA to przełącznik zarządzany
Dział zatytułowany „Modele OpenAI w Codeksie: rezydencja w USA to przełącznik zarządzany”W Codeksie 0.157.1 enforce_residency = "us" w /etc/codex/requirements.toml dołącza nagłówek rezydencji USA do każdego żądania do modelu; każda inna wartość, na przykład "eu", kończy start błędem unknown variant `eu`, expected `us` . Ten sam plik może przypiąć model_provider, więc trasa nie zależy od config.toml na każdym laptopie.
Codex 0.157.1 potrafi wymusić tylko rezydencję w USA. Materiały OpenAI wspominają o rezydencji danych w UE, więc zanim na niej oprzesz umowę, uzyskaj warunki dla UE od OpenAI na piśmie.
Których modeli możesz używać przy zero retencji danych?
Dział zatytułowany „Których modeli możesz używać przy zero retencji danych?”Zero retencji danych oznacza, że dostawca nie przechowuje promptów i odpowiedzi po zwróceniu odpowiedzi, z wyjątkiem sytuacji wymaganych przez prawo lub walkę z nadużyciami. W Claude Code ZDR jest węższe, niż zakłada większość umów.
Kto może je dostać. Kwalifikujące się konta Claude for Enterprise. ZDR włącza zespół opiekunów klienta w Anthropic, osobno dla każdej organizacji, bez przełącznika dla administratora; nowa organizacja go nie dziedziczy. Obejmuje też klucze API organizacji komercyjnej objętej ZDR, a Claude Platform on AWS oferuje ZDR na żądanie. Strona o ZDR w Claude Code obejmuje wyłącznie bezpośrednią platformę Anthropic. Na Bedrocku i Google Cloud podmiotem przetwarzającym jest dostawca chmury; dla Foundry strona Anthropic o retencji w API wskazuje Anthropic, więc warunki Foundry dla Claude Code uzyskaj na piśmie.
Które modele. Wszystko, do czego ma dostęp twoja organizacja z ZDR, pozostaje dostępne, z wyjątkiem Covered Models, które domyślnie wymagają 30-dniowej retencji:
| Model | Przy ZDR (bezpośrednio u Anthropic) | Jak mimo to z niego korzystać |
|---|---|---|
Claude Opus 5.5 (domyślny w Claude Code od v2.1.280, kanał latest), Sonnet 5, Haiku 4.5 i starsze modele Opus i Sonnet | Dostępne | — |
| Claude Fable 5.1, Fable 5 | Tylko tam, gdzie zezwoli Anthropic; według Anthropic uprawnieni klienci mogą używać Fable 5.1 przy ZDR, dopóki nie pojawią się Enterprise Frontier Safeguards | Włącz 30-dniową retencję dla jednego workspace’u w Claude Console > Settings > Workspaces > Privacy controls; pozostałe workspace’y zachowują ZDR |
| Claude Mythos 5.1, Mythos 5 | Ta sama zasada; i tak dostępne tylko na zaproszenie | — |
Tam, gdzie Fable jest niedostępny, alias best wskazuje Opusa. Covered Model wywołany bez retencji zwraca „In order to access this model, your organization or workspace must have data retention enabled.”
Co ZDR wyłącza. Sesje w chmurze (także uruchamiane z aplikacji Desktop), Claude Tag, Artifacts, /feedback, /bug, /share, Remote Control, zarządzany Code Review i Ultrareview. Zaplanuj code review wokół lokalnego /code-review i agentów uruchamianych w CI, zanim podpiszesz umowę.
Czego ZDR nigdy nie obejmuje. Czatu na claude.ai, Cowork, metadanych analitycznych, zarządzania stanowiskami oraz każdego serwera MCP i integracji zewnętrznej, z której korzysta agent. Transkrypty sesji zostają też na każdym laptopie jako zwykły tekst w ~/.claude/projects/, domyślnie przez 30 dni (cleanupPeriodDays), a treści oznaczone jako naruszenie zasad użytkowania mogą być przechowywane do dwóch lat.
Warunków retencji Codeksa i Cursora nie dało się sprawdzić 26 września 2026 r. Zapytaj każdego dostawcę na piśmie, które modele lub funkcje wymagają retencji i czy agenci w chmurze podlegają tym samym warunkom.
Co daje bramka LLM, a co odbiera?
Dział zatytułowany „Co daje bramka LLM, a co odbiera?”Bramka to proxy między agentem a dostawcą modelu: programiści mają poświadczenie bramki, a bramka trzyma poświadczenie dostawcy, atrybucję, budżety, logi audytowe i zmianę dostawcy.
Claude apps gateway od Anthropic jest wbudowana w binarkę claude (claude gateway --config gateway.yaml, Claude Code 2.1.195 lub nowszy). Programiści logują się przez twojego dostawcę tożsamości OIDC, grupy IdP mapują się na listy dozwolonych modeli po stronie serwera i na polityki ustawień zarządzanych, a bramka eksportuje metryki OpenTelemetry i przełącza się awaryjnie między trasami chmurowymi i API Anthropic. Jej warstwa danych nie wysyła niczego do Anthropic, chyba że API Anthropic jest skonfigurowanym upstreamem. Udokumentowane ograniczenia:
- Tylko SSO w przeglądarce, bez przepływu z tokenem usługowym, więc potoki CI uwierzytelniają się bezpośrednio u dostawcy.
- Tylko OIDC, jeden wystawca na bramkę, serwery wyłącznie na Linuksie, brak panelu administracyjnego.
- Brak wyszukiwania w sieci po stronie serwera, Remote Control i
/importw sesjach przez bramkę. - Prompt caching działa tylko z TTL 5 minut, więc długie sesje częściej wczytują kontekst bez cache’u; po przełączeniu obserwuj koszt sesji.
- Tylko adres w sieci prywatnej:
/loginodrzuca bramkę, której nazwa wskazuje (w DNS) na publiczny adres IP; publiczne pule używane wewnętrznie wpisz dogatewayInternalNetworks(Claude Code 2.1.268 lub nowszy).
Inne bramki działają, jeśli udostępniają obsługiwany format API i przekazują nagłówki oraz pola żądania wysyłane przez Claude Code; bramka nienadążająca za wydaniami Claude Code psuje funkcje, których pola usuwa. Traktuj bramkę jak element łańcucha dostaw: 24 marca 2026 r. wydania litellm 1.82.7 i 1.82.8 na PyPI okazały się złośliwym oprogramowaniem kradnącym poświadczenia i zostały usunięte (zgłoszenie BerriAI/litellm 24518). Przypinaj wersje i weryfikuj skróty. Porównanie produktów znajdziesz w przewodniku bramki i modele lokalne; odpowiednik po stronie narzędzi opisuje strona rejestry i bramki MCP.
Własny hosting to osobna decyzja. Codex uruchamia modele lokalne bezpośrednio (codex --oss --local-provider ollama lub lmstudio); Claude Code tego nie robi. Zanim model open-weight przejmie prawdziwą pracę, przeprowadź własne ewaluacje i sprawdź licencję wag; zobacz modele open-weight.
Jak skonfigurować trasę w każdym narzędziu?
Dział zatytułowany „Jak skonfigurować trasę w każdym narzędziu?”Dostarczaj trasę przez konfigurację zarządzaną, nigdy przez stronę w wiki. Te same pliki niosą resztę twojej polityki zarządzanej dla agentów.
Bedrock z inferencją w UE, w bloku env pliku ustawień zarządzanych:
{ "env": { "CLAUDE_CODE_USE_BEDROCK": "1", "AWS_REGION": "eu-central-1", "ANTHROPIC_BEDROCK_REGION_PREFIX": "eu", "ANTHROPIC_DEFAULT_OPUS_MODEL": "eu.anthropic.claude-opus-5-5", "ANTHROPIC_DEFAULT_SONNET_MODEL": "eu.anthropic.claude-sonnet-5" }}Prefiks wyraża tylko preferencję. Claude Code nie przepisuje przypiętych identyfikatorów profili inferencji, więc przypnij każdą dozwoloną rodzinę modeli do profilu eu., który istnieje na twoim koncie: blok przypina Opusa i Sonneta, a Haiku, jeśli go dopuszczasz, potrzebuje takiego samego wpisu ANTHROPIC_DEFAULT_HAIKU_MODEL. Ogranicz Resource w polityce IAM do ARN-ów tych profili, żeby wszystko inne kończyło się odmową.
Agent Platform w Google Cloud w lokalizacji wieloregionowej UE (eu):
{ "env": { "CLAUDE_CODE_USE_VERTEX": "1", "CLOUD_ML_REGION": "eu", "ANTHROPIC_VERTEX_PROJECT_ID": "acme-ai-prod" }}Własna bramka, z kluczem dla każdego programisty pobieranym z magazynu sekretów:
{ "env": { "ANTHROPIC_BASE_URL": "https://llm-gateway.internal.example.com" }, "apiKeyHelper": "/usr/local/bin/get-gateway-key"}Zarządzanego ANTHROPIC_BASE_URL programista nie nadpisze eksportem w powłoce. Nie łącz takiego poświadczenia bramki z forceLoginMethod ani forceLoginOrgUUID: każdy z tych kluczy blokuje ANTHROPIC_API_KEY, ANTHROPIC_AUTH_TOKEN i apiKeyHelper, i nikt nie uruchomi sesji. Wyjątkiem jest Claude apps gateway od Anthropic, wybierana przez forceLoginMethod: "gateway" i forceLoginGatewayUrl. Na trasach chmurowych przypnij wszystkie trzy zmienne ANTHROPIC_DEFAULT_*_MODEL, żeby nowy model domyślny pojawiał się wtedy, kiedy ty zdecydujesz. /status pokazuje dostawcę, region i bazowy URL, których sesja faktycznie używa. Pełna konfiguracja: konfiguracja bramki LLM i konfiguracja firmowego proxy.
Bedrock jako dostawca, w config.toml (wbudowany dostawca amazon-bedrock pozwala nadpisać tylko base_url, auth, http_headers i klucze aws.*):
model_provider = "amazon-bedrock"
[model_providers.amazon-bedrock.aws]profile = "codex-bedrock"region = "us-east-1"Własna bramka jako dostawca niestandardowy (wire_api = "chat" nie jest już akceptowane w 0.157.1):
model_provider = "corp-gateway"
[model_providers.corp-gateway]name = "Corporate LLM gateway"base_url = "https://llm-gateway.internal.example.com/v1"env_key = "CORP_GATEWAY_TOKEN"wire_api = "responses"Zarządzane minimum w /etc/codex/requirements.toml: inny model_provider w config.toml zostaje nadpisany z ostrzeżeniem „Configured value for model_provider is overridden by the required value”. Zdefiniuj dostawcę w tym samym pliku, bo inaczej Codex nie wystartuje i zgłosi „failed to load configuration”.
enforce_residency = "us"model_provider = "corp-gateway"
[model_providers.corp-gateway]name = "Corporate LLM gateway"base_url = "https://llm-gateway.internal.example.com/v1"env_key = "CORP_GATEWAY_TOKEN"wire_api = "responses"Wszystkie trzy pliki zostały sparsowane przez Codeksa 0.157.1 26 września 2026 r. Token trzymaj w zmiennej środowiskowej, nigdy w pliku. Zarządzanie workspace’ami opisuje strona zarządzanie Codeksem w firmie.
Lokalny agent Cursora wysyła to, co czyta, do backendu Cursora, a Privacy Mode jest przechowywany po stronie Cursora i zespół może go wymusić dla swoich członków. Regionu, podprocesorów i retencji dla poszczególnych planów nie dało się zweryfikować 26 września 2026 r., bo cursor.com było niedostępne, więc traktuj Cursora jako trasę bezpośrednio u dostawcy i ureguluj rezydencję w umowie. Kontrolujesz to:
- Privacy Mode wymuszony dla organizacji, udokumentowany zrzutem ekranu z panelu administracyjnego z datą.
- Logowanie kontem firmowym przez twojego dostawcę tożsamości, żeby żadne prywatne konto nie działało poza Privacy Mode.
- Pisemną odpowiedź Cursora o region, podprocesorów, retencję per model i Cloud Agents.
Pełną listę pytań i kontrole, które przetestujesz w CI, zawiera strona o prywatności i bezpieczeństwie Cursora.
Rejestr decyzji do przyjęcia bez zmian
Dział zatytułowany „Rejestr decyzji do przyjęcia bez zmian”Wypełnij po jednej kolumnie na narzędzie i daj do podpisu liderowi bezpieczeństwa oraz inspektorowi ochrony danych; o ten dokument poprosi audytor lub klient.
| Pole | Claude Code | Codex | Cursor |
|---|---|---|---|
| Dozwolone klasy danych (zob. prywatność i dane) | |||
| Trasa (bezpośrednio u dostawcy, Claude Platform on AWS, Bedrock, Google Cloud, Foundry, bramka, własny hosting) | |||
| Region inferencji i sposób wymuszenia (nazwa ustawienia, plik zarządzany) | |||
| Retencja: ZDR, 30 dni lub polityka dostawcy; odwołanie do klauzuli umowy | |||
| Dozwolone modele, w tym Covered Models dopuszczone z retencją | |||
| Funkcje utracone na tej trasie i ich zastępstwo | |||
| Kto wystawia fakturę i kto odpowiada za budżet | |||
| Źródło dowodów (logi bramki, CloudTrail, Cloud Audit Logs, Azure Monitor) | |||
| Data przeglądu (co najmniej raz na kwartał i przy każdej zmianie modelu lub planu) |
Jak udowodnić, że ruch idzie wybraną trasą?
Dział zatytułowany „Jak udowodnić, że ruch idzie wybraną trasą?”Trasa na papierze nie jest mechanizmem kontrolnym. Udowodnij ją dowodami generowanymi przez maszyny, sprawdzanymi według harmonogramu.
-
Sprawdź efektywną konfigurację na próbce maszyn. W Claude Code
/statuspokazuje dostawcę, region, bazowy URL i źródła ustawień; brak źródła zarządzanego oznacza, że dystrybucja zawiodła.codex doctorwypisuje aktywnego dostawcę, czy poświadczenie jest ustawione i endpoint odpowiada, oraz każde nadpisujące wymaganie. -
Przeczytaj zapis po stronie dostawcy. Żądania do Bedrocka widać w CloudTrail, do Google Cloud w Cloud Audit Logs, do Foundry w Azure Monitor, a przez bramkę w jej logach lub eksporcie OpenTelemetry. W API Anthropic pole
usage.inference_geow odpowiedzi mówi, gdzie inferencja faktycznie się odbyła. -
Zablokuj obejście na poziomie sieci. Dopuszczaj ruch do endpointów modeli tylko z bramki lub z zatwierdzonej trasy chmurowej. Niezależnie od dostawcy narzędzie WebFetch w Claude Code wysyła każdą nazwę hosta do
api.anthropic.comw celu sprawdzenia bezpieczeństwa; wyłącza to tylkoskipWebFetchPreflight: true(CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFICnie). Zapisz, czy dopuszczasz ten host, czy wyłączasz sprawdzanie. -
Co kwartał uruchom test kanarkowy. Jedno skryptowe żądanie na każde narzędzie i trasę, z linią logu i regionem zapisanymi jako dowód, przekazanymi też do obserwowalności agentów.
-
Przed zmianą trasy lub modelu powtórz ewaluacje. Trasy chmurowe nie nadążają za ustawieniami domyślnymi dostawcy (na Foundry Claude Code domyślnie używa Sonnet 4.5, a
opuswskazuje Opus 4.6); bramkę ewaluacyjną opisuje playbook nowego modelu.
Za kroki 1–4 odpowiada zespół platformowy, lider bezpieczeństwa podpisuje kwartalne dowody, a CTO każdą zmianę trasy (model operacyjny).
Prompty do skopiowania: audyt tras modeli
Dział zatytułowany „Prompty do skopiowania: audyt tras modeli”Co się psuje po przeniesieniu agentów na trasę chmurową lub bramkę?
Dział zatytułowany „Co się psuje po przeniesieniu agentów na trasę chmurową lub bramkę?”Ruch opuszcza region przez ustawienie domyślne. Każda pułapka z tabeli regionów wyprowadza ruch bez żadnego błędu. Naprawa: przypnij identyfikatory profili lub lokalizacje w ustawieniach zarządzanych, ogranicz do nich IAM i potwierdź to przez /status oraz log audytowy dostawcy.
Po wdrożeniu bramki nikt nie może uruchomić sesji. Komunikat brzmi „This machine’s managed settings require a first-party login”. Naprawa: usuń forceLoginMethod i forceLoginOrgUUID stojące obok poświadczenia bramki zewnętrznej, jak wyjaśnia zakładka Claude Code.
Polityka przestaje docierać do programistów. Ustawienia zarządzane z serwera wymagają bezpośredniego połączenia z api.anthropic.com, więc omijają sesje przez bramkę. Naprawa: dostarcz te same klucze przez plikowe ustawienia zarządzane.
Po przejściu na bramkę rosną koszty. Rozliczenie przechodzi na stawki za tokeny, a Claude apps gateway wymusza TTL cache’u 5 minut. Naprawa: ustaw limity wydatków per grupa w bramce i porównaj koszt na zaakceptowaną zmianę w dwóch tygodniach przed zmianą i po niej, tak jak opisuje zarządzanie kosztami.
Zmiana trasy po cichu zmienia model. Dostawcy chmurowi udostępniają i wycofują modele we własnym rytmie, a tryb auto działa tam tylko z Sonnet 5, Opus 4.7 i nowszymi oraz Fable, więc domyślna sesja na Foundry z Sonnet 4.5 startuje w trybie Manual. Naprawa: przypnij wersje modeli dla każdej trasy i powtórz ewaluacje przed każdą zmianą.
Dokąd dalej w temacie hostingu modeli
Dział zatytułowany „Dokąd dalej w temacie hostingu modeli”- Jak uniknąć uzależnienia od dostawcy: następna strona, o zachowaniu możliwości zmiany trasy lub dostawcy.
- Zakup narzędzi AI do kodowania: kwestionariusz: strona po niej, która zamienia rejestr decyzji w pytania do umowy.
- Zarządzanie kosztami AI: tam należą budżety bramki.
- Konfiguracja bramki LLM dla Claude Code: konfiguracja per dostawca i rozwiązywanie problemów.
- Prywatność danych i polityki firmowe: klasy danych z rejestru decyzji.
- Model zagrożeń dla agentów: kontrole dla integracji, których ZDR nie obejmuje.
- AI Act i branże regulowane: regulacje stojące za wymaganiami rezydencji.
- Przegląd modeli: aktualne wersje, ustawienia domyślne i ceny u poszczególnych dostawców.