Przejdź do głównej zawartości

Governance i autonomia: człowiek przy bramkach

Governance AI-native daje agentom szeroką możliwość analizy i weryfikacji, ale rezerwuje nieodwracalne, regulowane oraz produkcyjne decyzje dla wskazanych ludzi i kontroli platformy. Autonomia wynika z ryzyka i środowiska, nie z pewności modelu ani producenta. Każda sesja ma tożsamość, zakres, kontrakt dowodu i bramkę.

Nadzór człowieka przenosi się z pisania każdej linii na jawne decyzje: zaakceptuj problem, design, ryzyko implementacji, merge i produkcję. Deterministyczne checki pilnują niezmienników; agenci ujawniają kontekst i wyjątki.

TierTypowa zmianaAgent możeWymagana decyzja człowieka
0. Tylko odczytResearch, inwentaryzacja, plan, reviewCzytać zaakceptowane źródła i tworzyć artefakty lub findingsZaakceptować albo odrzucić artefakt
1. Odwracalna lokalnieTesty, dokumentacja, izolowana implementacjaEdytować izolowany checkout i uruchamiać lokalne checkiPrzejrzeć diff i wykonać merge
2. Współdzielone non-productionPreview, staging, próba migracjiUżyć ograniczonych poświadczeń non-production i zatwierdzonych runbookówZaakceptować mutację wspólnego stanu i promocję
3. Produkcja lub regulacjeDeploy, migracja danych, wyjątek security, operacja destrukcyjnaPrzygotować dowody, dry run, rollback i prośbę o approvalWskazany właściciel zatwierdza, a platforma wykonuje akcję

Ryzyko rośnie wraz z blast radius, wrażliwością danych, odwracalnością, skutkiem regulacyjnym i zakresem poświadczeń. Mały diff nadal może być Tier 3, jeśli zmienia logowanie, billing albo dane produkcyjne.

  1. Nadaj agentom nieinteraktywnym osobną tożsamość usługową. Nie używaj szerokiego tokenu programisty.

  2. Przyznaj najmniejszy zakres repozytorium, sieci, chmury i danych potrzebny w danym tierze.

  3. Odmów sekretów produkcyjnych zadaniom Tier 0–2. Prompt “nie wdrażaj” nie jest granicą dostępu.

  4. Wymagaj branch protection i akceptacji code ownera przy merge.

  5. Wymagaj osobnej akceptacji środowiska wdrożeniowego dla Tier 3. Agent piszący i agent review nie mogą jej spełnić.

  6. Loguj inicjującego człowieka, tożsamość agenta, wersje artefaktów, komendy, findings, approval, wdrożenie i wynik rollbacku.

Każde zadanie autonomiczne lub w tle definiuje:

  • Wejście: commit, artefakty, ticket, okno telemetrii i dozwolone źródła.
  • Zakres: katalogi, narzędzia, sieć, poświadczenia i limit czasu lub budżetu.
  • Dowód: komendy, oczekiwany status, screenshoty, schemat lub próg pewności.
  • Wyjście: plik, PR, komentarz lub rekord odczytywany przez następną bramkę.
  • Błąd: niezerowy status, timeout, brak zależności, niska pewność i właściciel eskalacji.
  • Uprawnienia: akcje bez approval oraz pierwsza akcja zawsze zatrzymywana dla człowieka.

Powtarzalny prompt:

Run as risk tier TIER on commit SHA. Inputs: ARTIFACTS.
Allowed scope: PATHS, TOOLS, NETWORK, CREDENTIAL_CLASS, TIME_LIMIT.
Required proof: COMMANDS_AND_EXPECTED_RESULTS.
Output: DESTINATION_AND_SCHEMA.
Fail closed on missing evidence, permission errors, or uncertainty.
Do not merge, deploy, mutate production, weaken tests, or approve your own work.
Escalate to OWNER with the evidence already collected.
PotrzebaWłaściwa kontrola
Wyjaśnienie architektury lub konwencjiCLAUDE.md, .cursor/rules/*.mdc lub AGENTS.md
Powtarzalny wieloetapowy workflowSkill
Deterministyczne blokowanie albo logowanie narzędziaHook lub execution policy
Ograniczenie plików, komend i sieciSandbox oraz ograniczona tożsamość
Review przed mergemBranch protection i code owners
Autoryzacja przed produkcjąŚrodowisko wdrożeniowe lub bramka change management
Bezpieczne odzyskaniePrzećwiczony rollback ze wskazanym właścicielem
Dowód zdarzeńNiezmienne logi CI, PR, wdrożenia i incydentu
  1. Poproś agenta Tier 1 o zapis poza dozwolonym workspace. Sandbox musi to zablokować.
  2. Poproś o pominięcie nieprzechodzącego wymaganego testu. Workflow musi się zatrzymać.
  3. Spróbuj merge bez akceptacji code ownera. Branch protection musi zablokować operację.
  4. Spróbuj wydania produkcyjnego bez wskazanej zgody. Platforma wdrożeniowa musi je zablokować.
  5. Uruchom rollback w reprezentatywnym non-production i zmierz czas odzyskania.
  6. Zmień regułę, skill albo hook i uruchom evale harnessu przed rolloutem.

Tekst doradczy jest traktowany jako egzekwowanie. Przenieś niezmienniki do hooków, execution policy, CI lub uprawnień platformy.

Jeden token sięga każdego środowiska. Rozdziel tożsamości i rotuj poświadczenia. Worktree lub kontener nie zawęża tokenu chmurowego.

Ludzka bramka nie ma kryteriów decyzji. Przed automatyzacją zdefiniuj dowody, próg ryzyka, właściciela, timeout i ścieżkę eskalacji.

Rollback istnieje tylko w dokumencie. Przećwicz go w reprezentatywnym non-production i zmierz czas przywrócenia.

Przejdź do Deploy po procedurę review i wydania albo do Maintain po ograniczoną pracę uruchamianą z produkcji.