Przejdź do głównej zawartości

Ścieżka dewelopera: plan czytania do inżynierii agentowej

Ścieżka dewelopera to uporządkowany plan czytania dla programistów, którzy używają Cursora, Claude Code albo Codeksa. Zaczyna się od darmowego punktu odniesienia, scorecardu dewelopera, a potem prowadzi w górę drabiny autonomii: od pierwszego prawdziwego zadania do oceniania dowodów zamiast każdego diffa. Każdy krok kończy się artefaktem, który dowodzi, że krok jest ukończony.

Już używasz agenta. Czasem oszczędza ci popołudnie, a czasem spędzasz popołudnie na czytaniu tego, co napisał, bo nic ci nie mówi, czy możesz mu ufać. Ścieżka poniżej układa nawyki, które to naprawiają, w kolejności, w jakiej zaczynają się opłacać.

  • Kolejność, w której efekty się sumują. Każdy krok zakłada poprzedni: plik instrukcji sprawia, że pętla informacji zwrotnej działa niezawodnie, a pętla sprawia, że równoległa praca agentów jest bezpieczna.
  • Kryterium „Gotowe, gdy” dla każdego kroku. Idziesz dalej, gdy istnieje artefakt, a nie wtedy, gdy lektura wydaje się skończona.
  • Osobna gałąź dla każdego narzędzia tam, gdzie narzędzia się różnią, i jeden wspólny krok tam, gdzie się nie różnią.
  • Jasna granica tego, co darmowe. Każdy krok jest oznaczony jako bezpłatny albo dla subskrybentów.
  1. Najpierw wypełnij scorecard dewelopera. Odpowiedzi pokażą, które kroki możesz pominąć, a klucz odpowiedzi przypisuje każde pytanie do strony, która je poprawia.
  2. Kroki od 1 do 3 czytaj po kolei. Wszystko dalej zakłada zainstalowane narzędzie i przejrzany plik instrukcji.
  3. Po kroku 3 pomijaj każdy krok, którego artefakt „Gotowe, gdy” już masz.
  4. Po czterech tygodniach wypełnij scorecard ponownie i porównaj wyniki sekcji.

Kroki, które jeszcze powstają, są ukryte i pojawią się tu po publikacji. Lista rośnie ku końcowi ścieżki, gdzie przechodzi od oceniania diffów do oceniania dowodów.

  1. Dlaczego teraz: Umieść swój obecny sposób pracy na drabinie, żeby każdy kolejny krok przesuwał cię o szczebel wyżej.

    Gotowe, gdy: Umiesz nazwać swój poziom i jeden nawyk, który cię na nim trzyma.

  2. 2 Szybki start w twoim narzędziu: Cursor Claude Code Codex Dla subskrybentów

    Dlaczego teraz: Zainstaluj i skonfiguruj jedno narzędzie i przeprowadź przez nie pierwsze prawdziwe zadanie w swoim repozytorium.

    Gotowe, gdy: Scalona zmiana napisana przez agenta, razem z testami, które uruchomił.

  3. Dlaczego teraz: Plik instrukcji to najtańsza dźwignia jakości wyniku; napisz go, zanim zaczniesz używać agenta szerzej.

    Gotowe, gdy: Przejrzany CLAUDE.md albo AGENTS.md poniżej 150 linii z prawdziwymi poleceniami testów.

  4. Dlaczego teraz: Zdecyduj, co agent może uruchamiać bez pytania, zanim pozwolisz mu pracować dłużej.

    Gotowe, gdy: Zacommitowana polityka uprawnień i sandbox dla wszystkiego, co ma sieć albo sekrety.

  5. 5 Łańcuch artefaktów Dla subskrybentów

    Dlaczego teraz: Intencja, specyfikacja i plan to to, co oceniasz zamiast każdej linii napisanej przez agenta.

    Gotowe, gdy: Jedna zmiana wdrożona z zaakceptowanych intent.md, spec.md i plan.md.

  6. Dlaczego teraz: Kryteria akceptacji zapisane jako padające testy to kontrakt, według którego pracuje agent.

    Gotowe, gdy: Historyjka, której kryteria istnieją jako testy, zanim agent zacznie.

  7. Dlaczego teraz: Pętla informacji zwrotnej uruchamiana jednym poleceniem pozwala agentowi udowodnić swoją pracę, zanim na nią spojrzysz.

    Gotowe, gdy: Agent uruchamia pętlę i raportuje status wyjścia przy każdym zadaniu.

  8. Dlaczego teraz: Testy, które agent może edytować, nie są dowodem; zablokuj kontrole, których nie wolno mu osłabić.

    Gotowe, gdy: Hook albo reguła CI, która oblewa zmianę chronionych testów.

  9. Dlaczego teraz: Równoległi agenci potrzebują izolowanych checkoutów, portów i stanu, zanim będą potrzebować więcej tokenów.

    Gotowe, gdy: Dwóch agentów przy dwóch zadaniach w dwóch worktree bez kolizji.

  10. Dlaczego teraz: Wybieraj między skillem a serwerem MCP według zadania, nie mody.

    Gotowe, gdy: Jedna możliwość dodana we właściwej warstwie, z powodem, który umiesz podać.

  11. Dlaczego teraz: Zacznij od domyślnego modelu, dostrój effort i zmieniaj model tylko wtedy, gdy twoje ewaluacje tak mówią.

    Gotowe, gdy: Reguła wyboru modelu dla twojego repozytorium poparta przebiegiem przed i po.

  12. Dlaczego teraz: Zobacz, jakie nazwane frameworki istnieją i co każdy z nich zaleca.

    Gotowe, gdy: Wiesz, czy którykolwiek framework pasuje do twojej następnej zmiany.

  13. Dlaczego teraz: Punkt zwrotny całej ścieżki: co czytasz zamiast diffa i kiedy nadal czytasz kod.

    Gotowe, gdy: Zmiana zatwierdzona na podstawie pakietu dowodów bez czytania każdej linii.

  14. Dlaczego teraz: Oceniaj pull request agenta według klasy ryzyka i dowodów, z krótką listą eskalacji.

    Gotowe, gdy: Lista kontrolna, którą wykonuje agent do code review, a ty tylko eskalujesz.

  15. Dlaczego teraz: Gdy bramki trzymają, pozwól, żeby dobrze opisane zgłoszenie stało się pull requestem bez ciebie.

    Gotowe, gdy: Jedno zgłoszenie zamknięte przebiegiem pipeline, którego nie uruchamiałeś ręcznie.

  16. Dlaczego teraz: Czym staje się twój warsztat, gdy kod piszą agenci, i jak to pokazać.

    Gotowe, gdy: Spisany plan umiejętności, które utrzymasz, i tych, które oddajesz.

Krok 2 rozgałęzia się według narzędzia; reszta ścieżki jest wspólna, a każda podlinkowana strona pokazuje wszystkie trzy narzędzia tam, gdzie się różnią. Jeśli narzędzie nie jest jeszcze wybrane, najpierw przeczytaj porównanie narzędzi.

CursorClaude CodeCodex
Szybki startSzybki start w CursorzeSzybki start w Claude CodeSzybki start w Codeksie
Plik instrukcji (krok 3)RulesCLAUDE.mdAGENTS.md
Planowanie tylko do odczytuPlan Modeclaude --permission-mode plan albo /plan/plan
Praca równoległaWorktreesclaude -w <nazwa>codex --worktree
Kontrole w trybie headlesstryb print w CLI Cursora (-p)claude -pcodex exec

Polecenia Claude Code i Codeksa sprawdzono 26 września 2026 r. w Claude Code 2.1.283 i Codex CLI 0.157.1. Funkcje Cursora ostatnio zweryfikowano 28 sierpnia 2026 r. Claude Code czyta AGENTS.md, gdy projekt nie ma CLAUDE.md, od wersji 2.1.277 i tylko na kanale wydań latest.

Jak udowodnić, że krok jest ukończony, bez czytania każdej linii?

Dział zatytułowany „Jak udowodnić, że krok jest ukończony, bez czytania każdej linii?”

Kryteria ukończenia są tak zbudowane, żeby na pytanie „czy to gotowe” odpowiadała kontrola, a nie twoja lektura. Uczciwość zapewniają trzy zasady:

  • Rozstrzyga jedno polecenie. Od kroku o pętli informacji zwrotnej każde zadanie kończy się tym, że agent uruchamia jedno polecenie repozytorium do testów, lintu i sprawdzania typów, a potem raportuje jego status wyjścia. Dowodem jest zerowy status polecenia, któremu ufasz, a nie podsumowanie agenta.
  • Agent nie może osłabić kontroli. Testy, które agent może edytować, niczego nie dowodzą. Zablokuj kontrole, których nie wolno mu osłabić, hookiem albo regułą CI (to krok ścieżki o ochronie wyroczni testowej, który pojawi się po publikacji), a CI niech uruchamia to samo polecenie przy każdym pull requeście.
  • Czytasz kontrakt, a nie diff. Od kroku o łańcuchu artefaktów oceniasz intencję, specyfikację i plan, zanim agent napisze kod, a po zakończeniu porównujesz z nimi dowody. Kod linia po linii nadal czytasz tam, gdzie zmiana jest wysokiego ryzyka albo brakuje dowodów.

Powtarzają się cztery blokady i każda ma szybkie wyjście:

  • Agent czyta nie te pliki. W dużych repozytoriach wyniki budowania i pliki generowane zalewają kontekst. Wskaż w prompcie pliki i katalogi, które się liczą, a te do pominięcia zapisz w pliku instrukcji.
  • Serwer MCP nie łączy się. Zwykle brakuje zmiennej środowiskowej. Najpierw uruchom serwer osobno, sprawdź, czy token jest wyeksportowany, a potem zrestartuj agenta; w Claude Code claude --debug "mcp" wypisuje błąd połączenia, a /mcp pokazuje stan każdego serwera.
  • Jakość nagle spada. Zanim zrobisz cokolwiek innego, sprawdź aktywny model i poziom wysiłku (effort): /model w Claude Code i Codeksie, wybór modelu w Cursorze. Zacznij od domyślnego modelu narzędzia, podnieś poziom wysiłku, zanim zmienisz model, i zmieniaj model tylko wtedy, gdy twoje ewaluacje tak mówią. Aktualne ustawienia domyślne są na stronie modeli.
  • Uruchomienia w trybie headless wiszą. Uruchomienie w CI czeka na prośbę o akceptację, na którą nikt nie odpowie. W Claude Code z góry zatwierdź narzędzia, których potrzebuje zadanie, flagą --allowedTools albo w ustawieniach projektu. W Codeksie podaj politykę akceptacji przed podkomendą, na przykład codex -a never exec …, w runnerze z sandboxem.

Pełny katalog komunikatów o błędach i poprawek jest w przewodniku rozwiązywania problemów.

Najczęstsze pytania

Czym jest ścieżka dewelopera?

To uporządkowana ścieżka czytania dla programistów, którzy używają Cursora, Claude Code albo Codeksa. Zaczyna się od darmowego scorecardu dewelopera jako punktu odniesienia, a potem prowadzi od drabiny autonomii przez szybki start narzędzia, plik instrukcji, łańcuch artefaktów i pętlę testów do równoległych worktree, ekosystemu i wyboru modelu. Każdy krok mówi, dlaczego jest w tym miejscu, i wskazuje dowód, że możesz iść dalej.

Czy kroki trzeba czytać po kolei?

Kroki od 1 do 3 czytaj po kolei, bo każdy późniejszy zakłada zainstalowane narzędzie i przejrzany plik instrukcji. Potem pomijaj każdy krok, którego kryterium ukończenia już spełniasz, i wracaj do niego, gdy scorecard albo twoja praca pokaże lukę.

Skąd wiem, że krok jest ukończony?

Każdy krok ma kryterium „Gotowe, gdy”, które jest artefaktem, a nie odczuciem: scalona zmiana razem z testami, które uruchomiła, przejrzany plik instrukcji, jedno polecenie, którego status wyjścia raportuje agent. Jeśli nie umiesz wskazać artefaktu, krok nie jest ukończony.

Które kroki są darmowe?

Strony drabiny i wszystko w Zacznij tutaj są darmowe. Przewodniki po narzędziach, przepływy pracy i strony odpowiedzi scorecardu wymagają subskrypcji; każdy krok ścieżki jest oznaczony jako bezpłatny albo dla subskrybentów.

Co zrobić, gdy ścieżka utknie?

Powtarzają się cztery blokady: agent czyta nie te pliki, serwer MCP nie łączy się z powodu brakującej zmiennej środowiskowej, jakość spada po zmianie modelu albo poziomu wysiłku (effort), a uruchomienia w trybie headless wiszą na prośbie o akceptację. Każda ma na tej stronie krótki sposób wyjścia.