Przejdź do głównej zawartości

Code review wewnątrz agenta: skille i wtyczki

Skille i wtyczki do code review robią review diffa wewnątrz agenta programistycznego, zanim pull request trafi do człowieka. Claude Code 2.1.283 ma wbudowane /code-review; wtyczki i skille dokładają komentarze na PR, wyspecjalizowanych recenzentów, zgodność ze specyfikacją, review bezpieczeństwa i drugi model. Wskazują prawdopodobne defekty. Niczego nie zatwierdzają: merge nadal zależy od testów, CI i konkretnego człowieka.

Agent kończy gałąź na 600 linii, pisze, że testy przechodzą, a ty otwierasz pull request ze świadomością, że nikt nie przeczyta jej uważnie w całości. Masz też zainstalowane trzy rzeczy o nazwie „code review” i nie wiesz już, którą uruchamia /review. Ta strona jest dla developerów, którzy chcą, żeby praca agenta była sprawdzona przed pushem, i dla tech leadów, którzy chcą jednego łańcucha review dla całego zespołu zamiast ośmiu prywatnych.

Co dostajesz z tej strony o code review wewnątrz agenta

Dział zatytułowany „Co dostajesz z tej strony o code review wewnątrz agenta”
  • Tabelę decyzyjną dla ośmiu narzędzi do review
  • Rozpisane uruchomienie /code-review high na gałęzi z funkcją, z flagami, które zmieniają jego zachowanie
  • Polecenia instalacji dla Claude Code, Codex i Cursora, sprawdzone 2026-09-26 z Claude Code 2.1.283, codex-cli 0.157.1 i skills CLI 1.7.0
  • Trzyetapowy workflow: review własnej pracy w sesji, w której powstał kod, drugi model, potem bot na PR, oraz to, co każdy etap przekazuje następnemu
  • Prompty do skopiowania, sposób na zmierzenie, czy recenzenci łapią prawdziwe błędy, i pułapki, przez które review po cichu się nie odbywa

„Code review” to nazwa co najmniej ośmiu różnych narzędzi. Różnią się tym, co czytają, dokąd trafiają uwagi i czy edytują twój kod.

NarzędzieKto je wydajeCo sprawdzaDokąd trafiają uwagiDziała w
/code-review (wbudowane, alias /review)Anthropic, w pakiecieBłędy poprawności w diffie, a jeśli obejmuje to procedura review dla danego modelu, także porządki (ponowne użycie kodu, uproszczenia, wydajność)Twoja sesja; --fix je nanosi, --comment publikuje na PRClaude Code
Wtyczka code-review, /code-review:code-reviewAnthropic, claude-plugins-officialPR na GitHubie: zgodność z CLAUDE.md, oczywiste błędy, historia gita, komentarze z wcześniejszych PR, komentarze w kodzie; odrzuca uwagi z oceną poniżej 80Jeden komentarz na PR przez ghClaude Code
pr-review-toolkit, /pr-review-toolkit:review-prAnthropic, claude-plugins-officialSześć wyspecjalizowanych subagentów: komentarze, testy, ciche błędy, projekt typów, ogólna jakość, uproszczeniaTwoja sesja, w grupach Critical / Important / SuggestionClaude Code
code-review Pocockamattpocock/skillsDwie osie w równoległych subagentach: udokumentowane standardy repozytorium i zgodność diffa ze specyfikacją lub zgłoszeniemTwoja sesja, pod ## Standards i ## SpecKażdy agent, który czyta skille
requesting-code-review / receiving-code-reviewobra/superpowersRequesting: subagent-recenzent sprawdza każde zadanie względem planu. Receiving: agent weryfikuje uwagi, zanim na nie zareagujeTwoja sesjaKażdy agent, który czyta skille
differential-reviewtrailofbits/skillsReview bezpieczeństwa diffa z git blame, zasięgiem zmiany (liczbą wywołujących) i pokryciem testami zmienionego koduRaport w pliku MarkdownClaude Code, Codex
Skill code-review od CodeRabbitcoderabbitai/skillsUruchamia CodeRabbit CLI na twoich zmianach; uwagi mają poziomy ważności i instrukcje naprawyTwoja sesja; diff trafia do API CodeRabbitKażdy agent, który czyta skille
Wtyczka codex, /codex:reviewOpenAI, openai/codex-plugin-ccReview Codexa w trybie tylko do odczytu: niezacommitowane zmiany albo gałąźTwoja sesja Claude CodeClaude Code

/review z gstacka to dziewiąta opcja, z kolizją nazw; zobacz ramkę z pułapkami niżej. Zarządzane boty na PR (Claude Code Review, @codex review, Cursor Bugbot, aplikacja CodeRabbit na GitHubie) opisuje strona boty AI do code review.

Popularność na 2026-09-26. Instalacje w katalogu wtyczek claude.com: code-review 438 525, pr-review-toolkit 114 856, coderabbit 32 361. Instalacje ze skills.sh od początku istnienia, według zewnętrznego zrzutu LinklyAI/best-skills z 2026-09-26 (źródło wtórne; przed cytowaniem sprawdź skills.sh): code-review Pococka 617 608, requesting-code-review 238 401, receiving-code-review 202 093. Gwiazdki na GitHubie tego samego dnia: garrytan/gstack 134,2 tys., openai/codex-plugin-cc 33,6 tys., trailofbits/skills 7,3 tys.

Jeśli chcesz…UżyjDlaczego ten
sprawdzić własną gałąź przed pushemwbudowanego /code-reviewNie wymaga instalacji, działa w tle, a --fix nanosi to, co znalazł
sprawdzić, czy diff robi to, o co prosiło zgłoszeniecode-review PocockaRaportuje zgodność ze specyfikacją jako osobną oś, niezależną od standardów, więc rozrost zakresu i brakujące wymagania nie giną wśród uwag o stylu
przejrzeć zmianę w uwierzytelnianiu, płatnościach albo parsowaniu wejściadifferential-reviewKlasyfikuje po ryzyku, nie po rozmiarze, i pisze raport, który dołączysz do PR
dostać drugą opinię od innej rodziny modeli/codex:review (Claude Code) albo skilla CodeRabbitRecenzent nie zaczyna od rozumowania modelu-autora ani od historii jego sesji
robić review między zadaniami długiego planu albo polemizować ze złą uwagąrequesting-code-review / receiving-code-review z SuperpowersPierwszy działa po każdym zadaniu, a nie raz na końcu; drugi każe agentowi zweryfikować każde twierdzenie, zanim się zgodzi
opublikować przefiltrowane review na PR kolegiwtyczki code-reviewFiltr pewności nie wpuszcza na PR drobiazgów o niskiej pewności

Wybierz jednego recenzenta na etap: dwa skille reagujące na jedno polecenie dają dwie procedury i dwa raporty.

Zacznij od polecenia wbudowanego; ma je każda sesja Claude Code. Pełna składnia w Claude Code 2.1.283 to /code-review [low|medium|high|xhigh|max|ultra] [--fix] [--comment] [pr#|branch|path].

  1. Skończ pracę na gałęzi. Bez celu review czyta commity gałęzi, których nie ma jeszcze w upstreamie, oraz wszystkie niezacommitowane zmiany. Pusty diff nie ma czego zgłosić.

  2. Uruchom review na poziomie effort high. W prompcie Claude Code:

    /code-review high

    Przy low i medium review zgłasza tylko uwagi, których jest najbardziej pewne. Poziomy od high do max poszerzają zakres i mogą zawierać uwagi mniej pewne. Na gałęzi z funkcją używaj high, przy małej poprawce medium.

  3. Pracuj dalej. Review działa jako subagent w tle z własnym oknem kontekstu; uwagi pojawiają się w rozmowie, gdy się skończy.

  4. Traktuj uwagi jak twierdzenia, nie fakty. Każda wskazuje miejsce w pliku i ma jednozdaniowe podsumowanie. Niech Claude odtworzy każdą uwagę o poprawności testem, który nie przechodzi, zanim ją poprawi (robi to prompt poniżej).

  5. Nanieś albo opublikuj. /code-review high --fix nanosi uwagi na drzewo robocze. /code-review high 1234 --comment przegląda pull request 1234 i publikuje uwagi jako komentarze w linii. Celem może być też ścieżka pliku albo nazwa gałęzi; udokumentowane formy w 2.1.283 to pr#, branch i path.

Łatwo przeoczyć:

  • Poziom jest zapamiętywany. Jeśli nie podasz poziomu, review użyje ostatniego, który wpisałeś, nawet we wcześniejszej sesji, i wyświetli komunikat w rodzaju Reusing high effort, the level you typed last time.
  • Zrób commit przed --fix. Nanosi on wszystkie uwagi na drzewo robocze za jednym razem, więc czysty commit daje ci jeden git restore do punktu wyjścia.
  • Lokalne review czyta CLAUDE.md, a nie REVIEW.md. REVIEW.md stroi tylko zarządzaną usługę Code Review.
  • /simplify to inne zadanie. Nanosi porządki, nie szukając błędów.

/code-review ultra przechodzi na ultrareview, czyli review wieloagentowe w chmurze Anthropic. Plany Pro i Max mają trzy darmowe uruchomienia, potem jedno kosztuje zwykle od 5 do 25 dolarów w kredytach użycia (dokumentacja ultrareview Anthropic, sprawdzona 2026-09-26). Ultrareview nie działa na Amazon Bedrock, Agent Platform w Google Cloud (dawniej Vertex AI), Microsoft Foundry ani w organizacjach z Zero Data Retention; tam /code-review ultra uruchamia zamiast tego review lokalne. Z powłoki to samo robi claude ultrareview [target], które wypisuje uwagi.

Żeby Claude ani zadanie zaplanowane nie uruchamiały review same, a polecenie zostało dostępne dla ciebie, dodaj to do ~/.claude/settings.json:

{
"skillOverrides": {
"code-review": "user-invocable-only"
}
}

Jak zainstalować skille do review w Claude Code, Codex i Cursorze?

Dział zatytułowany „Jak zainstalować skille do review w Claude Code, Codex i Cursorze?”

Wbudowane /code-review nie wymaga instalacji. Cała reszta to wtyczki (z aktualizacjami i poleceniami w przestrzeni nazw wtyczki) albo przenośne skille ze skills CLI (npm skills 1.7.0).

Okno terminala
# Anthropic's plugins (official marketplace, added on first interactive start)
claude plugin install code-review@claude-plugins-official --scope project
claude plugin install pr-review-toolkit@claude-plugins-official --scope project
# Second model: OpenAI's Codex plugin lives in OpenAI's own marketplace
claude plugin marketplace add openai/codex-plugin-cc
claude plugin install codex@openai-codex
# Security review of diffs
claude plugin marketplace add trailofbits/skills
claude plugin install differential-review@trailofbits
# Pocock's skills as a plugin, so his code-review gets a namespaced command
claude plugin install mattpocock-skills@claude-plugins-official
# Superpowers review skills as portable skills
npx skills add obra/superpowers --skill requesting-code-review receiving-code-review -a claude-code -y

Polecenia wtyczek mają przestrzeń nazw: /code-review:code-review, /pr-review-toolkit:review-pr tests errors, /mattpocock-skills:code-review, /codex:review, /differential-review:diff-review. Skille Pococka instaluj przez wtyczkę, bo przenośna kopia o nazwie code-review konkuruje z poleceniem wbudowanym o samą nazwę. Po instalacji wtyczki Codexa uruchom /codex:setup; sprawdza, czy Codex jest zainstalowany i zalogowany. Użycie Codexa liczy się do limitów twojego planu Codex albo klucza API.

Zacommituj to, co zainstalowałeś: .claude/settings.json dla wtyczek w zakresie projektu, .agents/skills/, .claude/skills/ i skills-lock.json dla przenośnych skilli. Skill do review działa z uprawnieniami agenta, więc najpierw go przeczytaj; listę kontrolną znajdziesz w bezpieczeństwie łańcucha dostaw skilli.

Jak połączyć review własnej pracy, drugi model i bota na PR?

Dział zatytułowany „Jak połączyć review własnej pracy, drugi model i bota na PR?”

Jeden recenzent łapie to, czego każą mu szukać jego model i prompt. Ten workflow używa trzech recenzentów, którzy mylą się w różny sposób, od najtańszych poprawek.

  1. Review własnej pracy w sesji, w której powstał kod. Uruchom /code-review high (Claude Code) albo /review (Codex) i poprawiaj tylko uwagi, które da się odtworzyć, pierwszym promptem powyżej. W Cursorze uruchom claude w zintegrowanym terminalu i wpisz tam /code-review high albo poproś agenta o review diffa gałęzi względem main tym samym promptem. Jeśli zmiana dotyka uwierzytelniania, pieniędzy albo parsowania, poproś też o „a differential security review of this branch against main”; skill differential-review zapisuje raport w Markdownie, który zachowujesz. Forma polecenia, /differential-review:diff-review, przyjmuje URL PR, SHA commita albo plik z diffem, z --baseline <ref>.

  2. Sprawdź diff względem specyfikacji. Uruchom code-review Pococka z main jako punktem odniesienia (/mattpocock-skills:code-review w Claude Code, $code-review w Codex, „use the code-review skill” w Cursorze). Oś Spec wypisuje brakujące wymagania, zachowania, o które nikt nie prosił, i wymagania, które wyglądają na zrealizowane, ale źle, każde z cytatem ze specyfikacji. Rozwiąż wszystkie uwagi z osi Spec przed otwarciem PR; po merge’u każda z nich to nowe zgłoszenie.

  3. Poproś o zdanie drugi model. Model, który napisał kod, przeglądając własną pracę, ma te same ślepe plamki.

    /codex:review --base main --background
    /codex:status
    /codex:result

    /codex:review działa tylko do odczytu i nie przyjmuje tekstu z kierunkiem review. Żeby zakwestionować konkretną decyzję, użyj /codex:adversarial-review --base main challenge whether the retry logic is safe under partial failure.

  4. Przejdź przez zebrane uwagi z receiving-code-review. Wklej wynik drugiego modelu do sesji, w której powstał kod, razem z promptem poniżej. Agent weryfikuje każde twierdzenie w kodzie, zanim cokolwiek zmieni, i z uzasadnieniem odrzuca błędne.

  5. Otwórz PR i daj go przejrzeć botowi. Bot na PR (Claude Code Review przez @claude review, @codex review, Bugbot albo aplikacja CodeRabbit) przegląda ostateczny diff z kontekstem repozytorium. Zarządzane Code Review od Anthropic to research preview dla planów Team i Enterprise, które według dokumentacji Anthropic „averages $15-25” za jedno review (sprawdzone 2026-09-26); konfigurację każdego bota opisuje strona boty AI do code review.

  6. Daj człowiekowi pakiet dowodów, nie diff. Opis PR wymienia, którzy recenzenci się uruchomili, które uwagi poprawiono razem z odtwarzającym je testem, a które odrzucono i dlaczego. Człowiek przechodzi potem przez triaż z code review PR-a agenta.

W długim planie Superpowers requesting-code-review przenosi krok 1 do środka pętli: po każdym zadaniu subagent-recenzent sprawdza je względem wymagań zadania, a agent poprawia uwagi Critical od razu, a Important przed następnym zadaniem. Zobacz Superpowers.

Skąd wiesz, że agenci-recenzenci łapią prawdziwe błędy?

Dział zatytułowany „Skąd wiesz, że agenci-recenzenci łapią prawdziwe błędy?”

Review, które niczego nie zgłasza, może oznaczać czysty diff albo recenzenta, który nie patrzył. Mierz recenzentów jak zestaw testów: podrzuć defekty i policz, co wróciło.

  • Podrzuć znane błędy. Na gałęzi do wyrzucenia wprowadź trzy defekty takiego rodzaju, z jakiego biorą się twoje incydenty, uruchom każdego recenzenta i zapisz, które wskazał (prompt poniżej to przygotowuje). Powtórz przy każdej zmianie modelu, poziomu effort albo wersji skilla.
  • Śledź los każdej uwagi. Oznacz każdą jako poprawioną, odrzuconą albo nieodtworzoną. Recenzent, którego uwagi są przeważnie odrzucane, kosztuje uwagę ludzi; obniż mu effort albo z niego zrezygnuj.
  • Bramką zostaje CI. Agenci-recenzenci doradzają; decydują testy, sprawdzanie typów, lintery i skanery bezpieczeństwa w CI. Uwaga, która ma znaczenie, staje się testem, więc ten sam błąd nie wróci. Testy trzymaj poza zasięgiem agenta według strony ochrona wyroczni testowej.
  • Sprawdź, czy review w ogóle się odbyło. Szukaj samego raportu: pliku Markdown z differential-review, statusu zakończenia CodeRabbit, wiadomości z uwagami z /code-review. „Brak uwag” bez raportu to nie wynik.

Kto zatwierdza. Developer, który otwiera PR, odpowiada za review własnej pracy i dowody odtworzenia błędów. Tech lead odpowiada za zestaw recenzentów zespołu, poziomy effort i wyniki kalibracji, i zmienia je przez pull request. Merge zatwierdza człowiek; żaden z opisanych tu agentów nie zatwierdza sam.

Skille kosztują w każdej sesji swoją nazwę i opis, a treść dopiero wtedy, gdy się uruchomią; wtyczki mogą kosztować więcej z góry. Pomiar z 2026-09-26:

Co się wczytujeKiedyRozmiar
Wtyczka pr-review-toolkitW każdej sesjiokoło 2033 tokenów (claude plugin details, Claude Code 2.1.283)
Wtyczka mattpocock-skills (wszystkie skille Pococka)W każdej sesjiokoło 1609 tokenów (claude plugin details, Claude Code 2.1.283)
SKILL.md skilla code-review PocockaGdy się uruchomi6589 bajtów
requesting-code-review z Superpowers + jego szablon code-reviewer.mdGdy się uruchomi2977 + 6449 bajtów
SKILL.md skilla receiving-code-review z SuperpowersGdy się uruchomi6203 bajty
SKILL.md skilla code-review od CodeRabbitGdy się uruchomi7518 bajtów
SKILL.md skilla differential-review od Trail of Bits (plus cztery pliki referencyjne otwierane w razie potrzeby)Gdy się uruchomi7439 bajtów (około 33 KB ze wszystkimi referencjami)
review/SKILL.md z gstackaGdy się uruchomiokoło 73 KB

Przy około 3–4 bajtach na token (tokenizery Claude 4.7 i nowszych dają około 30% więcej tokenów dla tego samego tekstu) większość skilli do review kosztuje po uruchomieniu około 1600–3200 tokenów, a skill gstacka około 18 000–24 000. Wbudowane /code-review czyta diff we własnym kontekście subagenta. Instalację sprawdzisz przez claude plugin details PLUGIN_NAME i /context.

Review nic nie znajduje w dużej zmianie. Zwykle cel był zły: gałąź nie miała upstreamu, zmiany były już wypchnięte albo review przeczytało tylko niezacommitowane pliki. Wyjście: podaj gałąź jako cel, na przykład /code-review high feature/rate-limit, i sprawdź, czy wiadomość z uwagami wymienia pliki, których się spodziewasz. Zakres gita nie jest udokumentowaną formą celu w 2.1.283.

Na jedną prośbę reaguje dwóch recenzentów. „Review this” uruchamia naraz kilka skilli do review albo takiego, którego się nie spodziewałeś. Wyjście: wywołuj po dokładnej nazwie, trzymaj jednego ogólnego recenzenta na repozytorium, a pozostałych usuń przez npx skills remove --skill SKILL_NAME albo claude plugin uninstall PLUGIN_NAME.

--fix zmienia więcej, niż się spodziewałeś. Nanosi wszystkie uwagi naraz, także te, których nie udałoby się odtworzyć. Wyjście: git diff, żeby zobaczyć zmiany, git restore albo git revert, żeby je cofnąć, i commit przed każdym --fix.

Agent zgadza się z każdą uwagą. Nanosi błędną sugestię bota z PR i psuje nieprzetestowane zachowanie. Wyjście: przepuszczaj wszystkie uwagi z review przez receiving-code-review drugim promptem powyżej i wymagaj testu, który nie przechodzi, przed każdą poprawką.

Pętla review się nie kończy. Opcjonalna bramka review we wtyczce Codexa działa z hooka Stop i nie pozwala Claude’owi zakończyć, dopóki znajduje problemy; README od OpenAI ostrzega, że „may drain usage limits quickly”. Wyjście: /codex:setup --disable-review-gate (flaga z README openai/codex-plugin-cc, sprawdzone 2026-09-26) i włączanie bramki tylko w sesjach, które obserwujesz.

Review w chmurze jest niedostępne. Na Bedrock, Google Cloud, Foundry albo przy Zero Data Retention /code-review ultra po cichu uruchamia review lokalne. Wyjście: traktuj je jako review lokalne i nie zapisuj go w pakiecie dowodów jako ultrareview.

Wtyczka code-review pomija twój PR. Odrzuca PR zamknięte, szkice, trywialne i już przejrzane, a gdy żadna uwaga nie osiąga 80, nie publikuje niczego. Wyjście: oznacz PR jako gotowy do review albo użyj wbudowanego /code-review, żeby zobaczyć też uwagi mniej pewne.

Konfiguracje dla konkretnych narzędzi opisują strony automatyzacja review w Claude Code, code review w Codex i code review w Cursorze. Szerszy ranking skilli praktyk programistycznych znajdziesz na stronie najczęściej instalowane skille praktyk programistycznych.