Przejdź do głównej zawartości

Superpowers: zdyscyplinowany proces tworzenia oprogramowania z agentami

Superpowers (obra/superpowers, licencja MIT, wersja 6.4.2) to wtyczka z 15 skillami i bootstrapem ładowanym na starcie sesji, która każe agentowi uzgodnić projekt, odizolować pracę w worktree, napisać przejrzany plan, implementować w ścisłym TDD, przejrzeć każde zadanie i pokazać wynik testów przed ogłoszeniem sukcesu. Steruje modelem; egzekwują CI i ludzkie review.

Prosisz agenta o „klucze API na poziomie organizacji z rotacją”, a po 20 minutach agent zmienił 14 plików, wymyślił model uprawnień, o który nikt nie prosił, i twierdzi, że „wszystkie testy przechodzą”, nie pokazując ani jednego uruchomienia. Ta strona jest dla programistów i tech leadów, którzy chcą, żeby agent najpierw pytał, planował jawnie i udowadniał swoje twierdzenia — i którzy muszą wiedzieć, ile ta dyscyplina kosztuje.

  • Polecenia instalacji dla Claude Code, Codex i Cursora oraz 30-sekundowy test, czy bootstrap zadziałał.
  • Którą wersję serwuje każdy marketplace i co różnica 6.4.1 vs 6.4.2 zmienia w planach.
  • Ośmioetapowy workflow i artefakt, który zostawia każdy etap — przeglądasz projekt i plan zamiast każdego diffa.
  • Cztery prompty do skopiowania, koszt w tokenach na wywołanie i tabelę awarii z krokami naprawy.
FaktWartość (odczyt 2026-09-26, chyba że zaznaczono)Źródło
Wersja upstream6.4.2, wydana 2026-09-25plugin.json, release notes
claude-plugins-official Anthropicprzypięty commit to 6.4.1manifest marketplace’u
superpowers-marketplace autora6.4.2claude plugin install w Claude Code 2.1.283, 2026-09-26
Codex openai-curated (openai-api-curated z kluczem API)manifest podaje 6.3.0openai/plugins
Skille15 oraz hook SessionStart, który wstrzykuje using-superpowersclaude plugin details
Stały koszt kontekstu~838 tokenów na sesjęclaude plugin details, Claude Code 2.1.283, 2026-09-26
Popularność1 009 371 instalacji w katalogu wtyczek Claude; 291,7 tys. gwiazdek na GitHubieclaude.com/plugins/superpowers; GitHub, odczyt 2026-09-26

Liczba instalacji obejmuje tylko instalacje Claude Code z katalogu Anthropic, a gwiazdki mierzą zainteresowanie repozytorium, nie realne użycie. Żadna z tych liczb nie mówi, że workflow poprawia twój kod — to zmierzy twój własny pilotaż.

Jak działa Superpowers: skille, bootstrap i adaptery harnessów

Dział zatytułowany „Jak działa Superpowers: skille, bootstrap i adaptery harnessów”

Superpowers ma trzy warstwy, a różnica między nimi tłumaczy większość problemów z instalacją.

  1. Skille. Piętnaście procedur SKILL.md: brainstorming, using-git-worktrees, writing-plans, subagent-driven-development, executing-plans, dispatching-parallel-agents, test-driven-development, systematic-debugging, requesting-code-review, receiving-code-review, verification-before-completion, finishing-a-development-branch, writing-skills, using-superpowers i diagnosing-superpowers.
  2. Bootstrap. using-superpowers każe agentowi sprawdzić, czy pasuje jakiś skill, zanim odpowie, zada pytanie albo dotknie repozytorium. Wtyczka wstrzykuje go na starcie sesji; bez niego skille leżą na dysku i odpalają się tylko wtedy, gdy model akurat po nie sięgnie.
  3. Adaptery harnessów. Manifesty i mapowania narzędzi dla każdego hosta. Claude Code i Cursor używają hooka startu sesji; Codex nie deklaruje żadnych hooków i polega na natywnym wykrywaniu skilli.

Kolejność jest jawna: twoje instrukcje — bezpośrednie polecenia i CLAUDE.md / AGENTS.md — mają pierwszeństwo przed skillami Superpowers, a te przed domyślnym zachowaniem agenta. Jeśli chcesz najpierw poznać skille i wtyczki ogólnie, zacznij od przeglądu ekosystemu i sekcji o wtyczkach.

Instalacja Superpowers w Claude Code, Codex i Cursorze

Dział zatytułowany „Instalacja Superpowers w Claude Code, Codex i Cursorze”

Zainstaluj natywną wtyczkę dla każdego agenta, którego używasz. README mówi wprost, że każdy harness wymaga osobnej instalacji.

W sesji wybierz jeden marketplace:

/plugin install superpowers@claude-plugins-official

Dostajesz wtedy commit przypięty przez Anthropic (6.4.1 na 2026-09-26). Żeby śledzić upstream (6.4.2):

/plugin marketplace add obra/superpowers-marketplace
/plugin install superpowers@superpowers-marketplace

Odpowiedniki w terminalu to claude plugin marketplace add obra/superpowers-marketplace i claude plugin install superpowers@superpowers-marketplace (sprawdzone w Claude Code 2.1.283, 2026-09-26). Skille mają przestrzeń nazw: etap wymusisz przez /superpowers:brainstorming.

README upstreamu opisuje też Antigravity, Devin CLI, Factory Droid, Gemini CLI, GitHub Copilot CLI, Grok Build CLI, Kimi Code, OpenCode, Pi, Qwen Code, Hermes Agent i Muse — kopiuj te polecenia z sekcji instalacji, a nie ze starszych artykułów. O agentach Google pisz „Antigravity CLI (konta prywatne) / Gemini CLI (enterprise, klucz API)”: od 2026-06-18 Gemini CLI nie obsługuje już użytkowników darmowych ani planów Google AI Pro i Ultra, którzy przeszli na Antigravity CLI. Superpowers usunęło Gemini CLI w 6.1.0 i przywróciło w 6.2.0, więc gemini extensions install https://github.com/obra/superpowers znów działa — dla użytkowników Code Assist Standard lub Enterprise, Google Cloud i płatnych kluczy API.

Otwórz nową sesję i wyślij smoke test z README:

Let's make a react todo list

Działająca instalacja uruchamia brainstorming: agent pyta, po co ci ta aplikacja i co ma robić, zanim napisze jakikolwiek kod. Jeśli zaczyna generować szkielet projektu, bootstrap nie jest załadowany. W Claude Code claude plugin list pokazuje zainstalowane wtyczki, a claude plugin details superpowers — 15 skilli, hook SessionStart i stały koszt w tokenach.

Trzy marketplace’y serwowały w tym samym tygodniu trzy wersje. Różnice dotyczą zachowania, nie kosmetyki:

MaszCo zmienia się w praktyce
6.3.0 (Codex openai-curated)Brak diagnosing-superpowers. executing-plans to stara wersja, która co kilka zadań zatrzymuje się, żeby dopytać. Brainstorming już skaluje ceremonię (spike, bounded, architectural). Paczka dostarcza dołączone skrypty bez bitu wykonywalności, więc helpery SDD kończą się Permission denied (naprawione upstream w 6.4.1).
6.4.1 (oficjalny Claude)diagnosing-superpowers; executing-plans przebudowany jako wykonanie Native z jednym review całej gałęzi; musisz przejrzeć zapisany plan, zanim cokolwiek ruszy; plany mają sekcję Review Focus; TDD uruchamia cały zestaw testów projektu. Plany nadal rozpisują pełny kod.
6.4.2 (upstream, marketplace autora)writing-plans zapisuje decyzje — sygnatury, nazwy i asercje testów, wartości ze specyfikacji, polecenie weryfikacji — zamiast pełnego kodu. Zmianę wywołało to, że część modeli frontierowych zaczęła implementować projekt w trakcie „planowania”. Opiekunowie raportują plany w około jednej czwartej czasu i jednej trzeciej tokenów w swoim odtworzeniu (release notes, 2026-09-25).

Jeśli zespół łączy Claude Code i Codex, ten sam prompt może dać plan pełen kodu w jednym narzędziu i plan na poziomie decyzji w drugim. Zapisuj wersję w notatkach z pilotażu, a jeśli chcesz 6.4.2 już teraz, instaluj w Claude Code z marketplace’u autora.

Każdy etap zostawia artefakt, który przeglądasz zamiast diffa. Etapy są takie same w Claude Code, Codeksie i Cursorze; różni się wersja serwowana przez każdy marketplace (patrz wyżej) oraz zagnieżdżony kontroler dostępny tylko w Claude Code.

  1. Brainstorming i klasyfikacja. brainstorming pyta, po co ci zmiana, a potem klasyfikuje ją jako spike, zmianę ograniczoną (bounded) lub pracę architektoniczną. Zmiana ograniczona dostaje krótki projekt w czacie; praca architektoniczna — spisaną specyfikację w docs/superpowers/specs/YYYY-MM-DD-<topic>-design.md. Każda ścieżka zatrzymuje się na twoją akceptację.
  2. Izolacja. using-git-worktrees wykrywa istniejące izolowane środowisko albo tworzy worktree na nowej gałęzi, instaluje zależności i uruchamia testy bazowe. Czerwona baza zatrzymuje pracę i agent pyta, co robić.
  3. Plan. writing-plans zapisuje docs/superpowers/plans/YYYY-MM-DD-<feature-name>.md: pliki per zadanie, interfejsy, asercje testów, polecenie weryfikacji z oczekiwanym wynikiem i listę Review Focus z wejściami, które specyfikacja zakłada, a żaden test jeszcze nie pokrywa. Przeglądasz plan przed wykonaniem.
  4. Wybór trybu wykonania. Po zapisaniu planu skill proponuje dwa tryby wykonania i poleca jeden z nich. Subagent-driven uruchamia świeżego implementera na każde zadanie, a po każdym zadaniu — review (zgodność ze specyfikacją plus jakość kodu). Native (executing-plans) implementuje wszystkie zadania w bieżącej sesji i dostaje jedno review całej gałęzi na końcu — to najtańszy tryb.
  5. Implementacja w TDD. test-driven-development wymaga testu, który pada z właściwego powodu, najmniejszej zmiany, która go przechodzi, i refaktoryzacji. Zielony wynik oznacza przejście całego zestawu testów projektu, a nie tylko nowego pliku testowego.
  6. Review. Review zadania przechodzi do pięciu rund poprawek, zanim kontroler rozstrzygnie. Końcowy recenzent czyta zintegrowaną gałąź.
  7. Weryfikacja. verification-before-completion wymaga faktycznego wyniku testów, builda, type-checka lub lintera przed każdym „gotowe”, „naprawione” czy „przechodzi”.
  8. Zakończenie. finishing-a-development-branch ponownie uruchamia testy i proponuje lokalny merge, push z otwarciem PR albo zachowanie gałęzi. Porzucenie pracy następuje tylko na twoje wyraźne żądanie, z wpisanym potwierdzeniem.

Przykład: klucze API organizacji od mglistej prośby do PR

Dział zatytułowany „Przykład: klucze API organizacji od mglistej prośby do PR”

Prośba brzmi: Add organization-level API keys with rotation and audit history. Zdrowy przebieg wygląda tak:

EtapArtefakt, który powinieneś zobaczyćTwój punkt kontrolny
BrainstormingPytania o własność, widoczność kluczy, unieważnianie, uprawnienia, retencję i migrację; dwa lub trzy projekty z kompromisami; klasyfikacja: architektonicznaZatwierdź zachowanie i model zagrożeń
Specyfikacjadocs/superpowers/specs/2026-09-26-organization-api-keys-design.md, zacommitowanaPrzeczytaj ją: jest krótsza niż kod
IzolacjaWorktree z przechodzącą baząZdecyduj o ewentualnym istniejącym błędzie
PlanZadania: schemat, API, UI, migracja i testy; Review Focus wymienia „unieważniony klucz użyty w trakcie rotacji” i „wpis audytu przy nieudanej rotacji”Zatwierdź zakres; dopisz brakujące przypadki brzegowe
WykonanieNa zadanie: padający test, minimalny kod, przechodzący zestaw, commit, werdykt recenzentaOdpowiadasz tylko na pytania produktowe
Review końcoweUwagi do całej gałęzi, poprawione i ponownie przejrzaneZdecyduj, czy gałąź jest gotowa
WeryfikacjaŚwieży wynik migracji, testów, type-checka, lintera i buildaPorównaj z kryteriami akceptacji
ZakończenieOtwarty PRZwykłe review PR i CI

Wartość nie polega na tym, że agent „zrobił plan”: projekt, plan, dowody z testów i uwagi z review pozostają do wglądu po kompakcji kontekstu czy przekazaniu pracy.

Ostatni prompt wymaga wersji 6.4.1 lub nowszej, w której istnieje diagnosing-superpowers.

Jak zweryfikować wynik Superpowers bez czytania każdej linii

Dział zatytułowany „Jak zweryfikować wynik Superpowers bez czytania każdej linii”

Superpowers przenosi twój wysiłek recenzencki z diffa na trzy krótkie dokumenty i zestaw bramek maszynowych:

  • Przed kodem: zatwierdzasz specyfikację (zachowanie, model zagrożeń, czego nie robimy) i plan (lista zadań, asercje testów, Review Focus). Tu człowiek łapie „zbudowaliśmy nie to, co trzeba”.
  • W trakcie wykonania: każdy commit zadania musi następować po padającym teście, a każde zadanie ma werdykt recenzenta. Sprawdź wyrywkowo dwa lub trzy zadania: test powinien padać na commicie nadrzędnym i przechodzić na commicie zadania.
  • Przed merge’em: wynik weryfikacji, CI na PR i wymagane review w repozytorium. Dodaj bramki, których Superpowers nie zapewnia — progi pokrycia lub testów mutacyjnych i wymagane status checki — żeby pominięty krok TDD kończył się głośną porażką, a nie cichym przejściem. Zobacz pakiet dowodów, który powinien nieść PR i jak przeglądać pull requesty agentów.
  • Akceptacja: programista prowadzący sesję odpowiada za zatwierdzenie specyfikacji i planu; recenzent PR (przy pracy architektonicznej — tech lead) akceptuje dowody, a nie czytanie linia po linii.

Projekcja samego Claude Code (claude plugin details, 2.1.283, 2026-09-26):

KosztTokeny
Stały, w każdej sesji (lista skilli + bootstrap)~838
brainstorming, przy każdym uruchomieniu~6,3 tys.
subagent-driven-development, przy każdym uruchomieniu~11,8 tys. plus świeży kontekst dla każdego implementera i recenzenta

Stały koszt jest niski na tle podobnych frameworków — w tym samym pomiarze Compound Engineering to ~2989, a Everything Claude Code ~41 515. Główny koszt generuje wykonanie planu. Żeby go ograniczyć:

  • Wybieraj wykonanie Native dla planów z małymi, jednorodnymi zadaniami; zużywa jeden kontekst plus jedno review końcowe.
  • W Claude Code poproś, żeby kontroler SDD działał jako zagnieżdżony subagent na modelu średniej klasy; release notes 6.4.1 (2026-09-18) raportują mniej więcej połowę kosztu i czasu, według pomiarów opiekunów. To opcja na żądanie.
  • Pozwól brainstormingowi klasyfikować drobną pracę jako ograniczoną, zamiast wymuszać pełną ścieżkę ze specyfikacją.

Używaj pełnego workflow, gdy wymagania są niejasne, zmiana obejmuje kilka warstw, zachowanie da się przetestować albo praca przejdzie między sesjami lub ludźmi.

Odpuść albo użyj pojedynczych skilli przy poprawkach jednolinijkowych lub mechanicznych, jednorazowych spike’ach, repozytoriach bez test runnera (TDD i weryfikacja dają wtedy ceremonię bez sygnału) albo gdy twój proces ma już mocniejsze bramki. systematic-debugging i verification-before-completion są warte instalacji także osobno; strona o skillach do testowania i debugowania omawia je bez frameworka.

Jeśli potrzebujesz trwałej, żywej specyfikacji zamiast dokumentu projektowego na funkcję, porównaj frameworki spec-driven, takie jak Spec Kit i OpenSpec. Pełny przegląd znajdziesz w porównaniu frameworków.

ObjawPrzyczynaNaprawa
Agent od razu pisze kodBootstrap niezaładowany: przenośna kopia z npx skills add albo zablokowany hookZainstaluj natywną wtyczkę; uruchom smoke test; sprawdź hook SessionStart w claude plugin details superpowers
Skille pojawiają się dwa razyInstalacja z dwóch marketplace’ów albo wtyczka plus npx skills addUsuń jedną kopię na agenta
W jednym narzędziu plany to strony kodu, w drugim są krótkieRozjazd wersji: 6.4.1 lub 6.3.0 vs 6.4.2Wyrównaj wersje; w Claude Code instaluj z superpowers-marketplace
Wykonanie co kilka zadań staje i dopytujeexecuting-plans z Codex 6.3.0Spodziewaj się tego, dopóki openai-curated się nie zaktualizuje, albo wybierz Subagent-driven
Codex: skrypty skilli kończą się Permission deniedPaczka openai-curated 6.3.0 gubi bity wykonywalności (naprawione w 6.4.1)Wywołaj skrypt przez interpreter (bash scripts/<nazwa>.sh) albo poczekaj, aż openai-curated wyda 6.4.1+
Codex prosi o zaufanie hookowi SessionStartPakiet sprzed 6.1.1Zaktualizuj wtyczkę; wersje dla Codex od 6.1.1 nie deklarują hooków
Windows: bootstrap po cichu się nie ładujeCytowanie powłoki w hooku przed 6.2.0Zaktualizuj do 6.2.0+, użyj Claude Code 2.1.81 lub nowszego i zainstaluj Git for Windows
Dwa plany w jednym checkoucie nadpisują sobie stanWspólny .superpowers/sdd/ przed 6.2.0 (ta sama nazwa pliku przed 6.4.1)Zaktualizuj; i tak dawaj każdej równoległej sesji osobny worktree
„Testy przechodzą” bez wynikuPominięta weryfikacjaWklej prompt o dowodach z tej strony; uznaj przebieg za nieudany, dopóki nie pojawi się wynik
Pominięte TDDModel nie zastosował się do skillaUznaj przebieg za nieudany; dodaj bramkę w CI lub review zamiast mocniejszych sformułowań
Usunięcie worktree zgubiłoby plikiNiezacommitowana praca w worktree6.3.0+ zatrzymuje się i wymienia pliki; zacommituj lub schowaj zmiany, nigdy --force
Skill odpalił się lub milczał nieoczekiwanieNiedopasowany wyzwalaczUruchom prompt diagnostyczny z tej strony (6.4.1+) i zgłoś oczyszczony pakiet upstream

Kontrole bezpieczeństwa przed wdrożeniem Superpowers

Dział zatytułowany „Kontrole bezpieczeństwa przed wdrożeniem Superpowers”

Skille to instrukcje, według których działa agent z dostępem do powłoki i sieci, więc przeglądaj je jak kod. Postępuj według bezpieczeństwa łańcucha dostaw skilli, a potem sprawdź szczegóły:

  • Adaptery Claude Code, Cursora i kilku innych hostów uruchamiają hook SessionStart; przeczytaj hooks/ przed instalacją i ponownie przy aktualizacjach.
  • Opcjonalny Visual Companion z brainstormingu to lokalny serwer Node domyślnie nasłuchujący na 127.0.0.1. Uruchomienie go na 0.0.0.0 (nasłuch na wszystkich interfejsach) poszerza granicę zaufania.
  • Companion ładuje logo Prime Radiant z adresu zawierającego wersję Superpowers. Ustaw SUPERPOWERS_DISABLE_TELEMETRY=true, żeby to wyłączyć; respektowane są też DISABLE_TELEMETRY i CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC.
  • Zgłoszenie z 2026-09-10 (#2277) opisuje, że systematic-debugging dostarcza fixtures testów presji napisane jako rozkazujące scenariusze, które trafiają do katalogów uruchomieniowych. Sprawdź, czy twoja wersja wciąż je zawiera.
  • receiving-code-review traktuje komentarze z review jako twierdzenia do sprawdzenia. Zewnętrzne komentarze w PR nadal są niezaufanym wejściem: żaden nie może uruchomić dostępu do sekretów ani niezwiązanych poleceń.

Opiekunowie prowadzą superpowers-evals, laboratorium, które przepuszcza prawdziwe CLI agentów przez scenariusze wyzwalania skilli, TDD, review i weryfikacji. Mierzy ono zgodność z workflow; nieliczne porównania bez wtyczki dotyczą pojedynczych skilli (w 6.4.1 stary stub executing-plans nie wypadł lepiej niż brak wtyczki), a nie całego pakietu, więc nie pokazuje, że pakiet wygrywa z agentem bez niego. Na 2026-09-26 nie było dostępnego niezależnego, kontrolowanego porównania całego frameworka, więc przeprowadź własne.

  1. Wybierz jeden pilotaż. Średnia funkcja z jasnymi kryteriami akceptacji — nie zabawka i nie najbardziej ryzykowna migracja.
  2. Zapisz punkt odniesienia na porównywalnej pracy bez wtyczki: akceptacja za pierwszym podejściem, ręczne poprawki, defekty z review, czas i tokeny.
  3. Przypnij i zapisz wersję Superpowers, marketplace, wersję agenta i model u każdego uczestnika, żeby rozjazd wersji nie wyglądał jak wynik.
  4. Ustal zasady w CLAUDE.md / AGENTS.md: kto zatwierdza specyfikacje i plany, kiedy wolno odstąpić od TDD (praca wizualna, pliki generowane) i które polecenia zawsze wymagają potwierdzenia.
  5. Każdą równoległą sesję uruchamiaj w osobnym worktree, bez sekretów produkcyjnych w środowisku. Zobacz Git worktrees dla równoległych agentów.
  6. Mierz z wtyczką i bez niej. W Claude Code claude plugin eval uruchamia przypadki ewaluacyjne na wtyczce i raportuje różnicę wyniku względem wariantu bez wtyczki. Umieść przypadki (case.yaml albo prompt.md z graders/*.md) w katalogu wewnątrz wtyczki — jako cel wystarczy lokalny klon — i wskaż jego nazwę przez --eval-dir; wariant bazowy bez wtyczki (--ablation with-without) jest włączony domyślnie (Claude Code 2.1.285, sprawdzone 2026-09-26).
  7. Zachowaj, przytnij lub usuń skille po pilotażu i powtarzaj go po każdej dużej aktualizacji modelu, agenta lub wtyczki.