Przejdź do głównej zawartości

Co nowego w AI Developer Toolkit

Changelog AI Developer Toolkit zapisuje dwie rzeczy na jednej osi czasu: co zmieniło się w Cursorze, Claude Code i Codeksie — wydania, premiery modeli, ceny i zmiany łamiące — oraz co pojawiło się w samym przewodniku. Wpisy biegną od najnowszych, od września 2026 wstecz do wydania 1.0.0 z lipca 2025, każdy z datą i numerami wersji.

Krajobraz narzędzi AI zmienia się co tydzień. Pojawiają się nowe modele, przesuwają się ceny, funkcje lądują we wszystkich trzech narzędziach, a dokumentacja, która to tłumaczy, musi się z tym przesuwać. Ta strona jest rejestrem obu rzeczy, więc od razu widać, czy dany przewodnik jest starszy niż wydanie, które opisuje.

  • Ten przewodnik — sekcja AI-native SDLC. Sześcioetapowa sekcja AI-native SDLC: łańcuch artefaktów, plan, projekt, budowa, testy, wdrożenie, utrzymanie, mapa narzędzi i metryki, każdy element odwzorowany na Cursora, Claude Code i Codeksa.
  • Ten przewodnik — zmiana domyślnego podejścia human-in-the-loop. Warstwowy przegląd agentowy plus bramki ludzkie zastąpiły przegląd linia po linii, który jest teraz zarezerwowany dla kodu krytycznego i regulowanego.
  • Ten przewodnik — przebudowane scorecardy. Scorecardy dla deweloperów i CTO mierzą teraz dojrzałość AI-native SDLC, nadal przy 25 pytaniach i 75 punktach.
  • Ten przewodnik — przesunięcie domyślnych modeli. Domyślne ustawienia zmieniono na Claude Fable 5 / Opus 5 / Sonnet 5 / Haiku 4.5, GPT-5.6 Sol/Terra/Luna, Grok 4.6, Gemini 3.8 Flash i Muse Spark 1.3, a plany Cursora zapisano jako Pro $20, Pro+ $60, Ultra $200. Snapshot modeli w dalszej części tej strony nie został zweryfikowany wobec tych nowszych nazw — zanim zacytujesz którekolwiek z nich, przeczytaj tam uwagę.
  • 28 sie · Ten przewodnik — Drabina, sześć darmowych hubów. Dokumentacja jest teraz uporządkowana według poziomu autonomii, a nie wyłącznie według narzędzia. Sześć stron-hubów, wszystkie poza paywallem i wszystkie EN+PL: ladder/index (tabela sześciu poziomów i checklista do samodzielnego umiejscowienia), level-1-2-assisted-paired (gdzie Shapiro umieszcza około 90% deweloperów AI-native i konfiguracja per narzędzie, która stamtąd wyprowadza), level-3-review-diffs (agenci równolegli, worktree, widoki agentów i automatyzacja przeglądu we wszystkich trzech narzędziach, z przepustowością przeglądu nazwaną jako sufit), level-4-write-specs (tryb planowania, /goal, /loop, hooki, TDD, compound engineering i reguły warunków stopu), level-5-run-the-factory (sześć stanowisk — intencja, uprząż, pętla, graf, weryfikacja, wydanie — odwzorowanych komórka po komórce na to, co dokumentują Claude Code, Codex i Cursor, każda komórka z linkiem i datą) oraz the-humans-job (gust, architektura, kierunek produktu, projektowanie evali i warunków stopu, uprawnienia oraz pętle dyskwalifikujące, które nie mogą działać bez nadzoru). Grupa Drabina otwiera teraz sidebar, napisana ręcznie zamiast generowana, żeby kolejność biegła od poziomu 0 do 5; żaden artykuł się nie przeniósł i żaden URL się nie zmienił (#371).
  • 28 sie · Ten przewodnik — Routines. Artykuł zapełniający lukę: materiał o poziomie 5 opierał się na nienadzorowanych sesjach chmurowych Claude Code, a przewodnik nie dokumentował ich nigdzie. Obejmuje wszystkie trzy typy wyzwalaczy (harmonogram, API, GitHub), /schedule, regułę, że routine pushuje na gałąź claude/, a nie na domyślną, ograniczanie środowisk i konektorów, do których routine może sięgnąć, dzienny limit oraz opakowanie w tekst niezaufany, przez które musi przejść payload wyzwalacza, zanim przeczyta go agent. EN+PL (#371).
  • 28 sie · Ten przewodnik — Cloud Agents i Automations. Drugi artykuł zapełniający lukę i kolumna Cursora w macierzy poziomu 5: agenci chmurowi na izolowanych maszynach wirtualnych, konfiguracja Builds i Dockerfile, uruchamianie agenta bez otwartego repozytorium, pełna lista wyzwalaczy Automations (harmonogram, GitHub, GitLab, Bitbucket, Slack, webhook, Linear, Sentry, PagerDuty), subskrypcje zdarzeń i subagenci, API Cloud Agents z webhookami oraz agenci Bugbot, Security i Approval odczytani jako stanowisko weryfikacji. EN+PL (#371).
  • 28 sie · Ten przewodnik — Stan inżynierii agentowej, sierpień 2026. Artykuł badawczy stojący za nowym kręgosłupem serwisu, darmowy i bez konta: dowody zewnętrzne z wydawcą i datą na to, ile kodu produkcyjnego piszą agenci w 2026 (udział scalonego kodu u Anthropic, pull requesty pisane przez agentów w Stripe, badanie wdrożeniowe Microsoftu), sześć poziomów Dana Shapiro od wspomaganego kodowania po ciemną fabrykę, sześć stanowisk fabryki oprogramowania odwzorowanych na Claude Code, Codeksa i Cursora, kontrdowody (METR, Faros) potraktowane tym samym rygorem źródłowym oraz to, co zostaje po stronie człowieka. Trzy prompty do skopiowania umieszczają repozytorium na drabinie. EN+PL (#369).
  • 24 sie · Ten przewodnik — compound engineering. Pętla Every (plan, praca, przegląd, kompoundowanie) jako przewodnik cross-tool, plus audyt stojącej za nią wtyczki: opublikowany przewodnik na every.to wymienia 26 agentów, 23 komendy i 13 skilli — jego własne drzewo katalogów mówi w tym samym dokumencie o 14 — podczas gdy agents/ i commands/ zwracają 404, a repozytorium wydaje 33 skille, 27 person recenzenckich należących do ce-code-review i 14 hostów agentów; podany URL marketplace’u przekierowuje po zmianie nazwy. Do tego pięciostopniowa drabina adopcji, trzy różne podziały czasu, które Every publikuje dla jednej pętli, dlaczego /lfg nie scala oraz argument, którego prawie nikt nie podnosi — krok kompoundowania w opisie z przewodnika zapisuje do CLAUDE.md, czyli do zawsze ładowanej konfiguracji, którą Gloaguen i inni mierzą jako netto szkodliwą, czego wydana wtyczka unika, czyniąc docs/solutions/ katalogiem pobieranym na żądanie. Cztery prompty do skopiowania uruchamiają pętlę bez instalowania czegokolwiek; zweryfikowane wobec wtyczki v3.23.3. EN+PL (#337).
  • 20 sie · Ten przewodnik — serwer MCP AI Developer Toolkit. Serwis odpowiada na wywołania MCP pod https://developertoolkit.ai/mcp: publiczny, nieuwierzytelniony endpoint tylko do odczytu, niosący dwa narzędzia, których szukają konektory ChatGPT i Claude — search po każdym przewodniku w serwisie i fetch po pełny markdown jednego artykułu. Przewodnik obejmuje jednoliniową konfigurację dla Cursora, Claude Code i Codeksa, kontrakt odpowiedzi, dzięki któremu cytowania konektora się rozwiązują, powód, dla którego polskie zapytanie zwraca polskie artykuły bez parametru języka, oraz to, czego endpoint nie robi. EN+PL (#319).
  • 19 sie · Ten przewodnik — skille anty-slop. Pogłębione omówienie theclaymethod/unslop i bartekpucek/miodkuj: trzy deterministyczne skanery w Pythonie działające w CI bez agenta w pętli, mechanika progresywnego ujawniania, dzięki której skill wydaje katalog reguł o wadze 50 KB przy około 100 tokenach stałego kosztu, pętla utrzymaniowa oparta na evalach oraz ustalenie, które odróżnia unslop od reszty kategorii — jego własny podstawowy benchmark odnotowuje no-ship, podczas gdy najczęściej gwiazdkowany skill w gatunku, mający ponad 36 500 gwiazdek, nie wydaje żadnego zestawu evali. miodkuj obejmuje polskie sygnały, do których nie sięga żadna angielska lista słów (urzędowość, nominalizacje, bezosobowa mgła, łańcuchy dopełniaczowe) i stawia na odwrotną architekturę, odmawiając deterministycznego lintera, bo lista dopasowań nie rozstrzyga kontekstu. EN+PL (#323).
  • 13 sie · Ten przewodnik — obsługa /goal i /loop ponownie zweryfikowana i poprawiona. Oba przewodniki o uruchomieniach autonomicznych twierdziły, że /loop jest natywny tylko dla Claude Code, a /goal w Codeksie jest eksperymentalny i trzeba go włączyć. Oba twierdzenia były nieaktualne: Cursor 3.5 wydał skill /loop 20 maja 2026 (miesiąc przed napisaniem artykułu), a Codex CLI 0.133.0 uczynił cele stabilnymi i włączonymi domyślnie 21 maja 2026. Sprawdzone ponownie wobec Claude Code 2.1.231 i Codex CLI 0.145, a nie wobec zbuforowanych zrzutów dokumentacji, które kończą się na 2.1.37 i lutym 2026. Dołożono też zachowania /loop, które narosły od tamtej pory — regułę z v2.1.196, że zaplanowane odpalenie uruchamia tylko skille samowywoływalne, ScheduleWakeup stop: true w v2.1.202, fallback na stały interwał u dostawcy chmurowego, jitter i limit 50 zadań — plus /goal edit w Codeksie oraz nowe wiersze parytetu w macierzy funkcji i referencji komend. EN+PL.
  • 12 sie · Ten przewodnik — fabryki oprogramowania. Czym jest fabryka oprogramowania, dlaczego Dex Horthy („Why Software Factories Fail”) i PostHog („Can software factories actually work?”) mają obaj rację i nie spierają się o to samo, jaki sufit mierzy SlopCodeBench (erozja strukturalna rosnąca w 77% trajektorii, kod agentowy 2,3x bardziej rozwlekły i 2,0x bardziej zerodowany niż kod ludzki), jaka rana jest samozadana poniżej tego sufitu — pipeline’y, które rozdzielają „decyduj” od „buduj” i wręczają agentowi ticket odarty z kontekstu produkcyjnego — oraz jak dawkować autonomię pętla po pętli wobec wyroczni weryfikacyjnej. Telemetria Faros AI z 2026 podaje liczby dla tygodnia, w którym sześciu agentów produkuje czterdzieści pull requestów: mediana czasu do pierwszego przeglądu w górę o 156,6%, scalenia całkiem bez przeglądu w górę o 31,3%. EN+PL (#257).
  • 12 sie · Ten przewodnik — Dr. Skill. Pełny przewodnik po dbreunig/drskill, diagnostycznym CLI tylko do odczytu badającym loadout: stojące za nim badania nad zestawami narzędzi (celność routingu załamująca się powyżej 30 narzędzi, agent enterprise z 600 skillami), 34 kontrole pogrupowane w higienę skilli, jakość opisów, powierzchnie wstrzyknięć i konfigurację MCP, drskill audit czytający ślady sesji, które Twoi agenci i tak zapisują, bramka CI z rejestrem potwierdzeń opartym na odciskach, ekspozycja komend shellowych w momencie wywołania oraz ograniczenia sprawiające, że czysty skan to mniej niż czysty loadout; zweryfikowane wobec wersji 0.6.7, podlinkowane z indeksu ekosystemu skilli, bezpieczeństwa skilli, najlepszych praktyk i referencji CLI. EN+PL.
  • 6 sie · Ten przewodnik — przepisanie korpusu pod odpowiedź na starcie. Każdy artykuł niebędący indeksem zaczyna się teraz samodzielnym akapitem, który odpowiada na własny tytuł przed jakimkolwiek wstępem; szablonowe nagłówki niemówiące niczego zostały usunięte, frontmatter faq i contentType dodano tam, gdzie ma zastosowanie, a regułę awansowano do bramki build, żeby regres łamał build, a nie wychodził po cichu (#214-#225).
  • 4 sie · Ten przewodnik — protokół ablacji dla plików kontekstu. Przycinanie CLAUDE.md, .cursor/rules i AGENTS.md jako budżetu do cięcia, a nie logu do rozrastania: datowana mapa tego, dlaczego przewodniki przeczą sobie nawzajem, co każde narzędzie faktycznie ładuje i kiedy (łącznie z cichym obcięciem do 32 KiB w Codeksie), tablica routingu dla wszystkich pięciu miejsc, w których może żyć reguła, dziewięć promptów, które tną, i zaobserwowane potknięcia; trzy poprawki merytoryczne dołożono po scaleniu. EN+PL (#212, #213).

Lipiec zresetował punkt odniesienia w całym stosie: Anthropic zamknął miesiąc Claude Opus 5, OpenAI wypuściło rodzinę GPT-5.6 i wprowadziło Codeksa do desktopowego ChatGPT, Cursor wydał 3.11 plus Grok 4.5, a Claude Code dodał Sonneta 5, a potem Opusa 5 do routingu modeli zależnego od konta i dostawcy, wzmacniając przy tym zawsze działający runtime agentów w tle.

  • 30 lip · Ten przewodnik — herdr. Multiplekser agentów, który klasyfikuje każdy panel jako idle, working albo blocked: jak naprawdę działa wykrywanie stanu, sesje przeżywające zamknięty laptop, CLI herdr agent i API gniazda pod TUI, wzorzec orkiestratora, w którym jeden agent powołuje i nadzoruje resztę floty, oraz miejsca, w których floty herdr się rozsypują. Terminal Moshi na iPhone’a i iPada dodano do sekcji o dostępie mobilnym krótko potem, z zawężeniem deklaracji „no relay” do hostingu, a nie do lokalności danych. EN+PL (#196, #205, #206).
  • 30 lip · Ten przewodnik — tmux dla flot agentów. Do czego tmux nadal służy teraz, gdy Claude Code, Cursor i Codex same tworzą i sprzątają swoje worktree, co stawia każdy przewodnik typu „pętla po git worktree add” o warstwę za nisko: sesja na zadanie, send-keys jako kanał agent-agent, odpytywanie przez capture-pane, bariery wait-for i hooki raportujące dokładny stan zamiast zgrywania ekranu. EN+PL (#196).
  • 30 lip · Ten przewodnik — alternatywne IDE i powłoki dla agentów. Przegląd powłok, w których można uruchomić Claude Code, Codeksa i Cursor Agent — Zed i JetBrains po ACP, herdr, Conductor, Nimbalyst, Emdash, Sculptor, Warp — posortowanych w cztery kształty, z jedną regułą kwalifikacji (czy to uruchamia Twojego agenta?), tabelą decyzyjną, terminalową bazą do sprawdzenia przed kupnem czegokolwiek i zmianami w repo, które czynią agentów równoległych znośnymi. EN+PL (#195).
  • 27 lip · Ten przewodnik — Claude Opus 5 przeciągnięty przez 187 plików. Nowe sekcje o Opusie 5 w dodatku z porównaniem modeli i w przewodniku wyboru modelu dla Cursora, dwie zmiany łamiące w API, Claude Code v2.1.219 i routing fallbacku według kategorii, odświeżony snapshot Artificial Analysis oraz Opus 4.8 przedstawiony jako poprzednia warstwa i cel fallbacku przy odmowach cyberbezpieczeństwa. Przy okazji poprawiono trzy twierdzenia, które zdezaktualizowały się niezależnie: dostęp planowy do Fable 5, próg cenowy Gemini 3.1 Pro powyżej 200K oraz domyślny poziom wysiłku Opusa 4.8. Twierdzenia o modelach, cenach, kontekście, wysiłku i routingu fallbacku sprawdzono ponownie wobec przeglądu modeli Anthropic, strony cennika, dokumentacji konfiguracji modeli Claude Code i analizy Opusa 5 w Artificial Analysis. EN+PL.
  • 24 lip · Anthropic — Claude Opus 5. Nowy domyślny Opus w cenie Opusa 4.8 ($5/$25 za 1M tokenów), połowa ceny Fable 5. Prowadzi w Artificial Analysis Intelligence Index, ma odcięcie wiedzy na maju 2026 i wymaga Claude Code v2.1.219+. Dwie zmiany łamiące w API: myślenie jest włączone domyślnie, a jego wyłączenie jest ograniczone do poziomu wysiłku high. v2.1.219 dodaje też fallback według kategorii — żądania oflagowane jako cyberbezpieczeństwo są ponawiane na Opusie 4.8, a żądania Opusa 5 oflagowane jako biologia kończą się odmową.
  • 25 lip · Ten przewodnik — Mobbin MCP. Poproś agenta o paywall, a dostaniesz statystyczną średnią wszystkich paywalli z jego danych treningowych. Mobbin MCP podłącza go zamiast tego do ponad 620 000 ekranów i 130 000 ścieżek użytkownika zebranych z wydanych produktów iOS i webowych: trzy narzędzia wyszukiwania, konfiguracja w Cursorze, Claude Code i Codeksie, wzorce zapytań, które faktycznie coś zwracają, zarządzanie kosztem kontekstu, podział MCP kontra REST API oraz inne serwery z referencjami projektowymi, w tym Refero. EN+PL (#183).
  • 25 lip · Ten przewodnik — Impeccable przebudowany pod v4. Pogłębione omówienie rozszerzono około 2,5x i zweryfikowano ponownie wobec v4.0.2: rozdawanie kierunku ze 188 ręcznie zatwierdzonych światów, pięć testów kierunku, tablica systemowa plus makieta pierwszej powierzchni przed kodem, cztery tryby odwiedzin, przegrupowanie komend w sześć intencji z referencją komenda po komendzie dla wszystkich 23 komend (craft wycofany na rzecz konwersacyjnej klasyfikacji zadań), workflow Live Mode z pinezkami, pociągnięciami i trzema wariantami, nakładka krytyki, hooki projektowe z raportowaniem dwubiegowym, kontrole świeżości w doctor, natywna alfa na iOS i Androida oraz katalog detektora na 64 wzorcach i 59 egzekwowanych regułach, w górę z 44. EN+PL.
  • 21 lip · Ten przewodnik — Taste Skill. Pogłębione omówienie Leonxlnx/taste-skill (~65 tys. gwiazdek), anty-slopowej biblioteki skilli frontendowych: jak ogranicza generowanie z góry (wnioskowanie briefu, trzy pokrętła, mapa design systemu, twarda lista zakazów, kontrola przed startem), wszystkie 13 wariantów estetycznych z nazwami instalacyjnymi, instalacja per agent, uczciwe granice zastosowania oraz sposób łączenia z Impeccable i pipeline’em projektowym; zweryfikowane wobec upstreamowej v2. EN+PL (#170).
  • 20 lip · Ten przewodnik — changelogi narzędzi odświeżone do 19 lipca. Claude Code v2.1.208-215, Codex v0.144.2-0.144.6, aktualizacja Cursor-w-Slacku z 17 lipca oraz doprecyzowanie, że ~272K roboczego kontekstu GPT-5.6 w Codeksie to nie ta sama liczba co jego 1.05M kontekstu API. Wcześniejsze twierdzenia o changelogach narzędzi i statusie przejęcia zweryfikowano wobec źródeł tego samego dnia.
  • 14-19 lip · Claude Code 2.1.208-2.1.215, Codex CLI 0.144.6, linia Cursor 3.11. Claude Code przestał automatycznie uruchamiać /verify i /code-review i uczynił z nich jawne skille, dodał narzędzie EndConversation, /fork do sesji w tle, tryb czytnika ekranu i wzmocnienie uprawnień PowerShella na Windowsie. Codex CLI 0.144.6 zaostrzył wykrywanie niebezpiecznych komend i skorygował GPT-5.6 Sol/Terra/Luna do 272K roboczego kontekstu. Cursor dodał wielorepozytoryjne środowiska w Slacku i plan-before-start 17 lipca.
  • 11 lip · Ten przewodnik — Superpowers. Pogłębione omówienie obra/superpowers: jak wtyczka z 14 skillami zamienia burzę mózgów, worktree, wykonywalne plany, TDD, przegląd przez subagenta i świeżą weryfikację w jeden egzekwowany workflow od projektu do PR-a, ze wszystkimi dziesięcioma celami instalacji, dowodami, bezpieczeństwem i uczciwymi ograniczeniami; zweryfikowane wobec upstreamowej v6.1.1, podlinkowane z ekosystemu skilli, podstawowej metodyki i przewodnika po scorecardzie. EN+PL (#159).
  • 11 lip · Ten przewodnik — GPT-5.6, Sonnet 5 i Grok 4.5 dodane w przewodnikach modeli, cenach i routingu. Do tego Claude Code v2.1.185-207, Cursor 3.8-3.11 (/automate, subagenci chmurowi, iOS, zespołowe marketplace’y MCP, boczne czaty) i Codex v0.142-0.144.1. GPT-5.5 usunięto z bieżących ustawień domyślnych i zastąpiono wskazówkami rolowymi dla GPT-5.6 Sol/Terra/Luna. Dokumentacja zaczęła też odróżniać oczekujące przejęcie Cursora przez SpaceX od nieprawdziwego twierdzenia, że xAI już go kupił, wyjaśniać, dlaczego Grok 4.5 nie zastępuje Composera 2.5, i oddzielać deklaracje dostawców od bieżących wyników Artificial Analysis v4.1/v1.1.
  • 9 lip · OpenAI — GPT-5.6 Sol, Terra i Luna. Sol jest modelem flagowym, Terra równoważy możliwości i koszt, a Luna celuje w pracę o dużym wolumenie. Wszystkie obsługują maksymalne rozumowanie; API dodaje utrwalone rozumowanie, jawne cache’owanie, Programmatic Tool Calling i betę wieloagentową.
  • 9 lip · OpenAI — Codex trafia do desktopowego ChatGPT, CLI 0.144.1. Codex jest zintegrowany z aplikacją desktopową ChatGPT z edycją inline, przeglądem PR-ów i projektami wielorepozytoryjnymi. CLI 0.143-0.144 dodaje zdalne wtyczki domyślnie, GPT-5.6 na Bedrocku, zatwierdzenia tylko dla zapisów i interaktywne uwierzytelnianie MCP.
  • 8-10 lip · Cursor — 3.11 i Grok 4.5. Trenowany wspólnie ze SpaceXAI Grok 4.5 ląduje na desktopie, w webie, na iOS, w CLI i SDK, nie zastępując mniejszego Composera 2.5. Cursor 3.11 dodaje trwałe boczne czaty, wyszukiwanie w transkrypcie, przeprojektowane selektory projektów i hooki chmurowe na poziomie rozmowy.
  • 3 lip · Ten przewodnik — „Co Claude Code potrafi, a czego jeszcze nie próbowałeś”. Około 40 niedocenianych funkcji Claude Code z prelekcji Gui Ferreiry na NDC AI 2026, pogrupowanych w konfigurację jednorazową, codzienną pętlę, rozszerzalność i pracę poza kodem; każda komenda zweryfikowana wobec aktualnej dokumentacji. EN+PL (#146).
  • 1 lip · Anthropic — Claude Fable 5 przywrócony globalnie, z rozliczeniem ustalonym 20 lipca: na stałe wliczony w Max i Team Premium do 50% tygodniowych limitów użycia, a Pro i Team Standard korzystają z kredytów. Warstwa o najwyższych możliwościach pozostaje jawnym wyborem, nigdy automatycznym ustawieniem konta.
  • Claude Code 2.1.185-2.1.207 · Anthropic. Claude Sonnet 5 stał się domyślny na standardowych miejscach subskrypcyjnych Anthropic; wybrane konta premium i z bezpośrednim API domyślnie używają Opusa 4.8, a ustawienia domyślne w chmurach zarządzanych różnią się. Wydania czynią agentów w tle trwałymi między restartami i dodają uwierzytelnianie MCP z CLI, kontrolę poświadczeń w sandboxie, skalowanie dynamicznych workflow, warstwowane skille, routines, bieżące kontrolki /effort oraz /doctor, który zarówno diagnozuje, jak i naprawia.

Wyścig o pracę autonomiczną nie zwolnił: Cursor wepchnął Design Mode do przeglądarki i na kanwy, Claude Code zamknął sprawę ultracode jako słowa kluczowego dla dynamicznych workflow, Codex wydał parowanie kontrolera dla flot bezgłowych, a Anthropic wydał Claude Fable 5, nową warstwę modeli ponad Opusem.

  • 24 cze · Ten przewodnik — /grill-me i /grill-with-docs. Dwa z najczęściej instalowanych skilli Matta Pococka: bezlitosny wywiad agenta po jednym pytaniu naraz, który rozstrzyga każdą gałąź planu, zanim zaczniesz budować, a w wariancie z dokumentacją także język ubikwitalny (CONTEXT.md) i ADR-y pisane na bieżąco. Podlinkowane z trybu planowania i ekosystemu skilli. EN+PL.
  • 24 cze · Ten przewodnik — /goal i /loop oraz dwa pogłębione omówienia skilli. Cross-toolowe pokrycie uruchomień agentowych sterowanych celem i pętlą, z uczciwie zmapowanymi lukami w każdym narzędziu (obsługa poprawiona 13 sierpnia). Obok nich omówienia shadcn/improve — audytu architektury, który pisze plany dla tańszych wykonawców — oraz Impeccable, słownika projektowego wyłapującego AI slop; oba zweryfikowane w Claude Code, Cursorze i Codeksie. EN+PL (#129).
  • 18 cze · Anthropic — Claude Code Artifacts (beta). Zamień sesję Claude Code w interaktywną stronę — omówienie PR-a albo żywy dashboard — udostępnianą prywatnym linkiem. Beta na Team i Enterprise.
  • 18 cze · Cursor 3.8 — /automate. Opisz automatyzację zwykłym językiem, a agent podłączy wyzwalacze, instrukcje i narzędzia. Plus wyzwalacz emoji w Slacku i pięć nowych wyzwalaczy GitHuba.
  • 18 cze · Codex v0.141 i Record & Replay. Szyfrowane kanały przekaźnikowe Noise dla zdalnych wykonawców i serwery MCP wykonawcy per wątek; Record & Replay w aplikacji Codex zamienia zademonstrowany workflow w edytowalny skill.
  • 18 cze · Ten przewodnik — changelogi narzędzi odświeżone do 18 czerwca. Claude Code v2.1.183 (Artifacts, zagnieżdżeni subagenci, niejawne zespoły agentów), Cursor 3.8 i Codex v0.141.
  • 17 cze · Cursor — subagenci chmurowi (/in-cloud, /babysit). Powołuj subagentów chmurowych na izolowanych maszynach wirtualnych, każ im zdalnie przygotowywać PR-y i postaw chmurowe środowisko deweloperskie w mniej niż 10 minut.
  • 16 cze · Cursor — SpaceX podpisuje umowę przejęcia Anysphere. Rozliczenie w akcjach przy implikowanej wycenie kapitału na 60 mld USD. Transakcja pozostawała zależna od zgód regulacyjnych i warunków zamknięcia, z oczekiwanym zakończeniem w III kwartale 2026.
  • 10 cze · Ten przewodnik — Claude Fable 5 opisany w całym serwisie. Porównanie modeli, strategie routingu, ceny i changelog Claude Code v2.1.169-170 (--safe-mode, /cd, Fable 5).
  • 9 cze · Anthropic — Claude Fable 5, nowa warstwa ponad Opusem. Model klasy Mythos przygotowany do bezpiecznego użytku ogólnego; w Claude Code od v2.1.170 (/model fable) i w selektorze modeli Cursora. $10/$50 za 1M tokenów.
  • 8 cze · Ten przewodnik — przegląd changelogów i 11 nowych oficjalnych wydawców skilli. Claude Code v2.1.156-168, Cursor 3.6-3.7, Codex potwierdzony jako aktualny na v0.137 oraz OpenAI, Google Gemini, LangChain, Vercel, Prisma, Convex, Deepgram, Box, Contentful, Contentstack i Base dodani do przewodnika po oficjalnych skillach. Hub z notatkami wydań i tracker aktualizacji odświeżono o czerwcowe pokrycie modeli i wersji.
  • 6 cze · Claude Code v2.1.166 — modele zapasowe. Skonfiguruj do trzech fallbackModelów próbowanych po kolei, gdy główny jest przeciążony, wzorce glob w regułach odmowy (* odmawia wszystkich narzędzi) i wzmocnioną komunikację międzysesyjną.
  • 4-5 cze · Cursor 3.7 — Canvas Design Mode. Design Mode działa teraz w przeglądarce i wewnątrz kanw: wielokrotne zaznaczanie elementów, narracja głosowa w trakcie pracy agenta, interaktywny raport zużycia kontekstu i pełnoekranowe kanwy współdzielone. Cursor Organizations dla Enterprise pojawiły się 3 czerwca.
  • 4 cze · Cursor SDK — własne narzędzia i auto-review. Udostępnij lokalnemu agentowi własne funkcje przez local.customTools, przepuść bezgłowe wywołania narzędzi przez klasyfikator auto-review, wybierz magazyn JSONL albo SQLite i zagnieżdżaj subagentów na dowolną głębokość.
  • 4 cze · Codex v0.137 — parowanie kontrolera, równoległe wyszukiwanie w sieci. Klienci codex remote-control mogą inicjować parowanie i zarządzać przyznaniami kontrolera; plugin list zyskuje wyjście JSON; samodzielne wyszukiwania w sieci biegną równolegle. v0.136 dodał sesje /archive.
  • 2 cze · Claude Code v2.1.160 — ultracode jest słowem kluczowym workflow. Wyzwalacz dynamicznych workflow zmieniono z workflow na ultracode, podświetlany na fioletowo; wpisanie „workflow” nie uruchamia już przebiegu, choć poproszenie własnymi słowami nadal działa. v2.1.156-158 dodały automatyczne ładowanie wtyczek z .claude/skills i tryb auto na Bedrocku, Vertexie i Foundry.
  • Claude Code v2.1.172-183 · Anthropic. Zagnieżdżeni subagenci do 5 poziomów wgłąb, niejawne zespoły agentów (TeamCreate/TeamDelete usunięte), reguły uprawnień z zakresem na parametr i zabezpieczenia trybu auto przed destrukcyjnymi komendami gita i terraforma.
  • Ten przewodnik — przewodniki o koszcie tokenów MCP i bezpieczeństwie skilli. Redukcja kosztu tokenów MCP przez wykonywanie kodu oraz bezpieczeństwo łańcucha dostaw skilli (SkillSpector), a do tego pokrycie Chrome DevTools MCP i aktualizacje promptowania oparte na badaniach.

Przełomowy miesiąc: Anthropic wydał Claude Opus 4.8 i dynamiczne workflow, a wszystkie trzy narzędzia dopełniły swoje pierwszoklasowe prymitywy pracy autonomicznej w odstępie kilku tygodni.

  • 29 maj · Cursor 3.6 — Auto-review Run Mode. Tryb pracy, który działa dłużej przy mniejszej liczbie promptów: wywołania z listy dozwolonych idą od razu, wywołania dające się osadzić w sandboxie trafiają do sandboxa, a reszta do subagenta-klasyfikatora.
  • 28 maj · Anthropic — Claude Opus 4.8 i dynamiczne workflow. Nowy model flagowy, około czterokrotnie rzadziej niż Opus 4.7 pozostawiający nieoflagowane wady w kodzie, plus dynamiczne workflow (research preview, v2.1.154+) orkiestrujące od dziesiątek po setki subagentów ze skryptu — do 1000 — oraz ultracode, żeby Claude sam decydował, kiedy taki przebieg uruchomić. Do tego /workflows, tryb szybki 2x i 2,5x oraz oszczędny systemowy prompt domyślnie.
  • 28 maj · Ten przewodnik — odświeżenie changelogów i modeli. Opus 4.8 i dynamiczne workflow, Cursor 3.3-3.5 i Composer 2.5, Codex CLI 0.131-0.135; odniesienia do modeli ujednolicone w całym serwisie.
  • 21 maj · Codex v0.133 — cele włączone domyślnie. Utrwalone cele przechodzą z flagi funkcji do stanu stabilnego i włączonego domyślnie, wsparte dedykowanym magazynem śledzącym postęp między aktywnymi turami.
  • 21 maj · Ten przewodnik — przewodniki wdrożeniowe do poszczególnych pytań ze scorecardów dla deweloperów i CTO (#40).
  • 20 maj · Cursor 3.5 — skill /loop, kanwy współdzielone. /loop uruchamia prompt według lokalnego harmonogramu aż do osiągnięcia rezultatu, sam wyznaczając tempo, gdy nie podano interwału. Automations przenoszą się do Agents Window, zyskując formy wielorepozytoryjne i bezrepozytoryjne.
  • 14 maj · Ten przewodnik — pokrycie recenzentów CI. Claude Code Action, Codex i Sentry Seer wymienione w badaniu dojrzałości AI (#29).
  • 11 maj · Claude Code v2.1.139 — /goal i widok agentów. /goal ustawia weryfikowalny stan końcowy, a Claude pracuje tura po turze, aż zostanie osiągnięty; claude agents to nowy dashboard każdej sesji w tle.
  • 11 maj · Cursor w Microsoft Teams. Wspomnij @Cursor na dowolnym kanale Teams, żeby zlecić pracę agentom chmurowym, z automatycznym wyborem repozytorium i modelu z kontekstu promptu.
  • 9 maj · Ten przewodnik — dwujęzyczne scorecardy dla deweloperów i CTO z analizą Gemini (#17).
  • 8 maj · Codex v0.130 — współdzielenie wtyczek, remote-control. codex remote-control do orkiestracji bezgłowej, współdzielenie wtyczek z metadanymi linku i odkrywalnością, logowanie do konsoli AWS Bedrock i wielośrodowiskowy view_image.
  • 7 maj · Cursor 3.3 — przegląd PR-ów, Build in Parallel. Przeprojektowany przegląd PR-ów (zakładki Reviews/Commits/Changes), szybka akcja Build in Parallel, dzielenie zmian na PR-y i przypięte pigułki szybkich akcji. Bugbot przechodzi na rozliczenie według użycia.
  • 7 maj · Codex v0.129 — /vim, przeglądarka /hooks. Modalna edycja w stylu Vima w kompozytorze, przeprojektowany selektor wznawiania i forkowania, linia statusu świadoma motywu oraz przeglądarka /hooks z wykonaniem przed i po kompaktowaniu.
  • Maj 2026 · Claude Code — pięciogodzinne limity użycia podwojone dla Pro, Max, Team i Enterprise, żeby udźwignąć nowe długo działające workflow agentowe.
  • Claude Code v2.1.144-154 · Anthropic. /resume dla sesji w tle i claude agents --json; /simplify i /code-review stają się odrębnymi komendami w bieżącym zestawie.
  • Codex CLI v0.131-0.135 · OpenAI. codex doctor, cele włączone domyślnie, wyszukiwanie w historii, ujednolicenie --profile i codex remote-control na pierwszym planie. GPT-5.5 był wtedy modelem domyślnym.
  • Cursor 3.3-3.5 i Composer 2.5. Przegląd PR-ów, Build in Parallel, pełnoekranowe zakładki, Composer 2.5 po $0,50/$2,50 (wariant szybki $3/$15), integracja z Jirą, kanwy współdzielone i Automations w Agents Window.
  • 30 kwi · Ten przewodnik — czteroetapowy pipeline projektowy AI, sekcja EN+PL (#6).
  • 30 kwi · Codex v0.128 — trwały /goal, profile uprawnień. Trwałe workflow /goal przeżywające --resume, wbudowane profile uprawnień, instalacja z marketplace’u wtyczek i jawny MultiAgentV2.
  • 24 kwi · Cursor 3.2 — /multitask. Asynchroniczni subagenci działający równolegle zamiast w kolejce, plus wielokorzeniowe przestrzenie robocze do sesji agentowych między repozytoriami w jednej rozmowie.
  • 24 kwi · Ten przewodnik — odświeżenie changelogów, identyfikatorów modeli i treści lekcji na kwiecień 2026.
  • 5 kwi · Ten przewodnik — udokumentowane Cursor 3.0, Claude Code v2.1.84-92 i aktualizacje desktopu oraz CLI Codeksa, GPT-5.4 zapisany jako domyślny model Codeksa na powierzchniach IDE i Cloud, a skille Wondel.ai udokumentowane w całym ekosystemie skilli.
  • 4 kwi · Ten przewodnik — Oficjalne Skille ze strony dokumentacji Technology Makers, EN+PL.
  • Cursor 3.0 — Agents Window i Design Mode. Zasadnicze przejście z forka VS Code do przestrzeni roboczej zbudowanej pod agentów. Agents Window to wielorepozytoryjny interfejs do prowadzenia równoległych agentów w różnych środowiskach — lokalnie, w worktree, w chmurze i przez zdalne SSH — ze scentralizowanym sidebarem pokazującym wszystkich agentów (Cmd+Shift+P → Agents Window). Design Mode dodaje adnotacje interfejsu w przeglądarce dla precyzyjnego feedbacku wizualnego (⌘+Shift+D przełącza, Shift+drag zaznacza obszary, ⌘+L dodaje elementy do czatu, ⌥+click dodaje do inputu). Agent Tabs i worktree pokazują wiele czatów obok siebie lub w siatce, z nową komendą /worktree do izolowanych worktree gita i /best-of-n do uruchomienia zadania na wielu modelach równolegle. Po stronie enterprise MCP Apps obsługują treść ustrukturyzowaną, wtyczki firm trzecich są domyślnie wyłączone, nazwy grup katalogowych pojawiają się w logach audytowych, a samodzielnie hostowani agenci chmurowi zyskują zarządzanie sekretami.
  • Claude Code v2.1.84-92 · Anthropic. Narzędzie PowerShell do natywnego rozwoju na Windowsie bez WSL (opt-in preview); kreator konfiguracji Bedrock z uwierzytelnianiem AWS, konfiguracją regionu, weryfikacją poświadczeń i przypinaniem modelu; komenda /powerup z animowanymi lekcjami; rozbicie kosztów per model i per trafienie w cache w /cost; odroczone uprawnienia hooków (decyzja "defer" w hookach PreToolUse dla sesji bezgłowych plus hook PermissionDenied odpalający po odmowach trybu auto); narzędzie Write o 60% szybsze na dużych plikach; nazwani subagenci w podpowiedziach @ z deklarowalnym frontmatterem initialPrompt; hooki warunkowe przez pole if w składni reguł uprawnień; oraz wyszukiwanie w transkrypcie (/ w trybie Ctrl+O, n/N do przechodzenia między wynikami). /tag i /vim usunięto w v2.1.84+.
  • Desktopowy ChatGPT (wtedy aplikacja Codex) i CLI · OpenAI. Wyszukiwanie wątków ze skrótem w sidebarze i skrótami klawiszowymi do ostatnich wątków; motywy z bazowym motywem plus kolorami akcentu, tła i pierwszego planu oraz fontami; przebudowane automatyzacje z wyborem wykonania lokalnego albo w worktree, własnymi poziomami rozumowania i szablonami wielokrotnego użytku; sandbox Windows z siecią tylko przez proxy i regułami egresu na poziomie systemu; wtyczki jako obywatel pierwszej kategorii, synchronizowane z zakresem produktu przy starcie i przeglądane w /plugins; oraz subagenci z adresowaniem ścieżkowym (/root/agent_a) i ustrukturyzowaną komunikacją między agentami.
  • 28 mar · Ten przewodnik — changelogi marca 2026 dla Claude Code i Codeksa, EN+PL.
  • 18 mar · OpenAI — GPT-5.4. Pierwszy model ogólnego przeznaczenia z natywną obsługą komputera, teraz domyślny na wszystkich powierzchniach OpenAI: 75% na OSWorld, do 1M tokenów kontekstu, 57,7% na SWE-bench Pro i 83% na GDPval. Przejmuje możliwości kodowania GPT-5.3-Codex, poprawiając użycie narzędzi w środowiskach programistycznych, a wariant GPT-5.4 Pro jest dostępny dla maksymalnej wydajności.
  • 18 mar · Cursor Composer 2. Frontierowy model kodujący Cursora zbudowany wewnętrznie: architektura Mixture-of-Experts na Kimi K2.5 z własnym dotrenowaniem i uczeniem ze wzmocnieniem; 61,3 CursorBench, 61,7 Terminal-Bench 2.0, 73,7 SWE-bench Multilingual, bijąc Claude Opus 4.6 na Terminal-Bench; $0,50/$2,50 za 1M tokenów w wersji standardowej i $1,50/$7,50 w wariancie szybkim o tej samej inteligencji; kontekst 200K zoptymalizowany pod edycje wieloplikowe i długie łańcuchy zadań. Zastąpił Composera 1, a obok pojawiły się wtyczki z Marketplace’u.
  • 18 mar · Cursor Automations. Zawsze włączeni agenci działający według harmonogramu lub reagujący na zdarzenia: wyzwalacze Slack, Linear, GitHub, PagerDuty i webhooki powołujące sandboxy chmurowe ze skonfigurowanymi MCP i modelami; narzędzie pamięci, dzięki któremu agenci poprawiają się na powtarzalnych zadaniach; szablony bezpieczeństwa przeglądające ponad 3000 wewnętrznych PR-ów tygodniowo i wyłapujące ponad 200 podatności; oraz w pełni zautomatyzowany pipeline incydentów od alertu PagerDuty przez analizę logów Datadog po podsumowania w Slacku z propozycjami napraw.
  • 18 mar · Cursor Self-Hosted Cloud Agents. Funkcja enterprise do uruchamiania agentów chmurowych wewnątrz infrastruktury klienta: baza kodu, wykonywanie narzędzi, wyniki buildów i sekrety nigdy nie opuszczają sieci klienta, przy tych samych możliwościach co agenci hostowani przez Cursora, do 10 workerów na użytkownika i 50 na zespół. Używane przez Brex, Money Forward i Notion.
  • 12 mar · Codex Security (research preview). Agent bezpieczeństwa aplikacji dla klientów Enterprise, Business i edukacyjnych: modele zagrożeń specyficzne dla projektu, ujmujące strukturę systemu, granice zaufania i punkty ekspozycji; głębokie wykrywanie podatności, których nie znajduje analiza statyczna, skategoryzowanych według realnego wpływu; ponad 1,2 mln commitów przeskanowanych w becie z 792 krytycznymi znaleziskami, w tym przepełnieniami sterty w GnuTLS i obejściami 2FA; oraz edytowalne modele zagrożeń, które zespoły mogą utrzymywać w zgodzie ze swoimi wymaganiami.
  • 12 mar · Claude Code v2.1.81-86. Flaga --bare dla skryptowego trybu -p, pomijająca hooki, LSP i wtyczki; przekaźnik uprawnień --channels do przekierowania na telefon; katalog drop-in managed-settings.d/ do składania konfiguracji enterprise; wyszukiwanie w transkrypcie; Ctrl+X Ctrl+E otwierające zewnętrzny edytor do komponowania promptu; oraz wklejane obrazy wstawiające pigułkę [Image #N].
  • 4 mar · OpenAI — desktopowy ChatGPT dla Windows (wtedy aplikacja Codex), CLI 0.117-0.118. Aplikacja Windows dodaje natywną obsługę PowerShella i natywny dla Windowsa sandbox agenta z tokenami o ograniczonych uprawnieniach na poziomie systemu i listami ACL na plikach. CLI 0.117 czyni wtyczki workflow pierwszej kategorii z synchronizacją w zakresie produktu, dodaje subagentów z adresowaniem ścieżkowym i konfigurację tytułu terminala przez /title; CLI 0.118 dodaje sieć tylko przez proxy w sandboxie Windows, logowanie kodem urządzenia do ChatGPT, prompt+stdin dla codex exec i dynamiczne tokeny bearer dla własnych dostawców modeli.
  • 18 lut · Ten przewodnik — rozbudowana strona dla subskrybentów, pokazująca wszystkie ponad 390 stron treści.
  • 13 lut · Ten przewodnik — filmy z korzyściami w Remotion dla Cursora i Claude Code.
  • 9 lut · Ten przewodnik — polskie tłumaczenia we wszystkich sekcjach dokumentacji.
  • 8 lut · Ten przewodnik — pokrycie trzech narzędzi. Pełna sekcja Codeksa oraz przebudowane sekcje Cursora i Claude Code.
  • 3 lut · Ten przewodnik — przegląd changelogów. Claude Code v2.1.17-v2.1.30, Cursor v2.3-v2.4 z subagentami i skillami, GPT-5.1-Codex-Max zaktualizowany do GPT-5.2 Codex wszędzie oraz Opus 4.5 pozycjonowany jako najlepszy model tamtej chwili.
  • Anthropic — Claude Opus 4.6. Najnowszy wtedy model Claude i nowa domyślna rekomendacja do złożonego kodowania: najlepszy wynik SWE-Bench Verified wśród dostępnych modeli, lepsze użycie narzędzi przy setkach narzędzi, większa odporność na wstrzyknięcia promptów, pewniejsze wykonanie wielokrokowe, okno kontekstu 200K z limitem wyjścia 64K, parametr wysiłku do regulacji głębokości rozumowania oraz usprawnienia pamięci. Dostępny w Claude Code, w selektorze modeli Cursora i przez API Anthropic.
  • Claude Code v2.1.30. Zakresy stron PDF przez parametr pages narzędzia Read (na przykład pages: "1-5"), nowa komenda /usage ze szczegółowym rozbiciem tokenów wejściowych i wyjściowych, lepsza obsługa błędów OAuth i zarządzanie tokenem odświeżającym oraz kontrole zdrowia MCP z automatycznym restartem serwerów, które zawiodły.
  • Cursor v2.4 — subagenci i skille. Wyspecjalizowani subagenci do testów, dokumentacji i refaktoryzacji, definiowalni w .cursor/agents/; definicje skilli wielokrotnego użytku z manifestami SKILL.md do dzielenia między projektami i zespołami; hooki 40x szybsze; Cursor Blame, czyli git blame z kontekstem napędzany AI; agenci zadający pytania doprecyzowujące przed złożonymi zadaniami; tryby Plan i Ask w CLI (cursor --plan, cursor --ask); oraz przekazanie do chmury sufiksem &.
  • OpenAI — GPT-5.3-Codex. Model napędzający wtedy powierzchnie Codeksa: lepsza wydajność kodowania we wszystkich językach, lepsza obsługa długiego kontekstu z automatycznym kompaktowaniem, ulepszone użycie narzędzi dla integracji MCP oraz dostępność w aplikacji desktopowej, CLI, rozszerzeniach IDE i Cloud.
  • Claude Code v2.1.17-25. Obsługa SKILL.md dla własnych skilli w .claude/skills/, forkowanie sesji z dowolnego punktu rozmowy, flaga --from-pr do startu z kontekstem pull requesta z GitHuba, historia promptów pod strzałkami i przekazanie do chmury sufiksem &.
  • Cursor v2.3. Personalizacja układu metodą przeciągnij i upuść, synchronizacja układu między monitorami, redukcja zużycia pamięci o 25% przy dużych plikach i ulepszone odzyskiwanie po awarii w długich sesjach.
  • Codex Automations osiągają dostępność ogólną. Przypisywanie zgłoszeń GitHuba do @codex, integracja ze Slackiem dla kanałów zespołowych, automatyzacja ticketów Linear i zadania cron według harmonogramu — wszystko działające jako sandboxowani agenci chmurowi.
  • Cursor v2.2 — Debug Mode i edycja wizualna. Instrumentacja logów w czasie działania do automatycznej analizy przyczyn źródłowych w wielu stosach i językach; Visual Style Editor do projektowania na żywo w Cursor Browser; sędziowanie wieloagentowe, w którym równolegli agenci robią to samo zadanie, a automatyczna ocena wybiera najlepsze rozwiązanie; oraz przypięte czaty w sidebarze agentów.
  • Claude Code v2.0.x — agenci w tle. Uruchamiaj zadania, pracując dalej, nazywaj sesje przez /rename i wznawiaj je przez /resume <name>, używaj katalogu .claude/rules/ obok CLAUDE.md, przyjmuj podpowiadane prompty następcze Tabem i przełączaj modele w trakcie pisania przez Alt+P.
  • Start Codex Cloud. Agenci w tle działający na infrastrukturze OpenAI, z izolacją przez worktree gita dla każdego zadania, do 10 zadań równolegle, tworzeniem PR-a na GitHubie po zakończeniu oraz powiadomieniami do Slacka i Lineara.
  • 24 lis · Anthropic — Claude Opus 4.5. Pierwszy model, który przekroczył 80% na SWE-Bench Verified, z większą odpornością na wstrzyknięcia promptów i lepszymi zdolnościami agentowymi. Równolegle wystartowała aplikacja Claude Code Desktop ze wszystkimi funkcjami CLI, a użytkownicy Pro zyskali dostęp do Opusa 4.5.
  • 19 lis · OpenAI — GPT-5.2 Codex. Zastąpił GPT-5.1-Codex-Max, wyspecjalizowany w naprawianiu błędów i generowaniu interfejsów, z wytrzymałością ponad 24 godzin na zadaniu dzięki kompaktowaniu. Dostępny w Cursorze i GitHub Copilocie.
  • 29 paź · Cursor v2.0 — era wieloagentowa. Do 8 agentów działających jednocześnie, Cursor Composer 1 jako model 4x szybszy przy 250 tokenach na sekundę, sandboxowane terminale do bezpiecznego wykonania na macOS oraz tryb głosowy do sterowania agentem mową.
  • Cursor v2.1 — przeglądy kodu przez AI. Wykrywanie błędów w edytorze na podstawie Twoich zmian, Instant Grep w becie dla wszystkich komend grep agenta oraz ulepszony tryb planowania z interaktywnymi pytaniami doprecyzowującymi.
  • Otwarcie kodu Codex CLI. OpenAI otworzyło kod Codex CLI: pełne źródła na GitHubie, przyjmowanie wkładu społeczności, architektura wtyczek do rozszerzeń i wsparcie wieloplatformowe dla macOS, Linuksa i Windowsa.

Zdjęcie stanu narzędzi na koniec pierwszego kwartału istnienia przewodnika. Cursor miał już Cursor Browser (beta) do testów w aplikacji, natywny tryb planowania (beta) do planowania zadań z AI, obsługę Claude Sonnet 4.5 i model GPT-5.2 Codex, a do tego agentów w tle, BugBota, Max Mode, checkpointy i rozgałęzianie, wielokorzeniowe przestrzenie robocze, rozszerzone symbole @ oraz Memories (beta). Claude Code miał tryb architekta (--enable-architect), kontrolki rozszerzonego myślenia (przełącznik myślenia i /effort, z ultrathink jako jednoturową podpowiedzią w prompcie), system hooków, rozszerzoną integrację MCP, automatyzację w trybie bezgłowym, wielokatalogowe przestrzenie robocze i własne komendy ukośnikowe.

  • 7 sie · Ten przewodnik — dodane wskazówki dla GPT-5 w wyborze modelu, konfiguracji, porównaniu i FAQ. Pozycjonowanie z tamtego czasu: mocny w tworzeniu aplikacji jednym strzałem ze szczegółowego PRD, choć doświadczeni deweloperzy mogą nadal preferować Opusa do głębi architektury i planowania. Źródło: https://cursor.com/blog/gpt-5.
  • 17 lip · Ten przewodnik — wersja 1.0.0, pierwsze pełne wydanie. Kompletna dokumentacja Cursora (ponad 100 artykułów) i kompletna dokumentacja Claude Code (ponad 100 artykułów), łącznie ponad 200 artykułów, sekcja wspólnych workflow, przewodnik po rozwoju enterprise, dokumentacja ekosystemu MCP i obszerne dodatki. Kluczowe elementy na starcie: metodyka PRD → Plan → Todo, 100 wskazówek dla każdego narzędzia, przewodnik porównawczy modeli, kalkulator cen i checklisty migracyjne. Wspierane wersje to Cursor 0.40.x i nowsze, Claude Code 0.8.x i nowsze, Claude Sonnet 4 i Claude Opus 4 w wersji GA, początkowe wsparcie OpenAI o3 oraz pełne wsparcie Gemini 2.5 Pro.
  • 16 lip · Ten przewodnik — szczegóły modelu o3 dodane.
  • 15 lip · Ten przewodnik — poziomy subskrypcji zaktualizowane.
  • 14 lip · Ten przewodnik — 40 przewodników po serwerach MCP dodanych.
  • 10 lip · Ten przewodnik — sekcja bezpieczeństwa i compliance dodana.
ModelDostawcaKontekstTypowe zastosowanieCena (za 1M tokenów)
Claude Fable 5Anthropic1MZadania dłuższe niż jedno posiedzenie; myślenie zawsze włączone$10 / $50
Claude Opus 5Anthropic1MDomyślny Opus: praca agentowa, obsługa komputera, praca umysłowa. Domyślny na kontach Max, Team Premium, Enterprise pay-as-you-go, w API Anthropic i w chmurach zarządzanych. Wymaga Claude Code v2.1.219+$5 / $25
Claude Sonnet 5Anthropic1MDomyślny na miejscach Pro, Team Standard i Enterprise$2 / $10 wprowadzająco
Claude Haiku 4.5Anthropic200KTania praca równoległa i masowa, subagenci$1 / $5
GPT-5.6 Sol / Terra / LunaOpenAI1.05M w API (~272K roboczego kontekstu w Codeksie)Frontier / zrównoważony / wydajny$5/$30 · $2,50/$15 · $1/$6
Grok 4.5SpaceXAI / Cursor500K w API*Długie zadania kodujące i praca z komputerem$2 / $6
Cursor Composer 2.5Cursor200KSzybka lokalna iteracja w Cursorze$0,50 / $2,50
Gemini 3.1 ProGoogle1MMultimodalność, ekstremalny kontekst, tryb Deep Think$2 / $12; $4 / $18 powyżej 200K wejścia

* Host taki jak Cursor może wystawiać mniejszy kontekst roboczy; sprawdź bieżący selektor modeli.

  • GPT-4, GPT-4.1, GPT-4o (starsze wobec bieżących wskazówek dla GPT-5.6; dostępność zależy od produktu)
  • GPT-5.1 / GPT-5.1-Codex / GPT-5.1-Codex-Mini/Max, GPT-5.2 (usunięte z selektora modeli Codeksa)
  • GPT-5.3-Codex, GPT-5.4 i GPT-5.5 (zastąpione przez rodzinę GPT-5.6)
  • Cursor Composer 1 i Composer 2 (starsze generacje; aktualny jest Composer 2.5)
  • Claude Opus 4.8 (zastąpiony przez Opusa 5 w tej samej cenie $5 / $25; nadal dostępny, nadal kwalifikujący się do Priority Tier i nadal model, na który wracają żądania Opusa 5 i Fable 5 oflagowane jako cyberbezpieczeństwo)
  • Claude Opus 4.6 / 4.7 (starsze niż Opus 4.8; v2.1.219 przesunęła udokumentowane ustawienia domyślne chmur zarządzanych na Opusa 5, z wyjątkiem Foundry, które zostaje na Sonnecie 4.5 i rozwiązuje opus do Opusa 4.6)
  • Claude Opus 4.1 (przestarzały — wycofanie 5 sierpnia 2026; migruj na Opusa 5)
  • Seria Claude 3.x (starsza wobec bieżących wskazówek dla wersji 4.5+ i serii 5)
  • o1-preview, o1-mini (nieaktualne)

Najnowsze oficjalne serwery MCP warte poznania: Atlassian (Jira i Confluence), Cloudflare (Workers, R2 i D1), Vercel (automatyzacja wdrożeń), Supabase (operacje na bazie i auth), Linear (śledzenie zgłoszeń) i Stripe (automatyzacja płatności).

Po stronie skilli marketplace Skills.sh hostuje już ponad 200 skilli, a uniwersalne CLI npx skills add <owner/repo> działa w ponad 35 agentach. Popularne skille to wdrożenia Cloudflare, przegląd kodu, integracja z Atlassianem i generowanie dokumentacji API.

SOC 2 Type II

Zweryfikuj bieżące trust center każdego dostawcy oraz zakres produktowy i umowny jego raportów SOC.

Kontrola danych

Oferty Business i API zapewniają umowne mechanizmy kontroli danych; ustawienia konsumenckie, retencja i wybory dotyczące trenowania różnią się w zależności od produktu i planu.

Logi audytowe

Możliwości audytowe dla enterprise różnią się w zależności od narzędzia, powierzchni i umowy; potwierdź zakres rejestrowanych zdarzeń, zanim oprzesz na nich compliance.

RODO

Warunki przetwarzania danych i rezydencja regionalna zależą od dostawcy i umowy enterprise; zweryfikuj bieżącą umowę powierzenia i wsparcie regionów.

  1. Claude Sonnet 5 (30 czerwca): domyślny na miejscach Pro, Team Standard i Enterprise z natywnym kontekstem 1M. Sesje Max, Team Premium, Enterprise pay-as-you-go i API Anthropic domyślnie używają Opusa 5, ustawienia domyślne chmur zarządzanych różnią się, a wprowadzające ceny API Sonneta kończą się 31 sierpnia 2026.
  2. Claude Fable 5: przywrócony globalnie 1 lipca; od 20 lipca na stałe wliczony w Max i Team Premium do 50% tygodniowych limitów użycia, podczas gdy Pro i Team Standard korzystają z kredytów.
  3. Rodzina GPT-5.6 (9 lipca): Sol, Terra i Luna zastępują wskazówki z ery GPT-5.5; przejrzyj slugi modeli, poziomy rozumowania i routing warstw.
  4. Grok 4.5 w Cursorze (8 lipca): dostępny na desktopie, w webie, na iOS, w CLI i SDK; wybierz cennik standardowy albo szybki.
  5. Cursor 3.0: interfejs Agents Window zastępuje stary układ, a agenci chmurowi zostali usunięci z edytora.
  6. Claude Code: /simplify i /code-review to odrębne komendy — /simplify do przeglądu pod kątem ponownego użycia, jakości i wydajności, /code-review do dedykowanego workflow przeglądu.
  7. Claude Code v2.1.84+: /tag i /vim usunięte; użyj /config → tryb edytora.
  8. Claude Code v2.1.160 (2 czerwca): słowo kluczowe wyzwalające dynamiczne workflow zmieniono z workflow na ultracode — wpisanie „workflow” nie uruchamia już przebiegu, choć poproszenie własnymi słowami nadal działa.

Te wiersze opisują migracje dokumentacji lub workflow, a nie ogólne wycofanie API czy koniec wsparcia. Dostępność produktu zweryfikuj u dostawcy.

Poprzednie wskazówki lub workflowZmiana snapshotuBieżąca ścieżka
Wskazówki dla Codeksa z ery GPT-5.5Lipiec 2026GPT-5.6 Sol / Terra / Luna
Cursor Composer 2Maj 2026Composer 2.5
Agenci chmurowi w edytorze Cursor v2.xKwiecień 2026Agents Window
Cursor Composer 1Marzec 2026Linia Composer 2 / 2.5
Interfejs Cursor v1.xLuty 2026Agents Window w v3.x
Konfiguracja Claude Code tylko przez WSLSierpień 2025Natywny Windows lub opcjonalnie WSL
Starsze rewizje specyfikacji MCPRewizje z konkretnymi datamiBieżąca datowana specyfikacja MCP i SDK

Settings > Update > Auto-update. Wybierz kanał „Stable” albo „Beta”.

Poza changelogami podlinkowanymi na górze tej strony blogi dostawców to Cursor, Anthropic i OpenAI; każdy ogłasza też na X/Twitterze i na swoim Discordzie.

Każdy wpis powyżej przechodzi przed publikacją cztery kroki. Przegląd oficjalnej dokumentacji: notatki wydań dostawców, zmiany w API i aktualizacje cennika. Walidacja społecznościowa: kanały Discorda i Slacka, zgłoszenia na GitHubie, opinie użytkowników. Praktyczne testy: nowe funkcje, workflow i przykłady uruchamiane, a nie parafrazowane. Przegląd ekspercki: poprawność techniczna, walidacja najlepszych praktyk i scenariusze enterprise.

Artykuły noszą tagi wersji zapisujące wersje narzędzi, które ich treść zakłada:

---
version: 1.0.0
lastUpdated: 2026-07-27
tools:
cursor: ">=3.11"
claude_code: ">=2.1.215"
codex_cli: ">=0.144.6"
---

Treść przechodzi przez cztery etapy cyklu życia: Aktywna (bieżąca najlepsza praktyka), Starsza (nadal poprawna, ale istnieją nowsze metody), Przestarzała (oznaczona do usunięcia) i Zarchiwizowana (wyłącznie odniesienie historyczne). Przykłady z GPT-4 uznano za przestarzałe w lipcu 2025 i usunięto w październiku 2025; stare poziomy cenowe oznaczono jako starsze w lipcu 2025 i usunięto w grudniu 2025; przewodniki po Claude 3.x oznaczono jako starsze w lipcu 2025 i usunięto w styczniu 2026.

Nowa lub odświeżona dokumentacja pojawia się w większości tygodni. Kanały publikowane są pod /en/feed.xml, /en/atom.xml i /en/feed.json.

Najczęstsze pytania

Co zmieniło się w Cursorze, Claude Code i Codeksie w lipcu 2026?

24 lipca pojawił się Claude Opus 5 w cenie Opusa 4.8, czyli $5/$25, wymagający Claude Code v2.1.219+. 9 lipca pojawiły się GPT-5.6 Sol, Terra i Luna, a Codex trafił do aplikacji desktopowej ChatGPT wraz z CLI 0.144.1. Między 8 a 10 lipca wyszedł Cursor 3.11 z Grok 4.5. Claude Code 2.1.207 uczynił agentów w tle trwałymi między restartami i dodał uwierzytelnianie MCP z CLI.

Które modele do kodowania są obecnie zalecane?

Claude Fable 5 ($10 / $50 za 1M tokenów) do zadań dłuższych niż jedno posiedzenie; Claude Opus 5 ($5 / $25) jako domyślny Opus do pracy agentowej; Claude Sonnet 5 ($2 / $10 w cenie wprowadzającej) jako domyślny na standardowych miejscach subskrypcyjnych; GPT-5.6 Sol / Terra / Luna z kontekstem 1.05M do pracy frontierowej, zrównoważonej i wydajnej. Tabelę uzupełniają Grok 4.5, Cursor Composer 2.5, Claude Haiku 4.5 i Gemini 3.1 Pro.

Które ostatnie zmiany wymagają działania?

Claude Sonnet 5 stał się domyślny na miejscach Pro, Team Standard i Enterprise 30 czerwca, a wprowadzające ceny API Sonneta kończą się 31 sierpnia 2026. Rodzina GPT-5.6 zastąpiła wskazówki z ery GPT-5.5. Agents Window w Cursorze 3.0 zastąpiło stary układ. Claude Code v2.1.84+ usunął /tag i /vim, a v2.1.160 zmienił słowo kluczowe wyzwalające dynamiczne workflow z workflow na ultracode.

Jaka dokumentacja pojawiła się w sierpniu 2026?

Piętnaście nowych przewodników -- sześć darmowych hubów sekcji z drabiną autonomii i Stan inżynierii agentowej 2026, czyli artykuł badawczy stojący za nią; routines w Claude Code oraz cloud agents w Cursorze; własny serwer MCP tego serwisu; fabryki oprogramowania; audyt loadoutu Dr. Skill; protokół ablacji do przycinania CLAUDE.md i AGENTS.md; skille anty-slop oraz compound engineering -- a do tego przepisanie każdego artykułu w korpusie tak, by zaczynał się od odpowiedzi, czego pilnuje teraz build. Wszystko EN+PL.

Jak ten przewodnik jest utrzymywany w aktualności?

Czterema krokami: przegląd oficjalnej dokumentacji, czyli notatek wydań, zmian w API i aktualizacji cennika; walidacja społecznościowa na kanałach Discorda i Slacka oraz w zgłoszeniach na GitHubie; praktyczne testy nowych funkcji, workflow i przykładów; oraz przegląd ekspercki pod kątem poprawności technicznej i scenariuszy enterprise. Baza modeli i cen była ostatnio zweryfikowana wobec źródeł dostawców 27 lipca 2026.