Przejdź do głównej zawartości

Najnowsze Aktualizacje

Krajobraz rozwoju AI zmienia się co tydzień. Pojawiają się nowe modele, zmieniają się ceny, a funkcje lądują we wszystkich trzech narzędziach. Ta strona śledzi aktualizacje, które mają znaczenie, dzięki czemu możesz pozostać na bieżąco bez śledzenia każdego changelogu.

Lipiec ustawił nowy baseline całego stosu: Anthropic zamknął miesiąc modelem Claude Opus 5, OpenAI wydał rodzinę GPT-5.6 i włączył Codex do desktopowego ChatGPT, Cursor wydał 3.11 oraz Grok 4.5, a Claude Code dodał Sonnet 5, a potem Opus 5 do routingu modeli zależnego od konta/providera i utwardził runtime stale działających agentów w tle.

Wyścig o pracę autonomiczną nie zwolnił tempa w czerwcu: Cursor wepchnął Design Mode do przeglądarki i kanw, Claude Code ustalił ultracode jako słowo kluczowe wyzwalające dynamiczne przepływy pracy, Codex wydał parowanie kontrolerów dla bezgłowych flot, a Anthropic wydał Claude Fable 5 — nowy poziom modeli powyżej Opusa.

Pivotalny miesiąc: Anthropic wydał Claude Opus 4.8 i dynamiczne przepływy pracy, a wszystkie trzy narzędzia dopełniły swoje pierwszorzędne prymitywy pracy autonomicznej w ciągu kilku tygodni od siebie.

Fundamentalna zmiana z forka VS Code na dedykowany workspace do pracy z agentami:

Agents Window

Nowy wielorepozytorium interfejs do równoległego uruchamiania agentów w różnych środowiskach — lokalnie, w worktrees, w chmurze i przez remote SSH. Scentralizowany sidebar pokazuje wszystkich agentów. Przełącz przez Cmd+Shift+P → Agents Window.

Design Mode

Adnotowanie elementów UI bezpośrednio w przeglądarce dla precyzyjnego wizualnego feedbacku. Użyj ⌘+Shift+D do przełączania, Shift+przeciągnij do zaznaczania, ⌘+L do dodania elementu do czatu, ⌥+klik do dodania do inputu.

Agent Tabs i Worktrees

Wyświetlaj wiele czatów obok siebie lub w siatce. Nowe polecenie /worktree tworzy izolowane git worktrees. /best-of-n uruchamia zadania równolegle na wielu modelach i porównuje wyniki.

Pluginy i Enterprise

MCP Apps wspierają ustrukturyzowaną treść dla bogatszych outputów. Wtyczki firm trzecich domyślnie wyłączone dla Enterprise. Nazwy grup katalogowych w logach audytu. Zarządzanie sekretami self-hosted cloud agents.

Duże dodatki funkcjonalności w wielu szybkich wydaniach:

  • Narzędzie PowerShell (Windows): Natywny rozwój na Windows bez WSL — opt-in preview dla PowerShell jako pełnoprawnego narzędzia
  • Kreator konfiguracji Bedrock: Interaktywna prowadzona konfiguracja z ekranu logowania — uwierzytelnianie AWS, konfiguracja regionu, weryfikacja poświadczeń i przypinanie modelu
  • Polecenie /powerup: Interaktywne lekcje z animowanymi demami uczącymi funkcji Claude Code
  • Podział kosztów per model: /cost pokazuje podział kosztów per model i cache-hit dla użytkowników subskrypcji
  • Odroczone uprawnienia hooków: Decyzja "defer" w hookach PreToolUse dla sesji headless, plus hook PermissionDenied po odmowach auto mode
  • Narzędzie Write 60% szybsze: Ulepszone obliczanie diff na dużych plikach
  • Nazwane subagenty: Subagenty pojawiają się w typeahead @ z deklarowalnym frontmatter initialPrompt
  • Warunkowe hooki: Pole if dla hooków używające składni reguł uprawnień
  • Przeszukiwanie transkryptów: Naciśnij / w trybie Ctrl+O, n/N do nawigacji między wynikami

Ulepszenia desktopowego Codex i CLI z wydań kwietniowych (produkt desktopowy nosił wtedy nazwę Codex App):

  • Wyszukiwanie wątków: Przeszukuj przeszłe wątki ze skrótem w sidebarze i skrótami klawiaturowymi
  • Motywy: Wybierz bazowy motyw i dostosuj kolory akcentu, tła, pierwszego planu oraz czcionki
  • Przebudowane automatyzacje: Wybierz wykonywanie lokalne lub worktree, niestandardowe poziomy rozumowania i szablony wielokrotnego użytku
  • Sandbox Windows: Sieciowanie proxy-only z regułami egress na poziomie OS dla aplikacji Windows
  • Wtyczki pierwszej klasy: Synchronizuj wtyczki na starcie, przeglądaj w /plugins, jaśniejsza obsługa instalacji/usuwania
  • Sub-agenty: Adresowanie oparte na ścieżkach (/root/agent_a) ze strukturalnym przesyłaniem wiadomości między agentami

Pierwszy model ogólnego przeznaczenia z natywną obsługą komputera, teraz domyślny na wszystkich powierzchniach OpenAI:

Natywna Obsługa Komputera

Pierwszy model ogólnego przeznaczenia z najnowocześniejszymi możliwościami obsługi komputera — 75% na OSWorld. Agenty mogą obsługiwać komputery i realizować złożone przepływy pracy między aplikacjami.

Kontekst 1M Tokenów

Obsługuje do 1M tokenów kontekstu. Łączy wiodące w branży możliwości kodowania z GPT-5.3-Codex, jednocześnie ulepszając użycie narzędzi w środowiskach programistycznych.

Najlepsze Benchmarki

57.7% na SWE-bench Pro (kodowanie), 83% na GDPval (praca z wiedzą). Znaczące ulepszenia w zadaniach profesjonalnych obejmujących arkusze kalkulacyjne, prezentacje i dokumenty.

Dostępny Wszędzie

Wdrażany w ChatGPT, Codex i API jako domyślny model. Wariant GPT-5.4 Pro dostępny dla maksymalnej wydajności przy złożonych zadaniach.

OpenAI uruchomił Codex Security — agenta bezpieczeństwa aplikacji dostępnego dla klientów Enterprise, Business i edukacyjnych:

  • Modelowanie zagrożeń: Buduje specyficzne dla projektu modele zagrożeń ujmujące strukturę systemu, granice zaufania i punkty ekspozycji
  • Głębokie wykrywanie podatności: Identyfikuje złożone podatności, które narzędzia analizy statycznej pomijają, kategoryzowane według realnego wpływu
  • Sprawdzony w skali: Przeskanowano ponad 1.2M commitów w beta, znaleziono 792 krytyczne ustalenia, w tym przepełnienia sterty GnuTLS i obejścia 2FA
  • Edytowalne modele zagrożeń: Zespoły mogą edytować wygenerowane modele zagrożeń, aby agent był zgodny z ich wymaganiami bezpieczeństwa

Agenty zawsze aktywne, działające według harmonogramów lub reagujące na zdarzenia:

  • Wyzwalacze zdarzeń: Slack, Linear, GitHub, PagerDuty i webhooks — agenty uruchamiają sandboxowane środowiska chmurowe ze skonfigurowanymi MCP i modelami
  • Narzędzie pamięci: Agenty uczą się z przeszłych uruchomień i poprawiają się z powtórzeniami w powtarzających się zadaniach
  • Szablony bezpieczeństwa: Przeglądanie ponad 3000 wewnętrznych PR tygodniowo, wykrywanie ponad 200 podatności dedykowanymi agentami audytu bezpieczeństwa
  • Pipeline incydentów: Alerty PagerDuty → analiza logów Datadog → podsumowania Slack z proponowanymi poprawkami, w pełni zautomatyzowane

Frontierowy model kodowania Cursor zbudowany wewnętrznie:

  • Architektura: Mixture-of-Experts (MoE) zbudowany na Kimi K2.5, wzbogacony o własne kontynuowane pretrenowanie i reinforcement learning Cursor
  • Benchmarki: 61.3 CursorBench, 61.7 Terminal-Bench 2.0, 73.7 SWE-bench Multilingual — przewyższa Claude Opus 4.6 na Terminal-Bench
  • Ceny: $0.50/$2.50 za 1M tokenów (standardowy), $1.50/$7.50 (szybki wariant z tą samą inteligencją)
  • 200K kontekstu: Zoptymalizowany do edycji wielu plików, generowania kodu, refaktoryzacji i długich łańcuchów zadań przez setki akcji

Funkcja enterprise do uruchamiania cloud agents w infrastrukturze klienta:

  • Baza kodu, wykonywanie narzędzi, wyniki budowania i sekrety nigdy nie opuszczają sieci klienta
  • Te same możliwości co Cursor-hosted agents: izolowane VM, pełne środowiska deweloperskie, multi-model harnesses, wtyczki
  • Do 10 workerów na użytkownika, 50 na zespół
  • Używany przez Brex, Money Forward i Notion

ChatGPT desktop dla Windows (wtedy Codex App) + CLI 0.117–0.118

Dział zatytułowany „ChatGPT desktop dla Windows (wtedy Codex App) + CLI 0.117–0.118”

Codex rozszerzył zasięg platformowy i możliwości CLI:

  • Aplikacja Windows (4 marca): Natywne wsparcie PowerShell i natywny sandbox Windows z tokenami ograniczonymi na poziomie OS i kontrolą uprawnień systemu plików (ACL)
  • CLI 0.117: Wtyczki jako workflow pierwszej klasy z synchronizacją produktową, sub-agenty z adresowaniem opartym na ścieżkach, konfiguracja tytułu terminala przez /title
  • CLI 0.118: Sandbox Windows z sieciowaniem proxy-only, logowanie ChatGPT device-code, prompt+stdin dla codex exec, dynamiczne bearer tokeny dla niestandardowych dostawców modeli

Ciągły strumień ulepszeń i utwardzania platformy:

  • Flaga --bare: Skryptowy tryb -p pomijający hooki, LSP i wtyczki dla czystej automatyzacji
  • --channels: Relay uprawnień dla przekierowania telefonicznego do doświadczeń mobilnych typu Cursor
  • Managed-settings drop-in: Katalog managed-settings.d/ dla kompozycji konfiguracji enterprise
  • Przeszukiwanie transkryptów: Naciśnij / w trybie Ctrl+O, n/N do nawigacji między dopasowaniami
  • Ctrl+X Ctrl+E: Otwórz zewnętrzny edytor do kompozycji promptów
  • Wklejane obrazy: Wstawiają chip [Image #N] do referencji w promptach

Najnowszy model Claude i nowa domyślna rekomendacja dla wszystkich złożonych zadań kodowania:

Najlepsze Wyniki SWE-Bench

Najlepsza wydajność na SWE-Bench Verified wśród wszystkich dostępnych modeli. Doskonałe zachowanie agentowe i utrzymane rozumowanie przez długie zadania.

Ulepszona Wydajność Agentowa

Ulepszone użycie narzędzi w setkach narzędzi. Lepsza odporność na prompt injection. Bardziej niezawodne wykonywanie zadań wieloetapowych.

200K Context Window

200K tokenów kontekstu z limitem 64K outputu. Parametr effort dla regulowanej głębokości rozumowania. Ulepszenia pamięci dla złożonych zadań.

Dostępny Wszędzie

Dostępny w Claude Code, Cursor (przez wybór modelu) i przez API Anthropic. Zalecany z planami subskrypcyjnymi Max/Ultra dla pełnego dostępu.

Najnowsze ulepszenia Claude Code:

  • Zakresy stron PDF: Parametr pages w narzędziu Read do czytania konkretnych zakresów stron z plików PDF (np. pages: "1-5")
  • Metryki tokenów: Nowe polecenie /usage ze szczegółowym podziałem tokenów wejścia/wyjścia
  • Ulepszenia OAuth: Lepsza obsługa błędów i zarządzanie refresh token
  • Sprawdzanie zdrowia MCP: Automatyczny restart dla niedziałających serwerów MCP

Główna aktualizacja doświadczenia agenta:

  • Subagents: Wyspecjalizowane subagenty do testowania, dokumentacji, refaktoryzacji. Definiuj niestandardowe subagenty w .cursor/agents/
  • Skills (SKILL.md): Definicje umiejętności wielokrotnego użytku z manifestami SKILL.md. Dziel się między projektami i zespołami
  • 40x szybsze hooks: Niemal natychmiastowe wykonywanie hook
  • Cursor Blame: AI-powered git blame z kontekstem
  • Wyjaśnienia agenta: Agenty zadają pytania wyjaśniające przed złożonymi zadaniami
  • Tryby CLI Plan/Ask: cursor --plan i cursor --ask dla użycia offline
  • Przekazywanie do cloud: Użyj sufiksu &, aby przekazać zadania do cloud agents

W momencie tego lutowego wydania model zasilający powierzchnie Codex to:

  • Ulepszona wydajność kodowania we wszystkich językach
  • Lepsze radzenie sobie z długim kontekstem z automatycznym kompaktowaniem
  • Ulepszone użycie narzędzi dla integracji MCP
  • Dostępny w aplikacji desktopowej (obecnie część ChatGPT), CLI, rozszerzeniach IDE i Cloud
  • Wsparcie SKILL.md: Definiuj niestandardowe umiejętności w .claude/skills/
  • Rozgałęzianie sesji: Twórz gałęzie z dowolnego punktu rozmowy
  • Flaga --from-pr: Rozpocznij z kontekstem z GitHub pull request
  • Historia klawiszy strzałek: Nawiguj historię promptów klawiszami góra/dół
  • Przekazywanie do cloud: Użyj sufiksu &, aby przekazać zadania do cloud agents
  • Dostosowywanie layoutu: Przeciągaj i upuszczaj układy paneli
  • Wsparcie wielu monitorów: Synchronizacja layoutu między wyświetlaczami
  • 25% redukcja pamięci: Lepsze radzenie sobie z dużymi plikami
  • Ulepszone odzyskiwanie po awarii: Zwiększona stabilność dla długich sesji

Automatyzacje Codex przeszły z beta do GA:

  • Przypisywanie GitHub issue do @codex
  • Integracja Slack dla kanałów zespołowych
  • Automatyzacja ticketów Linear
  • Zaplanowane zadania oparte na cron
  • Wszystkie automatyzacje działają jako sandboxed cloud agents

Tryb Debug

Instrumentacja logów runtime dla automatycznej analizy przyczyn źródłowych. Działa w wielu stackach technologicznych i językach.

Visual Style Editor

Projektowanie wizualne w czasie rzeczywistym w Cursor Browser. Modyfikuj elementy i kolory bezpośrednio w live preview.

Multi-Agent Judging

Uruchom równoległych agentów na tym samym zadaniu, następnie automatyczna ocena wybiera najlepsze rozwiązanie.

Przypięte Czaty

Przypinaj ważne rozmowy w sidebarze agenta dla szybkiego dostępu.

  • Background agents: Uruchamiaj zadania podczas kontynuowania pracy
  • Nazwane sesje: /rename do nazwania, /resume <name> do wznowienia
  • Katalog .claude/rules/: Wsparcie dla rules obok CLAUDE.md
  • Sugestie promptów: Claude sugeruje follow-up prompty (Tab do akceptacji)
  • Przełączanie modelu (Alt+P): Przełączaj modele podczas komponowania promptu

OpenAI uruchomił Codex Cloud — background agents działające na infrastrukturze OpenAI:

  • Izolacja Git worktree dla każdego zadania
  • Równoległe wykonywanie zadań (do 10 współbieżnych)
  • Tworzenie GitHub PR po zakończeniu
  • Integracje powiadomień Slack i Linear
  • Pierwszy model przekraczający 80% na SWE-Bench Verified
  • Uruchomiono aplikację desktopową Claude Code (natywne doświadczenie ze wszystkimi funkcjami CLI)
  • Użytkownicy Pro zyskali dostęp do Opus 4.5
  • Zwiększona odporność na prompt injection i możliwości agenta
  • 8 równoległych agentów: Uruchom do 8 agentów jednocześnie
  • Cursor Composer 1: 4x szybszy model (250 tokenów/sek)
  • Sandboxed terminals: Bezpieczne środowiska wykonawcze (macOS)
  • Tryb głosowy: Kontrola agenta speech-to-text
  • Zastąpił GPT-5.1-Codex-Max
  • Wyspecjalizowany w naprawianiu bugów i generowaniu UI
  • Wytrzymałość zadań 24+ godziny przez kompaktowanie
  • Dostępny w Cursor i GitHub Copilot
  • Wykrywanie bugów w edytorze badające twoje zmiany
  • Instant Grep (beta) dla wszystkich poleceń grep agenta
  • Ulepszone Plan Mode z interaktywnymi pytaniami wyjaśniającymi

OpenAI udostępnił open-source Codex CLI:

  • Pełne źródło dostępne na GitHub
  • Akceptowane wkłady społeczności
  • Architektura wtyczek dla rozszerzeń
  • Wsparcie cross-platform (macOS, Linux, Windows)
ModelDostawcaKontekstTypowe użycieCena (na 1M tokenów)
Claude Fable 5Anthropic1MZadania dłuższe niż jedna sesja$10 / $50
Claude Opus 5Anthropic1MDomyślny Opus: kodowanie agentyczne, obsługa komputera, praca wiedzowa$5 / $25
Claude Sonnet 5Anthropic1MDefault na standardowych miejscach subskrypcyjnych$2 / $10 promocyjnie
Claude Haiku 4.5Anthropic200KTania praca równoległa/masowa, subagenci$1 / $5
GPT-5.6 Sol / Terra / LunaOpenAI1,05MFrontier / zbalansowany / wydajny$5/$30 · $2,50/$15 · $1/$6
Grok 4.5SpaceXAI / Cursor500K API*Długotrwałe kodowanie i praca z komputerem$2 / $6
Cursor Composer 2.5Cursor200KSzybka lokalna iteracja w Cursor$0.50 / $2.50
Gemini 3.1 ProGoogle1MMultimodal, ekstremalny kontekst$2 / $12; $4 / $18 powyżej 200K wejścia

* Host taki jak Cursor może udostępniać mniejszy kontekst roboczy; sprawdź bieżący picker modeli.

  • GPT-4, GPT-4.1, GPT-4o (legacy wobec bieżących wskazówek GPT-5.6; dostępność zależy od produktu)
  • GPT-5.1 / GPT-5.1-Codex / GPT-5.1-Codex-Mini/Max, GPT-5.2 (usunięte z selektora modeli Codex)
  • GPT-5.3-Codex, GPT-5.4 i GPT-5.5 (zastąpione przez rodzinę GPT-5.6)
  • Cursor Composer 1 i Composer 2 (starsze generacje; Composer 2.5 jest bieżący)
  • Claude Opus 4.8 (zastąpiony przez Opus 5 w tej samej cenie $5 / $25; nadal dostępny, nadal objęty Priority Tier i nadal jest modelem, na który wracają żądania Opus 5 i Fable 5 oflagowane jako cyberbezpieczeństwo)
  • Claude Opus 4.6 / 4.7 (starsze od Opus 4.8; v2.1.219 przeniósł udokumentowane defaulty chmur zarządzanych na Opus 5, z wyjątkiem Foundry, które zostaje na Sonnet 4.5 i rozwiązuje opus na Opus 4.6)
  • Claude Opus 4.1 (deprecated — wycofanie 5 sierpnia 2026; migruj na Opus 5)
  • Seria Claude 3.x (legacy wobec bieżących wskazówek 4.5+ i serii 5)
  • o1-preview, o1-mini (przestarzałe)
  1. Atlassian MCP — Integracja Jira i Confluence
  2. Cloudflare MCP — Zarządzanie Workers, R2 i D1
  3. Vercel MCP — Automatyzacja wdrażania
  4. Supabase MCP — Operacje bazy danych i auth
  5. Linear MCP — Integracja śledzenia issues
  6. Stripe MCP — Automatyzacja przetwarzania płatności

Ekosystem Agent Skills znacznie się rozszerzył:

  • Marketplace Skills.sh teraz hostuje ponad 200 umiejętności
  • Universal CLI: npx skills add <owner/repo> działa w ponad 35 agentach
  • Popularne umiejętności: wdrażanie Cloudflare, code review, integracja Atlassian, generowanie dokumentacji API

SOC 2 Type II

Sprawdź bieżący trust center każdego dostawcy oraz zakres raportu SOC dla produktu i umowy.

Zwiększona Prywatność

Oferty biznesowe/API zapewniają kontraktowe kontrolki danych; ustawienia konsumenckie, retencja i wybory treningowe zależą od produktu i planu.

Logowanie Audytu

Możliwości audytu enterprise zależą od narzędzia, powierzchni i umowy; potwierdź zakres zdarzeń przed użyciem ich do compliance.

Zgodność GDPR

Warunki przetwarzania danych i rezydencja regionalna zależą od dostawcy i umowy enterprise; sprawdź bieżące DPA i wsparcie regionów.

Settings > Update > Auto-update. Wybierz kanał “Stable” lub “Beta”.

  • Changelogs: Cursor | Claude Code | Codex
  • Blogi: Cursor | Anthropic | OpenAI
  • Social: Śledź @cursor_ai, @AnthropicAI, @OpenAI na X/Twitter
  • Społeczność: Dołącz do serwerów Discord dla ogłoszeń w czasie rzeczywistym
  1. Claude Sonnet 5 (30 czerwca): default na Pro, Team Standard i subskrypcyjnych miejscach Enterprise z natywnym kontekstem 1M; Max, Team Premium, Enterprise pay-as-you-go i sesje Anthropic API domyślnie używają teraz Opus 5, defaulty zarządzanych chmur są inne, a promocyjna cena API Sonnet kończy się 31 sierpnia 2026
  2. Claude Fable 5: przywrócony globalnie 1 lipca; od 20 lipca 2026 na stałe wliczony w Max i Team Premium do 50% tygodniowych limitów użycia, a Pro i Team Standard sięgają po niego przez usage credits
  3. Rodzina GPT-5.6 (9 lipca): Sol, Terra i Luna zastępują wskazówki z ery GPT-5.5; sprawdź slugi, poziomy reasoning effort i routing tierów
  4. Cursor Grok 4.5 (8 lipca): dostępny w desktop, web, iOS, CLI i SDK; wybierz cennik standard lub fast
  5. Cursor 3.0: Nowy interfejs Agents Window zastępuje stary layout — cloud agents usunięte z Editora
  6. Claude Code: /simplify i /code-review są odrębnymi komendami; użyj /simplify do przeglądu reuse/jakości/wydajności, a /code-review do dedykowanego workflow review
  7. Claude Code v2.1.84+: Polecenia /tag i /vim usunięte (użyj /config → Editor mode zamiast tego)
  8. Claude Code v2.1.160 (2 czerwca): słowo kluczowe wyzwalające dynamiczne przepływy pracy zmieniło się z workflow na ultracode — wpisanie „workflow” już nie uruchamia przebiegu, choć poproszenie własnymi słowami nadal działa

Te wiersze opisują migracje dokumentacji lub workflowów, a nie ogólne wycofanie API ani koniec wsparcia. Dostępność produktu sprawdzaj u dostawcy.

Poprzednia wskazówka lub workflowZmiana snapshotuBieżąca ścieżka
Wskazówki Codex z ery GPT-5.5Lipiec 2026GPT-5.6 Sol / Terra / Luna
Cursor Composer 2Maj 2026Composer 2.5
Cursor v2.x Editor cloud agentsKwiecień 2026Agents Window
Cursor Composer 1Marzec 2026Linia Composer 2 / 2.5
UI Cursor v1.xLuty 2026Agents Window v3.x
Konfiguracja Claude Code tylko przez WSLSierpień 2025Natywny Windows lub opcjonalny WSL
Starsze rewizje specyfikacji MCPRewizje datowaneBieżąca datowana specyfikacja MCP i SDK

Ostatnia aktualizacja: 11 lipca 2026