Sterowanie głosem w pracy z agentami
Sterowanie głosem w pracy z agentami polega na mówieniu promptów zamiast ich wpisywania. Claude Code zamienia mowę na tekst promptu poleceniem /voice (wymagane logowanie claude.ai), Codex CLI prowadzi rozmowę głosową, GitHub Copilot CLI przełącza dyktowanie skrótem Ctrl+Space, a dyktowanie systemowe obsłuży każde inne narzędzie. Transkrypcję i tak trzeba sprawdzić, zanim stanie się decyzją.
Ta strona jest dla programisty, który więcej czasu spędza na tłumaczeniu agentowi, o co chodzi, niż na przeglądaniu jego kodu, oraz dla tech leada, który musi zdecydować, czy mikrofony wchodzą do konfiguracji zespołu. Siedzisz od 40 minut w sesji /grill-with-docs o rozliczaniu za stanowisko. Pytanie 17 brzmi: co się dzieje ze stanowiskiem usuniętym w połowie okresu rozliczeniowego? Uczciwa odpowiedź ma trzy warunki i jeden wyjątek. Wpisujesz „proporcjonalnie”. Agent uzupełnia resztę własną rekomendacją. Trzy dni później logika zwrotów jest błędna dokładnie w tym miejscu, które wyjaśniłbyś, gdyby pisanie było tańsze.
Co daje dobrze ustawione sterowanie głosem
Dział zatytułowany „Co daje dobrze ustawione sterowanie głosem”- Tabelę decyzyjną opcji głosowych dla każdego agenta i tego, co każda z nich wysyła i dokąd.
- Działającą konfigurację Claude Code:
/voice tap, trwałe ustawienie, właściwy język dyktowania i przemapowany klawisz. - Pełny workflow na poziomie frameworka: odpowiadasz na wywiad grill-me głosem, a potem zamieniasz te odpowiedzi w odczyt kontrolny, kryteria akceptacji i czerwone testy, które sprawdzisz bez odsłuchiwania nagrania.
- Trzy prompty do skopiowania, dzięki którym agent radzi sobie z błędami transkrypcji zamiast zgadywać.
- Checklistę dla zespołu, pułapki i typowe awarie wraz z naprawą.
Której opcji głosowej użyć z danym agentem?
Dział zatytułowany „Której opcji głosowej użyć z danym agentem?”Zacznij od agenta, którego już używasz. Wbudowane opcje różnią się rodzajem: Claude Code i Copilot CLI zamieniają mowę na tekst promptu, a Codex CLI prowadzi rozmowę głosową.
| Agent | Wbudowany głos | Co robi | Wymaga | Sprawdzone w |
|---|---|---|---|---|
| Claude Code (CLI, agent view, rozszerzenie VS Code) | /voice, /voice hold, /voice tap, /voice off | Transkrypcja na żywo do promptu; mowę i pisanie można mieszać | logowanie claude.ai, lokalny mikrofon, WSLg przy pracy w WSL | dokumentacja dyktowania Claude Code, 2026-09-26 |
| Codex CLI | /voice, /voice settings, /voice mute, /voice stop, F8 | Rozmowa głosowa; Codex słucha i odpowiada na głos | macOS, kompilacja Windows oparta na MSVC albo Linuksa oparta na glibc | plik wykonywalny codex-cli 0.157.1 i informacje o wydaniach 0.155.0 oraz 0.156.0 |
| GitHub Copilot CLI | Ctrl+Space, /voice devices | Przełącza dyktowanie; /voice devices wybiera i zapamiętuje mikrofon | środowisko głosowe, które CLI samo pobiera | changelog github/copilot-cli 1.0.71 i 1.0.81 |
| Cursor | Głos w Agencie (tylko źródła wtórne, zob. zakładka Cursor) | Mowa do promptu Agenta | niesprawdzone na potrzeby tej strony | niesprawdzone: cursor.com niedostępny 2026-09-26 |
| Aider | /voice, potem Enter | Nagrywa, transkrybuje i wysyła; dojrzały, ale wydania zwalniają (ostatnie na PyPI 2026-02-12) | opcjonalne zależności głosowe Aidera | usage/voice.md w repozytorium Aidera i PyPI aider-chat, 2026-09-26 |
| Dowolne narzędzie | Dyktowanie w macOS, pisanie głosowe w Windows (Win+H) | Wpisuje tekst w aktywne okno | wsparcie systemu | dostawca systemu |
Każda wbudowana opcja z tabeli przesyła dźwięk do dostawcy. Dokumentacja Claude Code mówi: „Audio is not processed locally”. Changelog Copilot CLI nie mówi, gdzie działa transkrypcja, więc dopóki tego nie potwierdzisz, zakładaj chmurę.
Popularność na 2026-09-26: żaden dostawca nie publikuje liczb użycia funkcji głosowych, a liczby instalacji nie ma, bo funkcja jest częścią samego agenta (dossier narzędzi agentowych tej strony nie znalazło żadnej publicznej metryki). Datować da się za to wydania: changelog Claude Code wymienia 20 języków dyktowania od wersji 2.1.69 (opublikowanej w npm 2026-03-04), Copilot CLI dodał dyktowanie pod Ctrl+Space w 1.0.81 (2026-08-27), a Codex 0.156.0 (2026-09-22) włączył rozmowy głosowe domyślnie.
Ustaw dyktowanie w Claude Code w trybie tap
Dział zatytułowany „Ustaw dyktowanie w Claude Code w trybie tap”Tryb tap pasuje do długich odpowiedzi: stukasz raz, mówisz tyle, ile trzeba, i stukasz ponownie, żeby wysłać. W przeciwieństwie do trybu hold nie potrzebuje rozgrzewki opartej na powtarzaniu klawisza, która zawodzi w terminalach z wyłączonym powtarzaniem.
-
Sprawdź, czy jesteś zalogowany kontem claude.ai. Uruchom
/statusw Claude Code. Jeśli metodą logowania jest klucz API, Bedrock, Agent Platform w Google Cloud albo Microsoft Foundry, dyktowanie jest niedostępne; uruchom/logini zaloguj się przez claude.ai. -
Włącz dyktowanie w trybie tap:
/voice tapPo włączeniu Claude Code sprawdza mikrofon. Na macOS pierwsze uruchomienie wywołuje systemowe pytanie o uprawnienie dla aplikacji terminala.
-
Przy pustym prompcie stuknij
Space. W stopce pojawi się● REC · tap to send. Mów, a potem stuknijSpacejeszcze raz. Claude Code wstawia transkrypcję i wysyła ją, jeśli ma co najmniej trzy słowa, więc przypadkowe stuknięcie nigdy nie wyśle pojedynczego słowa. Nagrywanie kończy się też po 15 sekundach ciszy albo po dwóch minutach łącznie.EsclubCtrl+Codrzuca nagranie i przywraca poprzednią treść promptu. -
Żeby dyktować po polsku (albo w innym z 20 obsługiwanych języków), ustaw
languagew/configlub w~/.claude/settings.json. To samo ustawienie sprawia, że Claude odpowiada i nazywa sesje w tym języku:{"language": "polish","voice": {"enabled": true,"mode": "tap"}}/voicezapisuje obiektvoiceza ciebie i ustawienie przetrwa między sesjami. W trybie hold dodaj"autoSubmit": true, żeby wysyłać po puszczeniu klawisza; bez tego naciskaszEntersam. -
Opcjonalnie: zabierz dyktowanie ze
Space. Przypisz akcjęvoice:pushToTalkdo innego klawisza w~/.claude/keybindings.json; nowy klawisz zastępujeSpace(linia"space": nulltylko to jawnie zapisuje). Kombinacja z modyfikatorem, np.meta+k, zaczyna nagrywanie od pierwszego naciśnięcia w obu trybach, bez rozgrzewki:{"bindings": [{"context": "Chat","bindings": {"meta+k": "voice:pushToTalk","space": null}}]}
W trakcie mówienia słowa pojawiają się w prompcie przygaszone, a po sfinalizowaniu transkrypcji stają się pełne. Claude Code podaje nazwę projektu i gałęzi git jako podpowiedzi dla rozpoznawania mowy i jest dostrojony do terminów takich jak OAuth, JSON czy localhost. Nazw twoich tabel i funkcji na tej liście nie ma i dlatego workflow poniżej je sprawdza.
Według dokumentacji Claude Code transkrypcja nie zużywa wiadomości ani tokenów Claude’a i nie wlicza się do limitów w /usage. Koszt kontekstu jest taki sam jak dla wpisanego promptu tej samej długości, a dwuminutowa odpowiedź na głos potrafi dodać kilkaset słów.
Głos w Codeksie, Cursorze, Copilot CLI i innych narzędziach
Dział zatytułowany „Głos w Codeksie, Cursorze, Copilot CLI i innych narzędziach”Użyj konfiguracji z sekcji wyżej. Dyktowanie działa też w agent view: przytrzymaj lub stuknij klawisz push-to-talk, gdy aktywne jest pole dispatch albo odpowiedź w panelu podglądu, i dyktujesz do sesji w tle. Rozszerzenie VS Code obsługuje dyktowanie z tym samym wymogiem konta claude.ai, ale nie w sesjach VS Code Remote (SSH, Dev Containers, Codespaces), bo mikrofon jest na twojej maszynie, a rozszerzenie działa na zdalnym hoście.
W codex-cli 0.157.1 polecenie /voice w TUI uruchamia rozmowę głosową, a nie dyktowanie do promptu: Codex słucha i odpowiada na głos. Flaga funkcji in_app_dictation jest włączona, ale codex-cli 0.157.1 nie udostępnia w TUI polecenia dla tej flagi (sprawdzone 2026-09-26). Wydanie 0.156.0 włączyło rozmowy głosowe domyślnie i dodało przełącznik F8.
| Polecenie | Co robi |
|---|---|
/voice albo F8 | „Start or stop a voice conversation.” (brzmienie z pliku wykonywalnego) |
/voice settings | Wybiera głos; plik wykonywalny podaje, że wybór „Applies to your next voice conversation.” |
/voice mute | „Mute or unmute the voice microphone” (brzmienie z pliku wykonywalnego) |
/voice stop | Kończy rozmowę głosową (nasz opis; plik wykonywalny wymienia ten wariant bez opisu) |
Cztery warianty pochodzą z linii pomocy w pliku wykonywalnym: Usage: /voice [settings|mute|stop]. Jego komunikaty mówią, gdzie głos się nie uruchomi: „Start a conversation before using voice mode.”, „Voice mode is unavailable in side conversations.”, a sam głos „requires macOS, an MSVC-based Windows build, or a glibc-based Linux build”. codex-cli 0.157.1 z npm na Linuksie x64 jest skompilowany z musl, więc głos tam nie działa (sprawdzone 2026-09-26); użyj macOS, Windows albo kompilacji Codeksa opartej na glibc.
codex features list pokazuje w 0.157.1 flagi realtime_conversation i in_app_dictation, obie stabilne i włączone.
Changelog Cursora, cytowany przez źródła wtórne, opisuje głos w Agencie od Cursora 2.0 i „press and hold Ctrl+M” od Cursora 3.1. Nie potwierdziliśmy tego na cursor.com, który 2026-09-26 był dla nas niedostępny. Jeśli skróty klawiszowe Cursora nie pokazują przypisania głosu, użyj dyktowania systemowego w polu Agenta.
GitHub Copilot CLI przełącza dyktowanie skrótem Ctrl+Space (changelog 1.0.81, 2026-08-27). Mikrofon wybierzesz i zapamiętasz poleceniem:
/voice devicesPrzy pierwszym użyciu CLI pobiera środowisko głosowe. Od wersji 1.0.76 tryb głosowy na macOS i Windows wstrzymuje odtwarzane media na czas nagrywania.
Dyktowanie systemowe wpisuje tekst w aktywne okno, więc działa w agencie bez własnego głosu, w sesji SSH oraz w Claude Code na kluczu API, Bedrocku albo za bramką lub modelem lokalnym, gdzie /voice jest niedostępne. W macOS włączysz je w Ustawienia systemowe › Klawiatura › Dyktowanie; w Windows naciśnij Win+H, żeby pisać głosem.
Co tracisz: brak podpowiedzi z nazwy projektu i gałęzi oraz brak ochrony przed wysłaniem przypadkowego słowa. Komercyjne aplikacje do dyktowania dodają słownictwo programistyczne, ale to kolejny podmiot przetwarzający twoją mowę; przepuść je przez dział bezpieczeństwa jak każde nowe narzędzie SaaS.
Dyktuj odpowiedzi w sesji grill-me: workflow krok po kroku
Dział zatytułowany „Dyktuj odpowiedzi w sesji grill-me: workflow krok po kroku”Sesja /grill-me albo /grill-with-docs najlepiej pasuje do głosu, bo agent zadaje rundę ponumerowanych pytań, każde z rekomendowaną odpowiedzią, i czeka na twoje odpowiedzi. Twoim zadaniem jest każdą rekomendację przyjąć, odrzucić albo doprecyzować, a właśnie doprecyzowanie ludzie pomijają, kiedy muszą je wpisać. Ryzyko polega na tym, że specyfikacją staje się transkrypcja, a nie twoja intencja. Ten workflow zostawia pisanie tam, gdzie liczy się dokładność, i wstawia kontrolę między mowę a kod.
Zainstaluj skille do wywiadu w swoim agencie
Dział zatytułowany „Zainstaluj skille do wywiadu w swoim agencie”grill-with-docs jest częścią pakietu mattpocock/skills Matta Pococka. Zainstaluj go raz, przez plugin albo przez CLI skills, nie na oba sposoby: README pakietu ostrzega, że wtedy każdy skill pojawia się dwukrotnie. Sposób wywołania zależy od narzędzia.
# terminal: oficjalny marketplace, niczego nie trzeba dodawać wcześniejclaude plugin install mattpocock-skillsSkille z pluginów mają przestrzeń nazw, więc wywiad zaczynasz poleceniem /mattpocock-skills:grill-with-docs. Najpierw, raz na repozytorium, uruchom /mattpocock-skills:setup-matt-pocock-skills; zapyta, gdzie trzymać słownik i ADR-y. Plugin (1.2.3, 25 skilli) dodaje około 1600 tokenów stale ładowanych opisów skilli według pomiaru z dossier frameworków tej strony z 2026-09-26; u siebie sprawdzisz to przez /context.
# terminal, w katalogu głównym repozytoriumnpx skills add mattpocock/skills --skill grill-with-docs grilling domain-modeling setup-matt-pocock-skills -a codexCodex wywołuje skille znakiem $: raz uruchom $setup-matt-pocock-skills, a wywiad zaczynaj od $grill-with-docs.
# terminal, w katalogu głównym repozytoriumnpx skills add mattpocock/skills --skill grill-with-docs grilling domain-modeling setup-matt-pocock-skills -a cursorW polu Agenta raz uruchom /setup-matt-pocock-skills, a wywiad zaczynaj od /grill-with-docs.
Przeprowadź wywiad głosem
Dział zatytułowany „Przeprowadź wywiad głosem”-
Zacznij sesję na klawiaturze. Wpisz polecenie swojego narzędzia z zakładek wyżej, spację, a potem wklej pierwszy prompt z ramki poniżej. Polecenia, ścieżki i identyfikatory szybciej i bezpieczniej się wpisuje, niż mówi.
-
Na każde pytanie odpowiadaj głosem. W Claude Code z
/voice tap: stuknij, mów, stuknij. Agent zadaje ponumerowaną rundę pytań, więc każdą odpowiedź zaczynaj od numeru pytania, a potem trzymaj się tych samych czterech części: decyzja, powód, ograniczenie i to, co zmieniłoby twoje zdanie. „P3: proporcjonalnie do dnia, bo finanse uzgadniają rozliczenia codziennie, z wyjątkiem planów rocznych, które zachowują stanowisko do odnowienia; zmieniłbym to, gdyby Stripe nie obsługiwał dziennych korekt”. -
Identyfikatory wpisuj. W trybie tap drugie stuknięcie wysyła odpowiedź, więc nie da się w nim zrobić pauzy na pisanie. Gdy odpowiedź musi zawierać nazwę tabeli, kolumny, funkcji albo flagi, przełącz się na
/voice hold(bezautoSubmit): przytrzymajSpacei mów, puść, wpisz nazwę, przytrzymaj ponownie, żeby mówić dalej, i naciśnijEnter, gdy odpowiedź jest gotowa. Claude Code wstawia każdą transkrypcję w miejscu kursora, więc mowa i pisanie mieszają się w jednym prompcie. -
Zanim cokolwiek zostanie zapisane, poproś o odczyt kontrolny. Na koniec wywiadu użyj drugiego promptu poniżej. Agent wypisze każdą decyzję razem z twoimi dosłownymi słowami i oznaczy to, co wygląda na źle usłyszane. Czytasz tę listę, a nie transkrypcję.
-
Zamień decyzje na coś, co sprawdza maszyna. Trzecim promptem wygeneruj kryteria akceptacji i czerwone testy. W
/grill-with-docsustalone pojęcia trafiają doGLOSSARY.md, a twarde decyzje do ADR-ów; przejrzyj te zmiany przezgit diff, bo przetrwają dłużej niż rozmowa. Repozytoria skonfigurowane starszą wersją skilli mogą mieć jeszczeCONTEXT.md, czyli nazwę, której skille używały przed przejściem naGLOSSARY.md(README mattpocock/skills, sprawdzone 2026-09-26); zmień jej nazwę poleceniemgit mv. -
Zatwierdzasz artefakty, nie nagranie. Akceptujesz odczyt kontrolny, kryteria akceptacji i czerwone testy. Dalej budowa idzie jak każda zmiana prowadzona specyfikacją: dowodem są testy, które przechodzą na zielono, i nikt nie odtwarza tego, co powiedziałeś.
Skąd wiesz, że agent usłyszał to, co miałeś na myśli?
Dział zatytułowany „Skąd wiesz, że agent usłyszał to, co miałeś na myśli?”Nie sprawdzasz transkrypcji słowo po słowie. Sprawdzasz trzy artefakty, przez które źle usłyszane słowo się nie prześlizgnie:
- Listę z odczytu kontrolnego. Każda decyzja w jednym zdaniu obok twoich zacytowanych słów. Zły cytat to błąd transkrypcji; dobry cytat ze złą decyzją to nieporozumienie. Jedno i drugie wychodzi tutaj, zanim powstanie jakikolwiek kod.
- Kryteria akceptacji i czerwone testy. Źle usłyszane „roczny” zamienione na „równy” staje się linią Given/When/Then, którą czytasz w kilka sekund, a test, który pada z podanego powodu, dowodzi, że kryterium da się wykonać.
- Zmiany w
GLOSSARY.mdi ADR-ach z/grill-with-docs. Pojęcia w słowniku muszą odpowiadać nazwom w kodzie. Pojęcie, którego nie ma nigdzie w repozytorium, to prawie zawsze artefakt transkrypcji.
Programista, który prowadził wywiad, zatwierdza odczyt kontrolny i czerwone testy. W zespole recenzent pull requesta czyta kryteria akceptacji i ADR-y, a nie zapis rozmowy.
Jak wdrożyć sterowanie głosem w zespole
Dział zatytułowany „Jak wdrożyć sterowanie głosem w zespole”Dla tech leada pytania dotyczą przetwarzania danych i tego, gdzie to działa, a nie tego, czy ludziom się podoba.
| Do sprawdzenia | Dlaczego to ważne | Co zrobić |
|---|---|---|
| Dokąd trafia dźwięk? | Claude Code przesyła dźwięk do Anthropic do transkrypcji; głos w Codeksie to rozmowa na żywo z usługą OpenAI | Traktuj mowę jak tekst promptu w ramach polityki danych dla AI; przeczytaj stronę Claude Code o wykorzystaniu danych |
| Jak loguje się zespół? | Dyktowanie w Claude Code wymaga logowania claude.ai; konfiguracje z kluczem API, Bedrockiem, Agent Platform i Foundry go nie użyją | Jeśli standardem jest dostawca chmurowy, zaplanuj dyktowanie systemowe |
| Gdzie ludzie pracują? | Brak dyktowania przez SSH, w sesjach w chmurze oraz w VS Code Remote, Dev Containers i Codespaces | W środowiskach zdalnych używaj dyktowania systemowego na lokalnej maszynie |
| Czy da się to wyłączyć? | Polityka administratora może wyłączyć dyktowanie w Claude Code; użytkownicy widzą wtedy Voice mode is disabled by your organization's policy | Zdecyduj przed wdrożeniem, a nie po pierwszej skardze |
| Wspólne biura | Mówione prompty zawierają nazwy klientów i szczegóły incydentów | Słuchawki i push-to-talk (tryb hold) w open space |
Co psuje się przy dyktowaniu i jak to naprawić
Dział zatytułowany „Co psuje się przy dyktowaniu i jak to naprawić”| Objaw | Przyczyna | Naprawa |
|---|---|---|
Voice mode requires a Claude.ai account | Logowanie kluczem API albo przez zewnętrznego dostawcę | /login przez claude.ai albo dyktowanie systemowe |
Przytrzymanie Space wpisuje spacje i nic się nie nagrywa | Dyktowanie jest wyłączone albo terminal nie wysyła powtórzeń klawisza | /voice hold, żeby je włączyć; jeśli pojawią się jedna czy dwie spacje i koniec, przejdź na /voice tap |
Stuknięcie Space w trybie tap wpisuje spację | Pierwsze stuknięcie nagrywa tylko przy pustym prompcie | Wyczyść prompt albo przypisz meta+k |
Microphone access is denied | Aplikacja terminala nie ma uprawnień do mikrofonu | macOS: Ustawienia systemowe › Prywatność i ochrona › Mikrofon; Windows: zezwól aplikacjom desktopowym na dostęp do mikrofonu; uruchom /voice ponownie |
| Terminala brak na liście mikrofonu w macOS | Nieaktualny stan uprawnień | tccutil reset Microphone com.apple.Terminal (albo bundle ID twojego terminala), potem zamknij terminal (Cmd+Q) i uruchom go ponownie |
Voice mode requires SoX for audio recording na Linuksie | Natywny moduł audio się nie załadował, a zapasowego nagrywania brak | Zainstaluj SoX poleceniem podanym w komunikacie |
could not find a working audio recorder in WSL | SoX nie ma backendu PulseAudio | sudo apt install sox libsox-fmt-pulse |
Voice input is failing repeatedly and has been paused | Trzy błędy w ciągu 10 sekund, zwykle brak urządzenia nagrywającego (serwer bez monitora, zdalna powłoka) | Napraw urządzenie, odczekaj 10 sekund, spróbuj ponownie |
Voice stream error: WebSocket upgrade rejected with HTTP 4xx | Nieaktualne logowanie albo proxy lub usługa anty-botowa odpowiada zamiast serwera | /login; sprawdź VPN albo proxy na trasie |
| Zniekształcony tekst albo zły język | Domyślnym językiem dyktowania jest angielski | Najpierw ustaw language w /config |
/voice w Codeksie się nie uruchamia | Brak rozpoczętej rozmowy, rozmowa poboczna albo nieobsługiwana kompilacja | Wyślij pierwszą wiadomość albo wróć do głównego wątku. Nieobsługiwana kompilacja: codex-cli 0.157.1 z npm na Linuksie x64 jest skompilowany z musl (zobacz zakładkę Codex) |
Gdy źle usłyszana odpowiedź już dotarła do agenta, nie spieraj się z transkrypcją w kolejnej turze. W Claude Code naciśnij dwa razy Esc przy pustym prompcie, żeby otworzyć menu cofania i przywrócić rozmowę sprzed tej odpowiedzi, albo wpisz poprawkę wprost („Correction to decision 4: the column is seat_count, not seed count”) i poproś o odczyt kontrolny jeszcze raz.
Dokąd dalej z planowaniem prowadzonym głosem
Dział zatytułowany „Dokąd dalej z planowaniem prowadzonym głosem”- Grill Me i Grill With Docs — skille do wywiadu, na których opiera się ten workflow.
- Wykonywalne kryteria akceptacji — jak zamienić potwierdzone decyzje w sprawdzenia.
- Programowanie prowadzone specyfikacją — pętla budowy, gdy testy są już czerwone.
- Tryb planowania — bramka przed wykonaniem, gdy wywiad się skończy.
- Zdalni i mobilni klienci agentów — sterowanie agentami z dala od biurka.
- Przegląd narzędzi agentowych — reszta narzędzi wokół agenta.
Najczęstsze pytania
Jak dyktować prompty w Claude Code?
Włącz dyktowanie poleceniem /voice i przytrzymaj spację, mówiąc, albo uruchom /voice tap: jedno stuknięcie spacji zaczyna nagrywanie, drugie wysyła. Potrzebujesz logowania kontem claude.ai i lokalnego mikrofonu; dyktowanie nie działa z kluczem API, Bedrockiem, Agent Platform w Google Cloud, Microsoft Foundry, przez SSH ani w sesjach w chmurze.
Czy mogę dyktować do Claude Code po polsku?
Tak. Dyktowanie obsługuje 20 języków, w tym polski. Korzysta z ustawienia language, które decyduje też o języku odpowiedzi Claude'a, więc ustawienie polskiego zmienia jedno i drugie.
Czy Codex CLI ma dyktowanie głosowe?
Nie jako dyktowanie do promptu. W codex-cli 0.157.1 polecenie /voice w TUI uruchamia rozmowę głosową, a nie dyktowanie do promptu; flaga in_app_dictation jest włączona, ale codex-cli 0.157.1 nie udostępnia w TUI polecenia dla tej flagi (sprawdzone 2026-09-26). /voice włącza i wyłącza rozmowę, /voice settings wybiera głos, a F8 działa jak przełącznik. Wymaga macOS, kompilacji Windows opartej na MSVC albo kompilacji Linuksa opartej na glibc.
Czy dyktowanie kosztuje tokeny?
W Claude Code nie: dokumentacja mówi, że transkrypcja nie zużywa wiadomości ani tokenów Claude'a i nie wlicza się do limitów w /usage. Prompt powstały z transkrypcji kosztuje tyle samo co wpisany ręcznie.