OpenAI 23 września 2026 roku rozszerzyło mobilnego ChatGPT o funkcje, które zmieniają Voice z interfejsu do rozmowy w sposób sterowania agentem wykonującym rzeczywistą pracę. Użytkownik może teraz z telefonu głosowo uruchomić zadanie w ChatGPT Work, a następnie zlecić m.in. przygotowanie dokumentu, prezentacji lub arkusza, pracę z połączonymi aplikacjami czy wykonanie wieloetapowego zadania w przeglądarce. Funkcja działa na urządzeniach mobilnych, więc do rozpoczęcia pracy agenta nie jest już potrzebny komputer.
Zmiana jest istotna, ponieważ do tej pory mobilny Voice służył przede wszystkim do naturalnej rozmowy z ChatGPT. Teraz wypowiedziane polecenie może rozpocząć zadanie wykonywane przez Work. Jeżeli użytkownik zakończy rozmowę głosową, zanim agent skończy pracę, zadanie może być kontynuowane w formie tekstowej. Można więc rozpocząć pracę podczas spaceru lub jazdy komunikacją, a później wrócić do rezultatów na ekranie.
Równolegle OpenAI rozszerza możliwości samego Voice o wtyczki i połączone aplikacje. Użytkownicy planów Free i Go mogą korzystać głosowo z pluginów dostępnych w ich planie, natomiast dostęp do Work zależy od posiadania zarówno funkcji Voice, jak i Work. TechCrunch wskazuje, że w ofercie konsumenckiej głosowe Work trafia przede wszystkim do użytkowników Plus i Pro.
Najważniejsze informacje:
- nowe funkcje zostały ogłoszone 23 września 2026 roku,
- Voice działa teraz w ChatGPT Work także na urządzeniach mobilnych,
- użytkownik może głosowo zlecić utworzenie dokumentu, prezentacji lub arkusza kalkulacyjnego,
- Work może korzystać z połączonych aplikacji i przeglądarki,
- TechCrunch informuje także o możliwości zlecania takich zadań jak tworzenie stron czy podsumowywanie wiadomości ze Slacka,
- niedokończone zadanie może kontynuować pracę tekstowo po zakończeniu rozmowy głosowej,
- użytkownik może płynnie przechodzić między głosem a tekstem,
- Voice obsługuje teraz wtyczki na iOS, Androidzie i w przeglądarce,
- użytkownicy Free i Go mogą korzystać w Voice z pluginów obsługiwanych przez ich plan,
- dostęp do poszczególnych funkcji nadal zależy od planu, regionu, aplikacji, uprawnień i ustawień przestrzeni roboczej.
ChatGPT Work dostaje obsługę głosową na telefonach
Największą zmianą jest rozszerzenie Voice na ChatGPT Work w wersji mobilnej. Work jest środowiskiem przeznaczonym do wykonywania bardziej złożonych, wieloetapowych zadań, a nie wyłącznie odpowiadania na pytania w konwersacji. Po aktualizacji użytkownik może wejść do Work na telefonie, uruchomić rozmowę głosową i powiedzieć agentowi, co ma przygotować. Nie musi więc najpierw opisywać zadania na klawiaturze ani czekać, aż znajdzie się przy komputerze.
Oficjalna dokumentacja OpenAI wymienia możliwość tworzenia dokumentów, prezentacji i arkuszy, korzystania z połączonych aplikacji oraz pracy w przeglądarce. TechCrunch dodaje do tej listy przykłady takie jak napisanie wiadomości, podsumowanie rozmów ze Slacka czy przygotowanie strony internetowej. Zakres konkretnego zadania zależy jednak od narzędzi dostępnych dla danego użytkownika i jego planu.
Najważniejsza różnica względem klasycznego trybu głosowego polega na tym, że rozmowa może uruchamiać pracę, a nie tylko kończyć się odpowiedzią. Voice staje się więc warstwą sterowania agentem. Użytkownik określa cel naturalnym językiem, natomiast Work może wykonać kolejne etapy zadania przy użyciu dostępnych narzędzi.
To szczególnie istotne na smartfonie, gdzie wpisywanie długich instrukcji bywa niewygodne. Polecenie wymagające kilku zdań można po prostu wypowiedzieć i pozwolić agentowi rozpocząć pracę w tle rozmowy.
Dokumenty, prezentacje, Slack i przeglądarka. Co można zlecić ChatGPT głosem?
OpenAI podaje kilka konkretnych przykładów zastosowania. W Work można powiedzieć ChatGPT, aby utworzył dokument, przygotował prezentację, zbudował arkusz kalkulacyjny albo skorzystał z przeglądarki. Jeśli użytkownik ma podłączone kompatybilne aplikacje, agent może również pracować na udostępnionych przez nie danych zgodnie z wcześniej nadanymi uprawnieniami.
TechCrunch opisuje scenariusze obejmujące przygotowanie wiadomości, podsumowanie Slacka, tworzenie stron oraz korzystanie z chmurowej przeglądarki. To pokazuje, że mobilne Voice nie służy wyłącznie do dyktowania gotowego tekstu. Użytkownik może przekazać cel, a Work dobiera dostępne narzędzia potrzebne do jego wykonania.
Przykładowe polecenie może więc brzmieć znacznie bardziej naturalnie niż klasyczny prompt wpisywany na komputerze: użytkownik może poprosić o przejrzenie materiałów z podłączonego źródła, wyciągnięcie najważniejszych informacji i zbudowanie na ich podstawie prezentacji. Jeżeli zadanie wymaga dostępu do zewnętrznej aplikacji, nadal obowiązują jej istniejące uprawnienia oraz ograniczenia.
To właśnie integracja głosu z narzędziami Work jest sednem aktualizacji. Rozpoznawanie mowy samo w sobie nie jest nowością. Nowością jest możliwość zamiany wypowiedzianej instrukcji w wieloetapowe zadanie agentowe, którego efektem może być gotowy artefakt lub wykonana praca, a nie tylko wygenerowany tekst.
Rozmowę można zakończyć, a Work nadal będzie wykonywać zadanie
Jedna z praktyczniejszych funkcji dotyczy sytuacji, w której zadanie trwa dłużej niż sama rozmowa głosowa. OpenAI potwierdza, że jeżeli użytkownik zakończy połączenie Voice, zanim Work skończy działanie, niedokończone zadanie może być dalej realizowane w trybie tekstowym. Rezultaty pozostają następnie dostępne w tej samej rozmowie.
Zmienia to sposób korzystania z ChatGPT na telefonie. Rozmowa nie musi trwać przez cały czas wykonywania pracy. Można wydać polecenie głosem, doprecyzować wymagania i zamknąć tryb Voice, a później sprawdzić rezultat. TechCrunch zwraca też uwagę na możliwość rozpoczęcia rozmowy w ruchu i późniejszego kontynuowania pracy na komputerze.
Voice ma jednocześnie prezentować bogatsze odpowiedzi tekstowe bezpośrednio w czacie. Użytkownik może więc słuchać rozmowy i równolegle obserwować na ekranie tworzone treści, wyniki lub elementy wymagające sprawdzenia. OpenAI rozwija w ten sposób jeden wspólny kontekst zamiast traktować głos jako osobny tryb, po którego zakończeniu trzeba rozpoczynać pracę od nowa.
W praktyce smartfon może stać się punktem startowym zadania, a nie urządzeniem, na którym koniecznie trzeba je zakończyć. To szczególnie przydatne przy dłuższych procesach, takich jak research, tworzenie dokumentu czy przygotowywanie większej prezentacji.
Free i Go dostają pluginy i połączone aplikacje w Voice
Aktualizacja nie ogranicza się do płatnego Work. OpenAI uruchomiło również obsługę pluginów w rozmowach głosowych na webie, iOS i Androidzie. Użytkownicy Free i Go mogą korzystać podczas rozmowy z pluginów obsługiwanych przez ich plan, dzięki czemu Voice może sięgać poza własną wiedzę modelu i pracować z dodatkowymi usługami.
Połączone aplikacje mogą udostępniać ChatGPT informacje z usług takich jak Dysk Google czy Slack. W zależności od konkretnej integracji można np. znaleźć plik, podsumować dokument, odszukać wiadomość albo wykonać obsługiwaną akcję. OpenAI zaznacza jednak, że dostępność poszczególnych funkcji zależy od aplikacji, planu, regionu, modelu i używanego interfejsu. Nie każda integracja musi więc obsługiwać identyczny zakres działania w Voice.
To ważne rozróżnienie względem Work. Użytkownik bez dostępu do Work nadal może wykorzystać rozmowę głosową razem z dostępnymi pluginami i aplikacjami. Nie otrzymuje jednak automatycznie pełnego środowiska agentowego pozwalającego wykonywać wszystkie zadania dostępne w Work.
OpenAI stopniowo rozdziela więc dwa poziomy funkcjonalności. Voice w Chat staje się bogatszą rozmową zdolną korzystać z narzędzi, natomiast Voice w Work pozwala użyć głosu do uruchamiania i koordynowania pracy agenta.
To już nie jest tylko ChatGPT, który odpowiada głosem
Mobilny tryb Voice przez długi czas był przede wszystkim alternatywnym sposobem prowadzenia konwersacji. Użytkownik mówił zamiast pisać, a ChatGPT odpowiadał głosem. Aktualizacja z 23 września przesuwa granicę znacznie dalej: wypowiedziane zdanie może zostać potraktowane jako instrukcja rozpoczęcia realnego procesu wykonywanego przez agenta.
Różnica jest fundamentalna. Pytanie „jak przygotować prezentację na podstawie tych materiałów?” prowadzi do odpowiedzi z instrukcjami. Polecenie „przygotuj prezentację na podstawie tych materiałów” może w Work prowadzić do stworzenia samego dokumentu. Podobnie wygląda sytuacja z researchiem, arkuszami, połączonymi aplikacjami czy zadaniami wykonywanymi w przeglądarce.
Smartfon staje się dzięki temu czymś w rodzaju pilota do agenta AI. Jego mały ekran przestaje być tak dużym ograniczeniem, ponieważ użytkownik nie musi wykonywać każdego kroku ręcznie ani wpisywać rozbudowanej instrukcji. Najważniejszym interfejsem może być rozmowa.
To również jeden z przykładów szerszej zmiany zachodzącej w aplikacjach AI. Modele przestają konkurować wyłącznie jako chatboty generujące najlepsze odpowiedzi. Coraz większe znaczenie ma zdolność do korzystania z zewnętrznych narzędzi, utrzymywania kontekstu oraz wykonywania zadań, które wcześniej wymagały kilku osobnych aplikacji i ręcznych działań użytkownika.
Voice nie omija uprawnień. Dostęp do aplikacji pozostaje kontrolowany
Możliwość wydawania głosowych poleceń agentowi nie oznacza automatycznego dostępu ChatGPT do wszystkich danych i usług użytkownika. OpenAI podkreśla, że Voice korzysta wyłącznie z narzędzi i uprawnień dostępnych w wybranym środowisku, a pluginy zachowują istniejące zasady dostępu, ograniczenia działań i wymagania dotyczące autoryzacji.
To samo dotyczy połączonych aplikacji. Jeżeli użytkownik podłączy np. usługę przechowującą dokumenty albo komunikator firmowy, ChatGPT może pracować tylko w zakresie udostępnionym przez konkretną integrację i przyznane zgody. Dostępność funkcji może dodatkowo zależeć od administratora przestrzeni roboczej, szczególnie w środowiskach firmowych.
Ma to szczególne znaczenie przy głosowym sterowaniu, ponieważ wydanie polecenia staje się znacznie łatwiejsze i szybsze. Sama wygoda interfejsu nie powinna jednak oznaczać pominięcia zabezpieczeń. Jeśli wykonanie operacji wymaga potwierdzenia lub aplikacja nie pozwala na określone działanie, Voice nie otrzymuje specjalnego obejścia tylko dlatego, że instrukcja została wypowiedziana.
OpenAI zaznacza również, że obowiązują standardowe limity wykorzystania Work i narzędzi. Głos jest więc nowym sposobem sterowania istniejącymi możliwościami, a nie oddzielnym systemem z nieograniczonym dostępem do danych użytkownika.
ChatGPT Work na telefonie – kto dostaje nowe funkcje?
Według TechCrunch głosowe funkcje agentowe w mobilnym Work są kierowane w pierwszej kolejności do użytkowników ChatGPT Plus i Pro. Oficjalna dokumentacja OpenAI opisuje to nieco szerzej: Voice w Work wymaga jednocześnie dostępu do Voice oraz samego Work, dlatego dostępność może różnić się w zależności od planu i typu przestrzeni roboczej.
OpenAI udostępnia Work również w wybranych środowiskach profesjonalnych, dlatego sam podział Free–Plus–Pro nie opisuje całej sytuacji. W organizacjach Business, Enterprise czy Edu znaczenie mają także ustawienia administratora i dostęp użytkownika do poszczególnych funkcji. Firma zaznacza, że możliwości mogą zależeć również od regionu oraz wykorzystywanego interfejsu.
Użytkownicy Free i Go otrzymują natomiast ważną część aktualizacji dotyczącą Voice w zwykłym Chat. Mogą korzystać głosowo z pluginów i połączonych aplikacji obsługiwanych przez ich plan. Nie oznacza to jednak automatycznego otrzymania Work i pełnego zestawu narzędzi agentowych.
W praktyce aktualizacja jest więc wdrażana dwutorowo. OpenAI rozszerza zwykły Voice o narzędzia dla szerszej grupy użytkowników, a jednocześnie daje osobom posiadającym Work możliwość uruchamiania znacznie bardziej rozbudowanych procesów bezpośrednio głosem ze smartfona.
ChatGPT Work i głosowe wykonywanie zadań – podsumowanie i wnioski
Rozszerzenie ChatGPT Work o Voice na telefonach jest czymś więcej niż kolejną aktualizacją rozmów głosowych. OpenAI przenosi na urządzenia mobilne możliwość wydawania agentowi poleceń dotyczących tworzenia dokumentów, prezentacji i arkuszy, korzystania z połączonych aplikacji oraz wykonywania pracy w przeglądarce. Użytkownik nie musi już rozpoczynać takich zadań przy komputerze.
Najważniejsza zmiana zachodzi w sposobie interakcji. Smartfon nie musi być miejscem, w którym użytkownik ręcznie wykonuje wszystkie czynności. Może stać się prostym interfejsem do przekazania celu: głos uruchamia zadanie, Work wykonuje kolejne kroki, a rezultaty można później przejrzeć w tekście lub kontynuować na innym urządzeniu.
Równolegle pluginy i połączone aplikacje trafiają do Voice w zwykłym Chat, również dla użytkowników Free i Go w zakresie obsługiwanym przez ich plany. W efekcie granica między „rozmową z AI” a „zlecaniem pracy AI” staje się coraz mniej wyraźna.
To prawdopodobnie właśnie ten kierunek będzie najważniejszy dla kolejnych generacji mobilnych asystentów. Telefon przestaje być jedynie ekranem, na którym chatbot odpowiada na pytania. Coraz częściej ma być miejscem, z którego jednym poleceniem można uruchomić agenta wykonującego rzeczywistą pracę — nawet wtedy, gdy użytkownik po chwili chowa urządzenie do kieszeni.
Źródła: OpenAI, OpenAI Help Center, TechCrunch. Opracowanie własne.
Dziękujemy za przeczytanie artykułu na Techoteka.pl.
Codziennie publikujemy najważniejsze informacje z Polski i ze świata dotyczące technologii, sztucznej inteligencji, nowych rozwiązań cyfrowych oraz trendów technologicznych, które kształtują przyszłość.
Obserwuj nas na Facebooku, aby być na bieżąco z najważniejszymi wydarzeniami ze świata technologii.



