Technologia

GPT-Live przynosi full-duplex do ChatGPT — pauza, która zdradzała AI, zniknęła

Adrian Kessler

OpenAI zastąpiło 10 lipca 2026 r. swój naprzemienno-turowy Advanced Voice Mode platformą GPT-Live, automatycznie przenosząc 150 milionów cotygodniowych użytkowników głosowych na architekturę równoległego przetwarzania — bez okna opt-in i bez ogłoszonej daty wycofania.

Pauza na końcu każdej rozmowy głosowej z ChatGPT miała nieomylny sygnał. Model kończył przetwarzanie, generował odpowiedź i dopiero wtedy oddawał głos. Ten rytm — zwany naprzemiennym — przez lata definiował działanie większości komercyjnych systemów głosowych AI od pierwszych wdrożeń. OpenAI wyeliminowało go za pomocą GPT-Live.

GPT-Live działa na architekturze full-duplex, przetwarzając napływającą mowę i jednocześnie generując odpowiedź. OpenAI uruchomiło GPT-Live-1 dla płatnych abonentów planów Go, Plus i Pro oraz GPT-Live-1 mini dla użytkowników bezpłatnych — oba 10 lipca, bez okna potwierdzenia, globalnie zastępując Advanced Voice Mode.

Praktyczna zmiana polega na możliwości przerwania modelu w pół zdania — i on się zatrzymuje. GPT-Live rejestruje krótkie wtrącenia, pytania lub zmiany kierunku bez wymogu, by ktokolwiek z uczestników kończył swoją wypowiedź. Może sygnalizować uwagę krótkim «mhm» lub «tak», gdy druga osoba jeszcze myśli, albo po prostu milczeć, aż myśl nabierze kształtu. Gdy rozmowa wymaga wyszukiwania w sieci, głębszego rozumowania lub złożonej pracy, GPT-Live po cichu deleguje zadanie do modelu frontier działającego w tle i zwraca wynik do bieżącej wymiany.

Architektura full-duplex nie sprawia, że GPT-Live lepiej rozumie to, co się mówi — sprawia, że naturalniej reaguje na rytm tego, jak się mówi. Ta różnica ma znaczenie. Pierwsi użytkownicy odnotowali wzorzec wytwarzany przez własny entuzjazm modelu: GPT-Live potwierdzał czasem stwierdzenie, zanim zakończył przetwarzanie jego pełnego znaczenia, zwłaszcza przy długich i gęstych wyjaśnieniach. Niektórzy uznali wtrącenia za zbyt nachalnie entuzjastyczne. System działa w całości na serwerach OpenAI, przez co każda rozmowa głosowa zależy od połączenia o niskim opóźnieniu, którego nie wszyscy ze 150 milionów cotygodniowych użytkowników mają w równym stopniu. Regiony z wolniejszą infrastrukturą mogą przekonać się, że ambicje czasu rzeczywistego GPT-Live wyprzedzają realia sieciowe.

OpenAI przeniosło całą aktywną głosowo bazę użytkowników na nowy system bez proszenia o zgodę. Firma opisuje GPT-Live jako ulepszenie — i przejście na full-duplex to realny postęp w płynności konwersacji. Oznacza jednak też zmianę modelu interakcji, do którego miliony dostosowały swoje oczekiwania, bez podanej daty wycofania poprzedniego systemu.

Nie ogłoszono zmian cen dla obecnych abonentów ChatGPT. Planowane jest udostępnienie API dla deweloperów i firm, a rejestracja na wczesny dostęp jest już dostępna. OpenAI nie potwierdziło, kiedy Advanced Voice Mode zostanie oficjalnie wycofane.

Tagi: , , , , ,

Dyskusja

Jest 0 komentarzy.