Ключові тези
OpenAI кардинально оновила голосову архітектуру ChatGPT, щоб забезпечити безперервну передачу аудіо без пауз. Нова система GPT-Live дозволяє ChatGPT слухати й говорити одночасно. Запуск голосової сесії скоротився із шести мережевих обмінів до одного. Аудіо проходить виділеним швидким каналом, тоді як міркування й виклик інструментів виконуються асинхронно. OpenAI опублікувала детальний технічний розбір цієї перебудови.
OpenAI повністю перезапустила голосову інфраструктуру, на якій працює ChatGPT, представивши нову архітектуру GPT-Live. Вона підтримує безперервний аудіопотік, тож складніші міркування та виклики інструментів більше не «рвуть» розмову на паузи.
Компанія описала зміни у серії дописів 3 серпня та опублікувала блог із технічним роз’ясненням, як система була перебудована — від клієнта до моделі. За даними OpenAI, запуск голосової сесії скоротився із шести мережевих «раундапів» до одного.
Як працює GPT-Live
GPT-Live спрямовує аудіо виділеним високошвидкісним каналом, відокремленим від контуру міркування та виклику інструментів. Поглиблені обчислення виконуються асинхронно — у фоновому режимі, не зупиняючи аудіострім.
У результаті голосова сесія стартує помітно швидше й триває без розривів, з якими користувачі раніше стикалися, коли ChatGPT опрацьовував складні запити.
У дописі OpenAI наголосила, що нова архітектура по-іншому обробляє сам момент старту сесії, завдяки чому спілкування здається природнішим уже з першої репліки. Перебудова усуває структурне обмеження попереднього стека, де будь-який крок міркування змушував голосовий шар чекати.
Читайте також: Cosmos Hub зростає на 6% на тлі відродження міжланцюгової тези
GPT-Live: ставка OpenAI на скорочення затримок у голосовому ChatGPT
Від 2026 року OpenAI агресивно нарощує голосові можливості продуктів. Раніше цього року компанія зазнала критики за те, що голосові відповіді ChatGPT звучали «дерев’яно» й надто повільно при обробці багатоетапних запитів. Перезапуск стеку у вигляді GPT-Live фактично є прямою інженерною відповіддю OpenAI на ці зауваження.
Реліз відбувся після того, як минулого місяця OpenAI розкрила результати тестування внутрішньої версії свого наступного великого моделя: система згенерувала десять нових математичних результатів при витратах на токени близько $2 000. Це сигналізує про масштабні інвестиції в інфраструктуру по всій продуктовій лінійці.
Далі до теми: Qwen та DeepSeek підштовхують китайський ШІ впритул до Anthropic






