OpenAI добавила голосовое управление в десктопный ChatGPT — теперь можно диктовать команды агентам
Теперь можно голосом управлять AI-агентами, запускать код-ревью и контролировать приложения через ChatGPT Voice на macOS и Windows.

OpenAI выпустила обновление десктопного приложения ChatGPT с поддержкой голосового режима ChatGPT Voice. Теперь пользователи могут голосом управлять AI-агентами в ChatGPT Work и Codex, выполнять многошаговые задачи на компьютере и давать доступ к содержимому экрана (macOS). Функция работает на базе новых голосовых моделей ChatGPT-Live, представленных в начале июля 2026 года.
Что умеет новый голосовой режим
ChatGPT Voice в десктопной версии заметно мощнее мобильной. Если смартфон-версия научилась плавно вести диалог и корректно обрабатывать прерывания, но не выполняла действия, то десктопное обновление позволяет диктовать сложные команды из нескольких шагов и отвечать, когда ChatGPT запрашивает уточнение.
В демо-ролике разработчик одной фразой просит ChatGPT создать новый тред, оформить pull request и найти причину бага — и модель выполняет всё последовательно, запрашивая подтверждения по ходу.
Голосовой режим работает с ChatGPT Work (управление проектами и задачами) и Codex (код и автоматизация). На macOS через функцию Appshots можно предоставить доступ к содержимому экрана, включая alt-текст — ChatGPT будет видеть, что открыто в браузере или редакторе, и действовать с учётом контекста.
Что внутри: GPT-Live и удалённый доступ
Функция построена на семействе моделей ChatGPT-Live, которое OpenAI анонсировала в июле 2026. Эти модели умеют одновременно говорить, слушать и координировать работу в приложении — без задержек на переключение режимов.
Для пользователей iOS доступ к ChatGPT Voice в Codex реализован через удалённое подключение: можно запустить голосовой режим на телефоне, а агент будет работать на десктопе.
Бесплатные пользователи получают доступ к базовой модели GPT-Live-1-mini, платные подписчики всех уровней — к полной GPT-Live-1 с расширенными возможностями.
Anthropic догоняет с Claude
OpenAI не единственная, кто усиливает голосовые интерфейсы. Anthropic тоже обновила голосовой режим для Claude: теперь он работает с моделями Opus, Sonnet и Haiku и интегрируется с Gmail, Calendar, Slack, Notion и Canva. Это прямая конкуренция за автоматизацию рабочих процессов через голос.
Пока OpenAI акцентирует управление агентами и кодом, Anthropic делает ставку на встраивание в популярные SaaS-инструменты. Оба подхода нацелены на одну аудиторию: разработчиков, продуктологов и всех, кто работает с многошаговыми задачами.
Где это полезно прямо сейчас
Голосовое управление агентами снимает трение в сценариях, где руки заняты или нужно быстро продиктовать серию действий:
- Код-ревью и отладка: попросить создать ветку, найти баг, написать тест — одной командой.
- Управление проектами: добавить задачу, обновить статус, переназначить исполнителя через ChatGPT Work.
- Работа с документами и скриншотами: на macOS можно показать ChatGPT содержимое экрана и попросить, например, извлечь данные из таблицы или описать интерфейс.
Ограничение: пока голосовой режим нельзя включить в уже начатом чате — нужно открывать новую сессию сразу с голосом.
Что дальше
OpenAI развернула ChatGPT Voice в десктопном приложении глобально 23 июля. Следующий шаг, вероятно, — интеграция с большим числом внешних инструментов (сейчас акцент на собственных Work и Codex) и улучшение работы с контекстом в длинных сессиях.
Anthropic уже показала, как можно встроить голосовой интерфейс в десятки сторонних сервисов. Если OpenAI пойдёт по этому пути, голосовой ChatGPT станет универсальным диспетчером задач — не только для разработчиков, но и для всех, кто работает с данными и коммуникациями.
Источники
Читайте также
Комментарии
Пока никто не написал. Будьте первым.


