ChatGPT-Live в приложении OpenAI для Windows и macOS: как управлять агентами голосом

Голосовой режим ChatGPT на базе GPT-Live теперь встроен в новое десктопное приложение OpenAI для Windows и macOS. Через него можно говорить с Work и Codex, запускать многошаговые задачи, уточнять детали по ходу работы и координировать несколько агентов в одном разговоре. Об обновлении OpenAI сообщила 23 июля, а 24 июля о нём стало известно широкой аудитории благодаря публикации TechCrunch: голосовой режим появился в настольном приложении для управления агентами и задачами на компьютере.
Практический смысл функции — не в обычной диктовке текста, а в управлении рабочим процессом голосом. Вы можете описать требуемый результат, разрешить приложению использовать доступные файлы, программы или инструменты, а затем по ходу выполнения остановить задачу, изменить приоритет или ответить на уточняющий вопрос. При этом доступ зависит от тарифа, рабочего пространства и выданных разрешений, поэтому Voice не превращает ChatGPT в полностью автономного оператора компьютера.
Что именно изменилось в десктопном ChatGPT
В новом приложении ChatGPT разделены несколько режимов работы: Chat предназначен для быстрых вопросов, Work — для длительных многошаговых задач, а Codex — для программирования, репозиториев, терминала и технических инструментов. Голосовой интерфейс добавлен именно к Work и Codex, а не только к обычному чату. Такое разделение описано в актуальной справке OpenAI о режимах ChatGPT, Work и Codex.
Для пользователя это означает, что голосовая команда становится частью уже существующего рабочего контекста. В проекте можно попросить Work собрать исследование или подготовить документ, а в Codex — разобраться с ошибкой, выполнить проверку или продолжить работу с локальной папкой. Голос задаёт направление, но фактические действия выполняются теми инструментами и разрешениями, которые доступны выбранному режиму.
Как GPT-Live поддерживает разговор во время работы
GPT-Live разработан как голосовая модель для непрерывного взаимодействия. OpenAI описывает архитектуру как двунаправленную: система одновременно обрабатывает входящий звук и формирует ответ, поэтому может решить, продолжать ли говорить, сделать паузу, выслушать пользователя, принять перебивание или вызвать инструмент. Подробности опубликованы в официальном представлении GPT-Live от OpenAI.
Для агентных задач важна другая часть архитектуры. Голосовой слой отвечает за быстрый диалог, а более сложный поиск, рассуждение или действие может быть передано другой модели в фоновом режиме. Поэтому разговор не обязательно прерывается, пока система выполняет отдельный этап работы.
На практике это полезно в ситуациях, когда задача развивается по ходу выполнения. Например, вы можете сказать: «Проверь проект, найди причину ошибки и остановись перед изменением файлов». После получения результата можно голосом уточнить область поиска, разрешить исправление или попросить подготовить только отчёт. Это редакционная рекомендация по безопасному сценарию работы, а не гарантия одинакового поведения во всех проектах.
Какие задачи можно запускать голосом

Функция подходит прежде всего для команд, где важен результат, а не ручное заполнение каждого поля. OpenAI указывает, что Voice в Work и Codex может запускать, приостанавливать, переориентировать и координировать задачи, пока работа продолжается в фоне. В справке также упоминается возможность получать голосовые или экранные обновления о прогрессе, блокировках и завершении.
- В Work — попросить исследовать тему, проанализировать материалы, подготовить документ, таблицу, презентацию или отчёт.
- В Codex — открыть проект, изучить код, запустить проверки, разобрать ошибку, подготовить изменения или объяснить результаты тестов.
- В обоих режимах — уточнить требования, изменить приоритет, остановить текущую работу или продолжить существующий проект.
- При наличии соответствующих инструментов — работать с сайтами, приложениями и локальными файлами.
TechCrunch отдельно отмечал демонстрацию, в которой голосовая команда объединяла создание новой ветки, подготовку запроса на слияние и поиск причины ошибки. Это показывает направление развития интерфейса, но не означает, что любая команда автоматически выполнится без подтверждений, конфликтов доступа или дополнительных вопросов.
Как начать работу в Windows или macOS
Сначала обновите новое десктопное приложение ChatGPT и войдите в аккаунт. В верхнем меню выберите ChatGPT или Codex, затем в ChatGPT переключитесь на Work либо откройте Codex напрямую. После этого нажмите управление Voice или используйте настроенное сочетание клавиш.
- Выберите рабочее пространство, проект или локальную папку, с которой должна работать система.
- Разрешите доступ к микрофону.
- Если требуется работа с контекстом компьютера, отдельно подтвердите разрешения для экрана, аудиозаписи или специальных возможностей.
- Сформулируйте не отдельное действие, а ожидаемый результат, ограничения и критерии проверки.
- Перед потенциально необратимым действием попросите показать план или остановиться на этапе подготовки.
- После завершения проверьте результат в текстовом чате и только затем переходите к публикации, отправке или изменению исходных данных.
OpenAI прямо указывает, что для Voice в Work и Codex нужны доступ к микрофону, а компьютерный контекст может потребовать разрешений на запись экрана и специальные возможности. Если функция не отображается, причиной может быть не только версия приложения, но и настройки тарифа, региона или рабочего пространства.
Чем голосовое управление отличается от обычной диктовки
Диктовка превращает произнесённую фразу в текст, который затем обрабатывается как сообщение. GPT-Live работает в режиме непрерывного диалога: пользователь может перебить ответ, попросить подождать, задать уточнение и продолжить разговор без нового ручного ввода. Поэтому ценность обновления проявляется прежде всего в управлении процессом, а не в скорости набора текста.
Есть и важное ограничение. Голосовая модель не отменяет необходимости проверять факты, файлы и действия агента. OpenAI предупреждает, что ChatGPT может ошибаться, особенно в вопросах, чувствительных к дате, времени и местоположению. Для рабочих задач полезно просить систему проговаривать найденные предпосылки, перечислять изменённые файлы и отделять выполненные действия от предложенных.
Разрешения и безопасность: что проверить до запуска

Главный риск связан не с самим микрофоном, а с расширением контекста, к которому получает доступ агент. Work в десктопном приложении может использовать локальные файлы и настольные приложения только при наличии разрешения. Поэтому доступ стоит выдавать конкретной папке или проекту, а не всему диску.
Перед первым запуском проверьте четыре уровня контроля:
- какой режим выбран — Work или Codex;
- какие файлы и приложения доступны выбранному режиму;
- может ли агент выполнять действия или только анализировать информацию;
- какие правила установил администратор рабочего пространства.
Для корпоративного использования особенно важны роли и политики рабочего пространства. В справке OpenAI указано, что администраторы могут отдельно управлять доступом к Work, локальным возможностям Codex, браузеру и сетевым функциям. Даже если Voice доступен технически, конкретный сотрудник может не иметь права использовать локальные файлы или подключённые инструменты.
Ограничения, которые важно учитывать
По состоянию на 25 июля 2026 года функция разворачивается для подходящих аккаунтов, но её доступность зависит от плана и рабочего пространства. OpenAI указывает, что Voice в Work и Codex доступен в десктопном приложении на macOS и Windows, тогда как самостоятельный режим для Work и Codex не является функцией веб- или мобильного интерфейса.
Есть и операционные ограничения. Одновременно может работать только один голосовой разговор, а голосовое время и агентные действия могут учитываться в общей системе использования Work и Codex. Для Business OpenAI отдельно описывает расчёт голосового использования и расход общего пула задач, поэтому перед массовым применением стоит проверить условия именно своего плана.
Кроме того, голос не гарантирует бесшовное выполнение длинной цепочки. Агент может запросить подтверждение, столкнуться с отсутствием разрешения, неверно интерпретировать имя файла или остановиться из-за внешнего сервиса. Самый надёжный подход — разбивать критические операции на этапы: анализ, план, выполнение, проверка.
Как формулировать команды, чтобы получать предсказуемый результат
Голосовые команды лучше строить вокруг результата и границ ответственности. Фраза «разберись с проектом» слишком расплывчата: в ней нет цели, области поиска и допустимых изменений. Более устойчивый запрос содержит объект, ожидаемый результат, ограничения и условие остановки.
Удобная структура выглядит так: «Проверь папку с проектом, найди ошибки сборки, составь список причин, ничего не изменяй и остановись перед исправлением». После просмотра отчёта можно дать отдельную команду: «Исправь только проблему в файле X, запусти тесты и покажи различия». Это снижает риск того, что агент выполнит лишние действия до того, как вы увидите промежуточный результат.
Для исследования полезно заранее назвать допустимые источники, период актуальности и формат результата. Для работы с документами — перечислить файлы, желаемую структуру и правила конфиденциальности. Для программирования — указать ветку, команды проверки и запрет на публикацию изменений без подтверждения.
Кому обновление действительно пригодится
Наибольшую пользу Voice получат пользователи, которые регулярно переключаются между несколькими задачами и приложениями. Разработчик может обсуждать ход диагностики, не отрываясь от редактора. Автор или аналитик — надиктовывать структуру исследования и просить Work собирать результат в документ. Руководитель проекта — запрашивать статус у нескольких агентов и менять приоритеты по мере появления новых данных.
Для простых вопросов обновление не обязательно будет заметным преимуществом: обычный чат или текстовый ввод часто окажутся быстрее и точнее. Голос особенно оправдан, когда нужно вести длинный контекст, работать без клавиатуры, параллельно наблюдать за процессом или регулярно давать короткие уточнения.
Практический сценарий первого запуска
Начните с задачи, которую легко проверить и откатить. Например, попросите Work проанализировать набор документов и подготовить черновой план, либо поручите Codex изучить тестовую ветку без изменения исходных файлов. В первом сеансе важно оценить не скорость ответа, а качество распознавания команд, поведение при паузах и момент, когда система запрашивает подтверждение.
После завершения проверьте историю разговора, список использованных файлов и итоговый результат. Если команда была понята неверно, уточните формулировку: называйте точные файлы, задавайте порядок действий и явно говорите, что запрещено менять. Только после нескольких безопасных сценариев имеет смысл переходить к операциям, связанным с публикацией кода, отправкой писем или изменением рабочих данных.
Итог для пользователей Windows и macOS
GPT-Live в десктопном ChatGPT превращает голос из инструмента ввода в интерфейс управления агентной работой. Он позволяет говорить с Work и Codex, перебивать систему, задавать уточнения, запускать многошаговые задачи и следить за их прогрессом, но результат по-прежнему зависит от доступных инструментов, разрешений и качества постановки задачи.
Оптимальный следующий шаг — обновить приложение, проверить наличие Work или Codex, настроить микрофон и начать с обратимой задачи без доступа к чувствительным данным. Голос стоит использовать как средство координации и навигации по процессу, а финальные изменения, публикации и внешние действия подтверждать вручную.
Читайте также:
- Обновление Условий обслуживания Google с 30 июля 2026 года: что важно знать владельцам сайтов
- Как отслеживать обновления FOMC в реальном времени для личных финансов
- Рекордный рост Google Поиска в 2026 году: почему трафик остаётся актуальным
- MiCA: обновление реестра ESMA 3 июля 2026 и влияние на крипту в ЕС
Подпишитесь на рассылку
Получайте свежие новости Web3, AI и криптовалют прямо на вашу почту.