Три года подряд языковые модели соревновались в том, кто лучше пишет текст. GPT-6 Astra, анонсированный OpenAI 3 сентября 2026 года, соревнуется в другом: кто аккуратнее кликает мышкой, листает страницу и запускает код на вашей машине. Это смена жанра, а не очередной прирост на бенчмарках.
О самой модели — контекст, бенчмарки, общие способности — мы уже писали отдельно. Здесь разбираем только одну её грань: инструмент computer use и то, что из него следует для обычной рабочей недели.
Сделайте следующий шаг в карьере
Подберите обучение, которое поможет освоить новые компетенции
Объявление опубликовал сотрудник OpenAI на официальном форуме community.openai.com 3 сентября 2026 года в 19:51. В тот же день доступ получил ограниченный круг одобренных пользователей, на следующий день, 4 сентября, модель открыли для платных тарифов.
Порядок раскатки вендор описал так: тарифы Pro, Enterprise и Business Premium — сразу, через ChatGPT Work и Codex; в API — сначала избранным партнёрам; Plus и Business — в течение нескольких дней.
Технический паспорт короткий и внятный:
Обратите внимание на состав списка: AutomationBench, ScreenSpot Pro, TerminalBench — это тесты не на эрудицию, а на действие. Модель мерили по тому, попадает ли она в нужный элемент интерфейса и доводит ли до конца работу в терминале.
Инструмент computer use в API OpenAI поддерживают две модели — gpt-5.6-sol и gpt-6-astra. Механика простая до примитивности: модель получает скриншот экрана, решает, что делать дальше, и возвращает действие. Доступные действия — click, double_click, drag, move, scroll, keypress, type, wait, screenshot. Дальше цикл повторяется: новый скриншот, новое решение, новое действие.
То есть агент не подключается к программам через API и не «понимает» их изнутри. Он смотрит на экран примерно так же, как человек, и тыкает в то, что видит. Именно поэтому категория называется computer use, а не «интеграция»: агенту всё равно, стоит ли перед ним веб-приложение, 1С или древняя утилита без всякого API.
Но самое интересное в документации — не список действий, а оговорка рядом с ним. Для Astra OpenAI прямо рекомендует не structured-действия с интерфейсом, а исполнение кода: «For GPT-6 Astra, we recommend code execution» — то есть генерацию скриптов на PyAutoGUI или Playwright. В наборе инструментов модели для этого есть hosted_shell (доступ к командной оболочке), apply_patch (правка файлов), code_interpreter, skills, mcp и tool_search.
Вот здесь и находится главное, что стоит вынести из релиза. Кликающий агент — это забавная демка, ограниченная скоростью интерфейса: тридцать кликов, тридцать скриншотов, минуты работы. Агент, который вместо кликов пишет двадцать строк на Playwright и запускает их, обрабатывает те же тридцать шагов за секунды и повторяет их тысячу раз. Мы считаем, что отраслевой разговор про «ИИ научился двигать мышкой» бьёт мимо: настоящий сдвиг в том, что модель перестала быть собеседником и стала исполнителем, у которого есть shell. Мышка — это витрина, shell — это суть.
ИИ-агент с множеством рук одновременно выполняет разные задачи в абстрактном цифровом пространстве
Разберём по типам задач, где разница между «чат подсказал» и «агент сделал» ощутима.
Рутина на сайтах без API. Выгрузить отчёты из трёх личных кабинетов, сверить строки, сложить в один файл. Раньше это был либо ручной час, либо заказ на разработку парсера. Теперь это задача, которую агент решает генерацией скрипта под конкретный интерфейс — и переписывает скрипт, когда интерфейс поменяется.
Работа с легаси-софтом. Бухгалтерские и складские программы, у которых нет ни API, ни экспорта нормального формата, — классическая боль. Для агента, который смотрит на экран, отсутствие API не помеха.
Многошаговые исследования. Контекст в миллион токенов плюс встроенные web_search и file_search означают, что агент способен пройти длинную цепочку «найди — открой — сверь — выпиши» без потери нити на середине.
Разработка и тестирование. hosted_shell и apply_patch в связке — это фактически описание работы джуна: прочитать репозиторий, внести правку, запустить тесты, посмотреть, что упало.
Чего в этом списке нет — так это «замены профессий». Замена происходит на уровне не должностей, а операций: исчезает конкретный набор действий, который вы совершали руками, и появляется новый — постановка задачи агенту и проверка результата. Навык формулировать задачу так, чтобы её выполнила машина, и отличать корректный результат от правдоподобного, за последний год превратился из экзотики в базовую рабочую компетенцию; его разбирают на программе «ИИ и нейросети для бизнеса», если хочется системно, а не по обрывкам из соцсетей.

Человек уверенно направляет светящегося робота-помощника, который разбирает задачи в воздухе
Этот раздел важнее всех предыдущих, и его почти не цитируют.
Вендор требует от разработчиков, использующих computer use, соблюдать набор правил: запускать агента только в изолированной среде — отдельном браузере или виртуальной машине; вести allow-list разрешённых сайтов и действий; трактовать всё содержимое экрана как недоверенные данные; запрашивать подтверждение перед необратимыми действиями. Пользователь обязан сохранять контроль над покупками, передачей данных и деструктивными изменениями.
Пора сменить профессию? Начните с понятного плана
Подберите программу под ваш опыт, цели и желаемый формат занятости
Последнее требование — не формальность. Если агент читает экран и выполняет то, что на нём написано, то любой текст на странице потенциально становится командой. Вредоносная инструкция, спрятанная в письме или на сайте, для агента выглядит ровно так же, как ваше задание.
И отдельно — строчка из system card на deploymentsafety.openai.com, которую стоит прочитать дважды: «GPT-6 Astra's monitorability has decreased relative to GPT-5.6 Sol». Прозрачность модели снизилась по сравнению с предыдущей. Тот же документ подтверждает дату 3 сентября 2026 года и говорит, что в задачах браузинга и рабочих сценариях Astra «significantly more robust» — заметно устойчивее прежних моделей.
Сложите два утверждения: работает надёжнее, а понять, почему она сделала именно так, стало труднее. Заявленные меры безопасности — мониторинг полных траекторий вместе с цепочками рассуждений, отслеживание рассогласования при использовании внешних инструментов, red-teaming и тесты на джейлбрейк, ограничения для несовершеннолетних — этот разрыв сужают, но не закрывают.
Наш вывод прямой: узкое место GPT-6 Astra — не способности, а аудируемость. Пока вы не можете объяснить регулятору, клиенту или собственному руководству, почему агент выполнил конкретное действие с деньгами или персональными данными, ответственность за это действие лежит на вас целиком, без разделения с вендором. Поэтому первые разумные сценарии — обратимые: чтение, сбор, черновик, тест. Необратимые — платежи, рассылки, удаление, отправка отчётности — только с ручным подтверждением каждого шага.

Прозрачный защитный купол вокруг маленького ИИ-робота — метафора изоляции и контроля
Тарификация API (за 1 млн токенов):
Одна практическая деталь: fast mode недоступен для GPT-6 Astra при размещении данных в ЕС — там работает только стандартная обработка. Стоимость самого инструмента computer use отдельно от токенов в документации не указана.
Из поддерживаемых возможностей модели заявлены streaming, structured outputs, function calling, file search, image input, web search и prompt caching. Разница между обычным входом ($10) и кэшированным ($1) в десять раз — повод сразу проектировать работу с повторяющимся системным промптом под кэш, а не оптимизировать это потом.
Россия отсутствует в официальном списке поддерживаемых стран OpenAI — в разделе на букву «R» перечислены только Румыния, Руанда и Реюньон. Формулировка вендора однозначна: доступ к сервисам или предоставление доступа за пределами перечисленных стран может привести к блокировке или приостановке аккаунта.
Отсюда следует практика:
Что работает легально:
Честная оценка: ни один российский продукт сегодня не даёт управления компьютером на уровне операционной системы. Категорию computer use в России развивают скорее RPA-вендоры, чем разработчики языковых моделей. Для задач внутри браузера паритет близок, для задач «сделай в программе на моём рабочем столе» — разрыв пока принципиальный.
Что такое GPT-6 Astra простыми словами? Это языковая модель OpenAI, представленная 3 сентября 2026 года, которая кроме генерации текста умеет выполнять действия: работать с файлами, запускать команды в оболочке и управлять экраном компьютера. Контекстное окно — 1 050 000 токенов, идентификатор в API — gpt-6-astra.
Чем computer use отличается от обычного чат-бота с ИИ? Чат-бот возвращает текст, а вы выполняете описанные шаги сами. Агент с computer use получает скриншот, сам выбирает действие (клик, скролл, ввод текста) и делает его. Для Astra OpenAI дополнительно рекомендует путь через генерацию кода — PyAutoGUI или Playwright — вместо пошаговых кликов.
Насколько безопасно давать ИИ доступ к рабочему компьютеру? Без изоляции — небезопасно, и вендор об этом говорит прямо. OpenAI требует изолированного браузера или виртуальной машины, allow-list сайтов и действий, отношения к содержимому экрана как к недоверенным данным и подтверждения необратимых операций. Плюс system card фиксирует снижение прозрачности модели относительно предыдущей версии.
Можно ли легально использовать GPT-6 Astra в России? Нет. Россия не входит в официальный список поддерживаемых стран OpenAI, а доступ за пределами этого списка, по формулировке вендора, может привести к блокировке аккаунта. Легальной схемы оплаты и договора для российских компаний не существует.
Какие российские аналоги управления компьютером через ИИ уже доступны? Для действий в браузере — Яндекс Браузер с Алисой AI в режиме агента. Для корпоративных агентных сценариев — GigaChat 3.5 Ultra и GigaChat Enterprise у Сбера, Cotype Pro 3 и MWS AI Agents Platform у МТС. Управления компьютером на уровне ОС ни один из них не предлагает.
Превратите интерес к теме в новую профессию
Оставьте заявку — поможем выбрать программу и расскажем об условиях обучения
Оставить заявку