16 сентября 2026

GPT-6 Astra: как ИИ учится управлять компьютером — и что это меняет в вашей работе

Три года подряд языковые модели соревновались в том, кто лучше пишет текст. GPT-6 Astra, анонсированный OpenAI 3 сентября 2026 года, соревнуется в другом: кто аккуратнее кликает мышкой, листает страницу и запускает код на вашей машине. Это смена жанра, а не очередной прирост на бенчмарках.

ИИ-агент с множеством рук одновременно выполняет разные задачи в абстрактном цифровом пространстве

О самой модели — контекст, бенчмарки, общие способности — мы уже писали отдельно. Здесь разбираем только одну её грань: инструмент computer use и то, что из него следует для обычной рабочей недели.

image

Сделайте следующий шаг в карьере

Подберите обучение, которое поможет освоить новые компетенции

Выбрать курс

3 сентября 2026: что именно вышло и кому досталось

Объявление опубликовал сотрудник OpenAI на официальном форуме community.openai.com 3 сентября 2026 года в 19:51. В тот же день доступ получил ограниченный круг одобренных пользователей, на следующий день, 4 сентября, модель открыли для платных тарифов.

Порядок раскатки вендор описал так: тарифы Pro, Enterprise и Business Premium — сразу, через ChatGPT Work и Codex; в API — сначала избранным партнёрам; Plus и Business — в течение нескольких дней.

Технический паспорт короткий и внятный:

  • идентификатор модели в API — gpt-6-astra; отдельного номера версии OpenAI не указывает;
  • контекстное окно — 1 050 000 токенов (максимум входа 922 000, максимум вывода 128 000);
  • дата отсечения знаний — 30 апреля 2026 года;
  • заявленные бенчмарки — Agents' Last Exam, AutomationBench, ScreenSpot Pro, FrontierMath Tier 4, ARC-AGI 3, TerminalBench-4.0, Terminal-Bench Science 0.1, HealthBench Pro.

Обратите внимание на состав списка: AutomationBench, ScreenSpot Pro, TerminalBench — это тесты не на эрудицию, а на действие. Модель мерили по тому, попадает ли она в нужный элемент интерфейса и доводит ли до конца работу в терминале.

Как работает автономный ИИ-агент для компьютера: клики, скролл и генерация кода

Инструмент computer use в API OpenAI поддерживают две модели — gpt-5.6-sol и gpt-6-astra. Механика простая до примитивности: модель получает скриншот экрана, решает, что делать дальше, и возвращает действие. Доступные действия — click, double_click, drag, move, scroll, keypress, type, wait, screenshot. Дальше цикл повторяется: новый скриншот, новое решение, новое действие.

То есть агент не подключается к программам через API и не «понимает» их изнутри. Он смотрит на экран примерно так же, как человек, и тыкает в то, что видит. Именно поэтому категория называется computer use, а не «интеграция»: агенту всё равно, стоит ли перед ним веб-приложение, 1С или древняя утилита без всякого API.

Но самое интересное в документации — не список действий, а оговорка рядом с ним. Для Astra OpenAI прямо рекомендует не structured-действия с интерфейсом, а исполнение кода: «For GPT-6 Astra, we recommend code execution» — то есть генерацию скриптов на PyAutoGUI или Playwright. В наборе инструментов модели для этого есть hosted_shell (доступ к командной оболочке), apply_patch (правка файлов), code_interpreter, skills, mcp и tool_search.

Вот здесь и находится главное, что стоит вынести из релиза. Кликающий агент — это забавная демка, ограниченная скоростью интерфейса: тридцать кликов, тридцать скриншотов, минуты работы. Агент, который вместо кликов пишет двадцать строк на Playwright и запускает их, обрабатывает те же тридцать шагов за секунды и повторяет их тысячу раз. Мы считаем, что отраслевой разговор про «ИИ научился двигать мышкой» бьёт мимо: настоящий сдвиг в том, что модель перестала быть собеседником и стала исполнителем, у которого есть shell. Мышка — это витрина, shell — это суть.

ИИ-агент с множеством рук одновременно выполняет разные задачи в абстрактном цифровом пространстве

Что это меняет в реальной работе

Разберём по типам задач, где разница между «чат подсказал» и «агент сделал» ощутима.

Рутина на сайтах без API. Выгрузить отчёты из трёх личных кабинетов, сверить строки, сложить в один файл. Раньше это был либо ручной час, либо заказ на разработку парсера. Теперь это задача, которую агент решает генерацией скрипта под конкретный интерфейс — и переписывает скрипт, когда интерфейс поменяется.

Работа с легаси-софтом. Бухгалтерские и складские программы, у которых нет ни API, ни экспорта нормального формата, — классическая боль. Для агента, который смотрит на экран, отсутствие API не помеха.

Многошаговые исследования. Контекст в миллион токенов плюс встроенные web_search и file_search означают, что агент способен пройти длинную цепочку «найди — открой — сверь — выпиши» без потери нити на середине.

Разработка и тестирование. hosted_shell и apply_patch в связке — это фактически описание работы джуна: прочитать репозиторий, внести правку, запустить тесты, посмотреть, что упало.

Чего в этом списке нет — так это «замены профессий». Замена происходит на уровне не должностей, а операций: исчезает конкретный набор действий, который вы совершали руками, и появляется новый — постановка задачи агенту и проверка результата. Навык формулировать задачу так, чтобы её выполнила машина, и отличать корректный результат от правдоподобного, за последний год превратился из экзотики в базовую рабочую компетенцию; его разбирают на программе «ИИ и нейросети для бизнеса», если хочется системно, а не по обрывкам из соцсетей.

Человек уверенно направляет светящегося робота-помощника, который разбирает задачи в воздухе

Человек уверенно направляет светящегося робота-помощника, который разбирает задачи в воздухе

Безопасность: что OpenAI предупреждает о собственной модели

Этот раздел важнее всех предыдущих, и его почти не цитируют.

Вендор требует от разработчиков, использующих computer use, соблюдать набор правил: запускать агента только в изолированной среде — отдельном браузере или виртуальной машине; вести allow-list разрешённых сайтов и действий; трактовать всё содержимое экрана как недоверенные данные; запрашивать подтверждение перед необратимыми действиями. Пользователь обязан сохранять контроль над покупками, передачей данных и деструктивными изменениями.

Пора сменить профессию? Начните с понятного плана

Подберите программу под ваш опыт, цели и желаемый формат занятости

  • Востребованные навыки без лишней теории.
  • Поддержку экспертов на каждом этапе
  • Помощь с выходом на рынок труда
Подобрать обучение
image

Последнее требование — не формальность. Если агент читает экран и выполняет то, что на нём написано, то любой текст на странице потенциально становится командой. Вредоносная инструкция, спрятанная в письме или на сайте, для агента выглядит ровно так же, как ваше задание.

И отдельно — строчка из system card на deploymentsafety.openai.com, которую стоит прочитать дважды: «GPT-6 Astra's monitorability has decreased relative to GPT-5.6 Sol». Прозрачность модели снизилась по сравнению с предыдущей. Тот же документ подтверждает дату 3 сентября 2026 года и говорит, что в задачах браузинга и рабочих сценариях Astra «significantly more robust» — заметно устойчивее прежних моделей.

Сложите два утверждения: работает надёжнее, а понять, почему она сделала именно так, стало труднее. Заявленные меры безопасности — мониторинг полных траекторий вместе с цепочками рассуждений, отслеживание рассогласования при использовании внешних инструментов, red-teaming и тесты на джейлбрейк, ограничения для несовершеннолетних — этот разрыв сужают, но не закрывают.

Наш вывод прямой: узкое место GPT-6 Astra — не способности, а аудируемость. Пока вы не можете объяснить регулятору, клиенту или собственному руководству, почему агент выполнил конкретное действие с деньгами или персональными данными, ответственность за это действие лежит на вас целиком, без разделения с вендором. Поэтому первые разумные сценарии — обратимые: чтение, сбор, черновик, тест. Необратимые — платежи, рассылки, удаление, отправка отчётности — только с ручным подтверждением каждого шага.

Прозрачный защитный купол вокруг маленького ИИ-робота — метафора изоляции и контроля

Прозрачный защитный купол вокруг маленького ИИ-робота — метафора изоляции и контроля

Доступ и цены

Тарификация API (за 1 млн токенов):

  • стандартная обработка, короткий контекст: вход $10, кэшированный вход $1, запись в кэш $12,50, вывод $50;
  • длинный контекст: вход $20, вывод $75;
  • batch-обработка: вход $5, вывод $25;
  • fast mode: вход $20, вывод $100.

Одна практическая деталь: fast mode недоступен для GPT-6 Astra при размещении данных в ЕС — там работает только стандартная обработка. Стоимость самого инструмента computer use отдельно от токенов в документации не указана.

Из поддерживаемых возможностей модели заявлены streaming, structured outputs, function calling, file search, image input, web search и prompt caching. Разница между обычным входом ($10) и кэшированным ($1) в десять раз — повод сразу проектировать работу с повторяющимся системным промптом под кэш, а не оптимизировать это потом.

Для пользователей из России: что доступно и чем заменить

Россия отсутствует в официальном списке поддерживаемых стран OpenAI — в разделе на букву «R» перечислены только Румыния, Руанда и Реюньон. Формулировка вендора однозначна: доступ к сервисам или предоставление доступа за пределами перечисленных стран может привести к блокировке или приостановке аккаунта.

Отсюда следует практика:

  • Легальная оплата невозможна. У OpenAI нет юрлица в РФ и закрывающих документов для российских компаний, прямой договор заключить не с кем. Карты «Мир» не принимаются, карты российской эмиссии не проходят проверку по стране биллинга — ни для подписок, ни для API.
  • Обходные схемы — это риск, а не решение. Зарубежные и виртуальные карты, балансы магазинов приложений, посредники-реселлеры — всё это нарушает условия использования OpenAI и грозит блокировкой аккаунта вместе с оплаченным балансом. Реселлеров стоит считать непроверенными по умолчанию.

Что работает легально:

  • Яндекс Браузер с Алисой AI в режиме ИИ-агента — ближайший доступный аналог. Агент действует внутри браузера: заполняет формы на сторонних сайтах, бронирует, сравнивает цены. Это browser-use, не управление операционной системой.
  • Алиса AI с агентом «Исследовать» (апрель 2026, глубокое исследование с исполнением кода) и платформой для создания ИИ-агентов (июнь 2026).
  • GigaChat 3.5 Ultra (Сбер, июль 2026) — флагманская модель с поддержкой агентов. Рядом — ГигаЧат Бизнес / GigaChat Enterprise (общая доступность с 3 марта 2026) с вариантами on-prem, гибрид и облако, и GigaCowork (тестирование с мая 2026) для оркестрации агентов над CRM и ERP; управления экраном там нет.
  • Cotype Pro 3 и MWS AI Agents Platform (МТС / MWS AI, июнь 2026) — Pro 3 позиционируется под многошаговые агентные задачи.
  • T-Pro 2.0 (Т-Технологии, открытые веса) — только модель, агентную обвязку придётся собирать самостоятельно.

Честная оценка: ни один российский продукт сегодня не даёт управления компьютером на уровне операционной системы. Категорию computer use в России развивают скорее RPA-вендоры, чем разработчики языковых моделей. Для задач внутри браузера паритет близок, для задач «сделай в программе на моём рабочем столе» — разрыв пока принципиальный.

Частые вопросы

Что такое GPT-6 Astra простыми словами? Это языковая модель OpenAI, представленная 3 сентября 2026 года, которая кроме генерации текста умеет выполнять действия: работать с файлами, запускать команды в оболочке и управлять экраном компьютера. Контекстное окно — 1 050 000 токенов, идентификатор в API — gpt-6-astra.

Чем computer use отличается от обычного чат-бота с ИИ? Чат-бот возвращает текст, а вы выполняете описанные шаги сами. Агент с computer use получает скриншот, сам выбирает действие (клик, скролл, ввод текста) и делает его. Для Astra OpenAI дополнительно рекомендует путь через генерацию кода — PyAutoGUI или Playwright — вместо пошаговых кликов.

Насколько безопасно давать ИИ доступ к рабочему компьютеру? Без изоляции — небезопасно, и вендор об этом говорит прямо. OpenAI требует изолированного браузера или виртуальной машины, allow-list сайтов и действий, отношения к содержимому экрана как к недоверенным данным и подтверждения необратимых операций. Плюс system card фиксирует снижение прозрачности модели относительно предыдущей версии.

Можно ли легально использовать GPT-6 Astra в России? Нет. Россия не входит в официальный список поддерживаемых стран OpenAI, а доступ за пределами этого списка, по формулировке вендора, может привести к блокировке аккаунта. Легальной схемы оплаты и договора для российских компаний не существует.

Какие российские аналоги управления компьютером через ИИ уже доступны? Для действий в браузере — Яндекс Браузер с Алисой AI в режиме агента. Для корпоративных агентных сценариев — GigaChat 3.5 Ultra и GigaChat Enterprise у Сбера, Cotype Pro 3 и MWS AI Agents Platform у МТС. Управления компьютером на уровне ОС ни один из них не предлагает.

Превратите интерес к теме в новую профессию

Оставьте заявку — поможем выбрать программу и расскажем об условиях обучения

Оставить заявку
icon