GPT-6.1 Sol, управление программами через Agents API и ассистенты dots
Дата выпуска:
OpenAI представила GPT-6.1 Sol, добавила управление программами в Agents API и начала запуск dots — ассистентов с собственными облачными компьютерами. Для применения этих новинок важны не только функции, но и цены, доступность, разрешения и контроль действий.
Выпуск может включать ранее опубликованные важные события.
OpenAI представила GPT-6.1 Sol как обновление GPT-6 Sol. Модель доступна по API под идентификатором gpt-6.1-sol, а пользователям планов Plus, Pro, Business, Enterprise и Edu — в ChatGPT Work и Codex. В Chat её пока нет. Стандартная цена API составляет $2 за миллион входных и $10 за миллион выходных токенов; кешированный вход стоит $0,10 за миллион токенов. Уровень Ultrafast компания планирует добавить в ближайшие дни.
Ключевые факты
OpenAI сообщает, что в её тесте DeepSWE v1.1 GPT-6.1 Sol сопоставима с GPT-6 Astra при примерно одной пятой стоимости задачи. Это сравнение в условиях теста, а не обещание такой экономии при любом использовании.
По данным OpenAI, в офлайн-наборе OSWorld 2.0 при максимальном уровне рассуждения результат модели на семь процентных пунктов выше, чем у GPT-6 Sol, и на 2,1 пункта ниже, чем у Astra; стоимость задачи составляет около одной седьмой стоимости задачи Astra.
OpenAI сообщает, что доля ответов хотя бы с одной фактической ошибкой снизилась с 11,4 % у GPT-6 Sol до 7,7 % у GPT-6.1 Sol при низком уровне рассуждения. Выборка намеренно сложная и, по словам компании, не отражает обычное использование.
Почему это важно
Цена кешированного входа может быть важна для агентов, которые повторно передают один и тот же большой контекст. Однако она не определяет стоимость всего сценария: имеют значение доля токенов, попавших в кеш, объём вывода и число шагов. Доступ через API позволяет проверить модель на собственных задачах разработки и подготовки материалов. Для выбора модели полезнее сравнить качество и полную стоимость законченной задачи при одинаковых условиях, чем переносить результаты тестов поставщика на рабочую нагрузку.
Бизнес-процессы
Разработка ПО и обработка задач из трекера — Команда может испытать модель при разборе ошибок и подготовке изменений, сохранив проверку кода человеком.
Подготовка документов и исследовательских материалов — При повторных запросах с неизменным контекстом кеширование может снизить расходы на входные токены; влияние на итоговую стоимость нужно измерить.
Возможности автоматизации
Агент разбирает задачу, работает с репозиторием и готовит черновик запроса на включение изменений: Модель можно подключить по API для подготовки кода и пояснений, оставив принятие и публикацию изменений ответственному сотруднику. Условия: Нужны настройка API, разграничение доступа к репозиторию и журнал действий.; Качество, стоимость полной задачи и надёжность следует проверять на собственных примерах.
Влияние на ручную работу
Подготовка кода и черновиков может потребовать меньше ручной работы, но приведённые OpenAI тесты не измеряют экономию времени в конкретном процессе организации.
Ограничения и риски
Результаты DeepSWE, OSWorld и проверки фактических ошибок опубликованы OpenAI для конкретных настроек; это не гарантии качества или стоимости в эксплуатации.
Низкая цена применяется только к кешированным входным токенам.
Доступность в ChatGPT Work и Codex не означает, что модель уже появилась в Chat.
В обзоре DevDay OpenAI сообщила, что Agents API теперь поддерживает управление программами через их интерфейсы — computer use. Компания также добавила возможности из Codex: координацию нескольких агентов, поиск и вызов инструментов и сжатие контекста. Базовую инфраструктуру запускает OpenAI. Отдельный Decisions API предназначен для выбора ответа из конечного набора заранее заданных вариантов; у него другой статус доступности.
Ключевые факты
По объявлению OpenAI, Agents API позволяет создавать агентов, которые работают с программами, и включает координацию агентов, поиск и вызов инструментов, а также сжатие контекста.
OpenAI указывает доступ через API, а также в Codex и ChatGPT Work на планах Pro 500 и Enterprise.
Decisions API, который может использовать текстовый или графический контекст для выбора из заранее заданных ответов, находится в ограниченном предварительном доступе. Более широкий запуск OpenAI планирует в ближайшие дни.
Почему это важно
Управление интерфейсом может дать агенту доступ к шагам процесса, для которых нет удобного API. Поиск инструментов и координация нескольких агентов потенциально уменьшают объём собственной инфраструктуры разработчика. Но возможность выполнить действие не означает, что его безопасно выполнять без надзора: в корпоративном сценарии нужно определить разрешённые системы, права, проверки результата и действия, требующие подтверждения.
Бизнес-процессы
Работа с внутренними системами без удобного API — Можно испытать выполнение повторяющихся шагов в интерфейсе, если набор действий чётко ограничен и результат проверяется.
Многошаговая обработка заявок — Поиск инструментов и координация агентов могут упростить переходы между этапами и системами; эффект зависит от конкретной интеграции.
Возможности автоматизации
Агент переносит сведения между корпоративными интерфейсами и готовит итог для проверки: Повторяемые действия можно поручить агенту, а отправку, изменение важных данных и платежи оставить за человеком. Условия: Следует проверить доступ к Agents API в нужном канале и плане; статус Decisions API отличается.; Нужны испытания на целевых экранах, минимальные права, журнал действий и подтверждение рискованных операций.
Влияние на ручную работу
Управление программами может сократить ручные действия и переключения между системами. Обзор OpenAI не показывает фактическую экономию труда для определённого процесса.
Ограничения и риски
Обзор DevDay объединяет продукты с разной доступностью; Decisions API пока лишь в ограниченном предварительном доступе.
Изменение экранов может нарушить сценарий, а неверное действие — изменить данные не там, где планировалось.
Для действий с существенными последствиями нужны ограничение прав и проверка человеком.
OpenAI начала ограниченный запуск постоянных ассистентов dots
OpenAI представила dots — постоянных ассистентов на базе GPT-6 Astra. У каждого dot есть собственный облачный компьютер с браузером. По описанию компании, он может вести несколько проектов, учитывать обратную связь и работать с подключениями из экосистемы более чем 4 000 приложений. Пользователь может обращаться к dot из ChatGPT, Slack или Teams, просматривать его работу, задавать границы и права приложений и проверять действия, для которых нужно одобрение. Запуск идёт на подходящих рынках для пользователей ChatGPT Pro и Business Premium.
Ключевые факты
Облачный компьютер dot отделён от устройства пользователя, если пользователь сам явно не подключил его.
Для проактивного исследования, когда пользователь не работает с ассистентом, подключённые приложения используются через инструменты только для чтения.
В планах Enterprise, Edu и Healthcare бета-версию можно попробовать после включения администратором рабочего пространства; по умолчанию она выключена.
Почему это важно
Dots рассчитаны на работу между обращениями пользователя: например, подготовку обновлённого анализа или черновика после появления новых материалов. Это может быть полезно там, где работа длится несколько дней и требует возвращаться к прежнему контексту. Но постоянный доступ к приложениям делает особенно важными границы полномочий: какие источники разрешено читать, какую работу можно наблюдать и какие шаги остаются за владельцем процесса. Примеры таких сценариев приводит сама OpenAI, а не независимое исследование.
Бизнес-процессы
Отслеживание материалов и обновление рабочих исследований — Ассистент может готовить обновлённый черновик на основе разрешённых источников; изменения и выводы следует проверять.
Подготовка счетов и изменений кода — Предварительную работу можно поручить ассистенту, сохранив одобрение отправки счёта или внесения изменения за ответственным человеком.
Возможности автоматизации
Постоянный помощник для сбора материалов и подготовки черновиков по нескольким проектам: Dots можно испытать с выбранными приложениями, заданными границами и обязательным одобрением чувствительных действий. Условия: Запуск ограничен подходящими рынками и планами ChatGPT Pro или Business Premium; для Enterprise, Edu и Healthcare бета требует включения администратором.; Работа, которую dot начинает или ведёт в Codex либо ChatGPT Work, учитывается в обычных лимитах этих продуктов.
Влияние на ручную работу
Ассистент может сократить ручной сбор материалов и подготовку черновиков. Примеры OpenAI показывают предполагаемое применение, но не доказывают экономию времени или качество результата.
Ограничения и риски
Чувствительные действия остаются предметом проверки или требуют непосредственного действия пользователя.
Отдельные специализированные dots для предприятий находятся в целевых пилотах; их статус не следует переносить на основной запуск.
Для начального dot в Pro или Business Premium предусмотрен объём более глубокой работы, а связанная работа в Codex и ChatGPT Work расходует обычные лимиты этих продуктов.