Агент OpenAI Operator получает усиление с новой моделью ИИ

- OpenAI обновил Operator, своего ИИ-агента, который использует веб для выполнения задач, до модели на базе o3 после ранее использовавшейся пользовательской версии GPT-4o.
- Оператор o3 был дообучен на дополнительных данных по безопасности для работы с компьютером, включая специализированные датасеты, обучающие модель определять границы принятия решений.
- Майк Кноп, сооснователь фонда Arc Prize Foundation, считает, что запуск модели o3 может оказаться дороже, чем ожидалось.
OpenAI обновил модель ИИ, питающую Operator, с предыдущей пользовательской версии GPT-4o на модель на базе o3, одну из новейших в серии «рассуждающих» моделей o от OpenAI. Оператор o3 был дообучен на дополнительных данных безопасности для использования компьютера и включал наборы данных безопасности, предназначенные для обучения модели границам принятия решений.
оценивает аудиторию бесплатного плана ChatGPT более чем в 1 миллиард еженедельно активных пользователей, и именно рекламная модель помогает поддерживать работу бесплатной версии. обновила оператор в ChatGPT с новой моделью агента использования компьютера (CUA) на основе версии OpenAI o3. С новой моделью оператор стал более настойчивым и точным при взаимодействии с браузером, что улучшило общий показатель успешности задач. Он также предоставляет более структурированные ответы, которые являются более четкими и подробными.
Согласно оценивает аудиторию бесплатного плана ChatGPT более чем в 1 миллиард еженедельно активных пользователей, и именно рекламная модель помогает поддерживать работу бесплатной версии., новая модель CUA показала более сильные результаты по сравнению с отраслью, достигнув SOTA на OSWorld и WebArena. Она также показала более сильные относительные результаты по сравнению с предыдущей версией как в установленных бенчмарках, так и в оценках предпочтений людей.
OpenAI заменяет модель на базе GPT‑4o на версию на базе o3
OpenAI намекает на крупное обновление для агента ChatGPT Operator pic.twitter.com/iGPQp9butD
— SabatAge (@sabatage) мая 22, 2025
OpenAI заменила существующую модель на базе GPT‑4o для Operator на версию на базе OpenAI o3, хотя версия API останется на базе 4o. Компания по искусственному интеллекту также утверждала, что оператор o3 использует тот же многослойный подход к безопасности, что и версия 4o.
Однако по сравнению с другими моделями семейства o3, оператор o3 был дообучен на дополнительных данных безопасности для использования компьютера, включая наборы данных безопасности, предназначенные для обучения модели границам принятия решений на подтверждениях и отказах.
оценивает аудиторию бесплатного плана ChatGPT более чем в 1 миллиард еженедельно активных пользователей, и именно рекламная модель помогает поддерживать работу бесплатной версии. опубликовал технический отчет, показывающий производительность оператора o3 в конкретных оценках безопасности. По сравнению с моделью оператора GPT-4o, оператор o3 был менее склонен отказываться от выполнения «незаконных» действий и поиска конфиденциальных персональных данных, а также был менее восприимчив к форме атаки на ИИ, известной как «инъекция промпта».
«Оператор o3 использует тот же многослойный подход к безопасности, который мы использовали для версии 4o оператора… Хотя оператор o3 наследует возможности программирования o3, он не имеет прямого доступа к среде программирования или терминалу.»
Компания по искусственному интеллекту также раскрыла, что новая модель на базе o3 прошла стандартные оценки безопасности, и Operator продолжал оставаться в виде исследовательского превью для пользователей ChatGPT Pro по всему миру. Однако эта обновленная модель была доступна только в Operator в ChatGPT.
Кноп подозревает, что запуск модели o3 от OpenAI может оказаться дороже, чем ожидалось
На прошлой неделе Фонд Arc Prize, который поддерживает и администрирует ARC-AGI, обновил свои приблизительные вычислительные затраты для o3. Изначально организация оценивала, что лучшая конфигурация o3, которую она протестировала, o3 high, стоила около $3K за решение одной проблемы ARC-AGI. Однако теперь Фонд считает, что стоимость может быть в 10 раз выше предыдущей оценки, возможно, около $30K за задачу.
Кроме того, хотя OpenAI еще не установила цену на o3 и не выпустила ее полностью, один из соучредителей Фонда Arc Prize, Майк Кноп, считает, что ценообразование модели o1-pro является разумным прокси и более близким сравнением истинной стоимости o3. Однако он добавил, что o3 будет продолжать обозначаться как превью в таблице лидеров, чтобы отразить неопределенность до объявления официальных цен.
Согласно Фонду Arc Prize, высокая цена для o3 high не была бы чем-то из ряда вон выходящим, учитывая количество вычислительных ресурсов, которые, как сообщается, использует модель. o3 high использовал в 172 раза больше вычислений, чем o3 low, конфигурация o3 с наименьшим использованием вычислений, для решения задач ARC-AGI.
Слухи летали с начала марта о дорогих планах, которые OpenAI рассматривала для внедрения для корпоративных клиентов. Сообщалось, что компания может взимать до $20K в месяц за специализированные ИИ-«агенты», такие как агенты для разработчиков программного обеспечения.
Однако, в то время как некоторые утверждали, что даже самые дорогие модели OpenAI будут стоить значительно меньше, чем типичный человеческий подрядчик или сотрудник, исследователь ИИ Тоби Орд указал, что модели могут быть не такими эффективными. Например, o3 high требовал 1024 попытки для каждой задачи в ARC-AGI, чтобы достичь лучшего результата.
Самые умные крипто-энтузиасты уже читают нашу рассылку. Хотите присоединиться? Присоединяйтесь.

Коллинс Дж. Окот
Коллинс Окот — журналист и аналитик рынка с 8-летним опытом освещения криптовалютной и технологической отраслей. Он является сертифицированным финансовым аналитиком (CFA) и имеет степень в области актуарной математики. Ранее Коллинс работал писателем и редактором в Geek Computer и CoinRabbit.















