OpenAI представила GPT‑5.4

OpenAI представила GPT‑5.4

OpenAI представила GPT‑5.4 с компьютерным зрением

Компания OpenAI выпустила GPT‑5.4 и GPT‑5.4 Pro спустя два дня после релиза версии 5.3 Instant. Стандартная версия доступна через веб-интерфейс ChatGPT, API и Codex. Версия GPT‑5.4 Thinking открыта для подписчиков Plus, Team и Pro. GPT‑5.4 Pro предназначена для пользователей Pro и корпоративных клиентов Enterprise и также доступна через API.

Цены и тарификация

Базовая стоимость использования GPT‑5.4 составляет $2,5 за 1 млн входных токенов и $15 за 1 млн выходных. Для версии Pro расценки выше — $30 и $180 за 1 млн токенов соответственно.

Производительность в рабочих задачах

GPT‑5.4 показывает стабильные и качественные результаты в реальных сценариях. В бенчмарке GDPval по 44 профессиям модель набрала 83%, превзойдя GPT‑5.2 с 70,9%. Особое внимание уделено работе с таблицами, презентациями и документами: в задачах уровня младшего аналитика инвестбанка GPT‑5.4 достигла 87,3% против 68,4% у GPT‑5.2.

Презентации и точность фактов

Презентации от GPT‑5.4 оценивались выше в 68% случаев за эстетику и разнообразие. Модель стала самой точной в работе с фактами: отдельные ошибки встречались на 33% реже, а полные ответы содержали ошибки на 18% реже по сравнению с GPT‑5.2.

Компьютерное зрение

GPT‑5.4 получила встроенные возможности компьютерного зрения и управления ПК. Модель способна использовать мышь и клавиатуру по скриншотам, писать код для автоматизации через Playwright и настраивать поведение под конкретные сценарии с допустимым уровнем риска.

Результаты тестов OSWorld-Verified

В бенчмарке управления рабочим столом GPT‑5.4 успешно выполнила 75% заданий, обойдя предыдущую версию (47,3%) и человека (72,4%). В тестах MMMU-Pro (понимание и логика) результат составил 81,2%, а в OmniDocBench (анализ документов) средний показатель ошибок снизился с 0,140 до 0,109.

Программирование и инструменты

GPT‑5.4 сравнялась с GPT‑5.3‑Codex по производительности, но работает быстрее. В Codex появился режим /fast, ускоряющий генерацию в 1,5 раза без потери качества. Экспериментальный навык Playwright (Interactive) позволяет визуально отлаживать веб- и Electron-приложения. Новая функция Tool Search уменьшает потребление токенов на 47% без потери точности, а веб-поиск стал эффективнее: показатели BrowseComp выросли на 17%, Pro достигла 89,3%.

Управляемость и работа с контекстом

GPT‑5.4 Thinking демонстрирует пользователю план действий при сложных запросах, позволяя корректировать направление на ходу. Модель лучше удерживает контекст в длинных диалогах и дольше обдумывает сложные задачи, сохраняя связность и релевантность ответов.