Такая скорость выводит Ultrafast в число быстрых предложений на рынке, но не делает его абсолютным лидером по производительности. Независимая исследовательская компания Artificial Analysis сейчас оценивает скорость Gemini 3.5 Flash от Google примерно в 201 токен в секунду. Специализированные модели, ориентированные на скорость, показывают более высокие результаты: около 769 токенов в секунду у Mercury 2 и около 1491 — у Celeris-1.
Разница в том, что OpenAI предлагает скорость до 300 токенов в секунду на передовых моделях семейства GPT-6. Абсолютные рекордсмены обычно специально оптимизированы для инференса с очень высокой пропускной способностью.
За скорость приходится платить: использование Ultrafast через API стоит в шесть раз дороже стандартного тарифа той же модели. Режим уже доступен для GPT-6 Astra, а его версия для GPT-6.1 Sol, по словам компании, появится скоро.
Вместе новые продукты расширяют выбор для корпоративных разработчиков. Организации могут запускать сложную автономную работу на сравнительно недорогой Sol или платить заметно больше, если задержка ответа становится важнее стоимости токенов.
Цены GPT-6.1 Sol остались на уровне Sol
Главное в цене GPT-6.1 Sol — то, что OpenAI не стала повышать. Миллион входных токенов стоит $2, миллион кэшированных входных токенов — $0,10, а миллион выходных — $10.
Цены на обычные входные и выходные токены совпадают с тарифами GPT-6 Sol. Кэшированные входные токены подешевели с $0,20 до $0,10 за миллион — на 50%. В актуальной документации OpenAI для разработчиков указаны цены GPT-6 Sol: $2 за миллион входных, $0,20 за миллион кэшированных входных и $10 за миллион выходных токенов.
Поэтому переход с GPT-6 Sol на GPT-6.1 Sol не требует увеличивать базовый бюджет на токены.
По сравнению с Astra разница ещё заметнее. Сейчас OpenAI берёт за GPT-6 Astra $10 за миллион входных токенов, $1 за миллион кэшированных входных и $50 за миллион выходных. Значит, обычные входные и выходные токены GPT-6.1 Sol обходятся ровно в пять раз дешевле, а кэшированные входные — в десять раз.
Для сравнения, GPT-5.6 Sol, на который сейчас действует скидка, стоит $4 за миллион входных и $20 за миллион выходных токенов. GPT-6.1 Sol вдвое дешевле этой предыдущей модели поколения Sol по текущей цене токенов. В документации OpenAI указано, что льготный тариф GPT-5.6 Sol будет действовать как минимум до 21 ноября 2026 года.
Снижение цены на кэшированные входные токены особенно важно для корпоративных ИИ-агентов. Долго работающие агенты для программирования, исследовательские системы и автоматизация бизнес-процессов часто повторно используют системные инструкции, контекст репозитория, политики, справочные документы и другие части промта. Если такая работа включает сотни или тысячи обращений к модели, удешевление повторно используемого контекста может оказаться важнее цены обычных входных токенов.
OpenAI сообщает, что Sol приблизилась к Astra
OpenAI приводит результаты собственных оценок, согласно которым GPT-6.1 Sol сократила отставание от Astra.
В DeepSWE v1.1, где оценивают длительные задачи по программной инженерии в реальных кодовых базах, GPT-6.1 Sol, по данным OpenAI, сравнялась с Astra, обходясь примерно в пять раз дешевле. Лучший результат GPT-6 Sol новая модель превзошла на 6,4 процентного пункта.
В GDP.pdf — бенчмарке для сложных профессиональных документов с графиками, таблицами, схемами и мелким шрифтом — GPT-6.1 Sol, по сообщению OpenAI, набрала больше, чем Claude Opus 5.5 с резервными моделями, и стоила на каждую задачу меньше половины её цены. По результату модель также приблизилась к Astra, обходясь примерно в пять раз дешевле.
Для внедрения корпоративных ИИ-агентов могут быть особенно актуальны результаты AutomationBench. Этот бенчмарк проверяет сквозные задачи с использованием 47 инструментов в продажах, маркетинге, операционной деятельности, поддержке, финансах и управлении персоналом. OpenAI сообщает, что при среднем уровне рассуждения GPT-6.1 Sol опередила Opus 5.5 на 2,2 процентного пункта и стоила примерно втрое дешевле. В тех же условиях результат модели оказался на 4,8 процентного пункта выше, чем у GPT-6 Sol.
В задачах по работе с компьютером наблюдается похожая картина. На офлайн-наборе OSWorld 2.0 GPT-6.1 Sol, по данным OpenAI, при максимальном уровне рассуждения отстала от Astra всего на 2,1 процентного пункта, а каждая задача обходилась примерно в семь раз дешевле.
Эти результаты получены в оценках OpenAI, а не в независимых испытаниях на реальных производственных системах. Компания отмечает, что тестирует модели в исследовательской среде или через API и что результаты могут несколько отличаться от работы ChatGPT в реальных условиях. При этом позиционирование моделей понятно: Astra остаётся вариантом с максимальными возможностями, а Sol OpenAI предлагает разработчикам для задач, где цена многократного запуска ИИ-агентов важна не меньше, чем результат на бенчмарке.
Ultrafast превращает скорость инференса в платную опцию
Вторая часть анонса касается другого ограничения. Передовые модели могут справляться с рабочим процессом, но оставаться слишком медленными для приложений, где человек ждёт каждый ответ. Ultrafast — это отдельный ускоренный режим инференса с повышенной ценой.
По словам OpenAI, в нём генерация достигает 300 токенов в секунду. В Codex скорость может вырасти до 8 раз, а при обращении через API — до 6 раз. Использование API стоит в шесть раз дороже стандартного тарифа.
Это заметно выше стоимости существующего режима Fast, который раньше назывался Priority processing. По текущей таблице цен OpenAI, Fast для моделей семейства GPT-6 стоит вдвое дороже стандартного режима. Например, для GPT-6 Sol цена входных и выходных токенов меняется с $2 и $10 на $4 и $20, а для Astra — с $10 и $50 на $20 и $100.
До 6 раз быстрее через API · до 8 раз в Codex · до 300 токенов/с
Расчётные цены. OpenAI сообщает, что Ultrafast через API стоит в шесть раз дороже стандартного тарифа, но в материалах DevDay не приводит отдельные цены для каждой позиции. Поэтому суммы для Astra и GPT-6.1 Sol рассчитаны по опубликованным стандартным тарифам и заявленному множителю 6×. По данным компании, Ultrafast стоит втрое дороже Fast и вшестеро — Standard для той же базовой модели.
Таким образом, при одинаковой базовой модели Ultrafast обходится втрое дороже Fast и вшестеро дороже Standard.
Для GPT-6 Astra множитель 6× означает $60 за миллион входных и $300 за миллион выходных токенов. Для сравнения: Standard стоит $10 и $50, а Fast — $20 и $100.
Для GPT-6.1 Sol такой же множитель после запуска Ultrafast будет означать $12 за миллион входных и $60 за миллион выходных токенов. Если множитель применяется и к опубликованной цене кэшированных входных токенов, она составит $0,60 за миллион.
В материалах DevDay OpenAI указала множитель 6×, но не опубликовала отдельные цены Ultrafast для GPT-6.1 Sol. Поэтому эти суммы рассчитаны по объявленному множителю, а не взяты из отдельного опубликованного тарифа.
Из-за такой стоимости Ultrafast вряд ли заменит стандартный инференс для фоновых ИИ-агентов, обработки документов и других задач, где важнее пропускная способность. Режим рассчитан прежде всего на приложения, в которых ожидание само по себе обходится дорого: интерактивное программирование, клиентскую поддержку, финансовый анализ, реагирование на инциденты и другие системы с участием человека.
OpenAI уже проверяла этот подход. В августе компания представила GPT-5.6 Sol Ultrafast на оборудовании Cerebras: модель выдавала до 750 выходных токенов в секунду и работала до 14 раз быстрее стандартного режима. Доступ получили ограниченное число клиентов. Среди первых сценариев применения OpenAI назвала финансовые исследования, коммерцию, поддержку и реагирование на инциденты.
После DevDay эксперимент стал более широким продуктовым предложением. При этом новые модели GPT-6 уступают прежней версии в максимальной заявленной скорости, зато дают доступ к более новым возможностям.
Доступность и другие анонсы DevDay
GPT-6.1 Sol доступна через API под именем gpt-6.1-sol, а также пользователям ChatGPT Work и Codex с тарифами Plus, Pro, Business, Enterprise и Edu. OpenAI отдельно уточняет, что в обычном Chat модель пока недоступна.
GPT-6 Astra Ultrafast уже работает через API и доступна в ChatGPT Work и Codex пользователям Pro 500 и Enterprise. GPT-6.1 Sol Ultrafast должна появиться в ближайшие дни.
В документации API для поддерживаемых моделей также доступен параметр с ограниченным доступом service_tier=ultrafast.
Новые модели — лишь часть анонсов OpenAI на DevDay. Компания также представила постоянно работающих ИИ-агентов Dots; инфраструктуру защиты данных Private Intelligence; управление компьютером в Agents API; Managed Agents на AWS Bedrock с технологиями OpenAI; новые возможности Codex Cloud, интерфейса командной строки, проверки кода и безопасности; Decisions API; расширение плагинов и автоматизации, запускаемой событиями MCP; совместные пространства ChatGPT Spaces, Pages и слайды; командные задачи; интеграции ChatGPT со Slack и Microsoft Teams; плагин Meetings; вход через ChatGPT; новую подписку Pro 500 и OpenAI Marketplace для корпоративных клиентов.
Для технических руководителей компаний GPT-6.1 Sol и Ultrafast показывают, как меняются критерии выбора модели. OpenAI предлагает учитывать не только её возможности, но и отдельно оценивать интеллект, стоимость и задержку.
GPT-6.1 Sol заметно снижает стоимость запуска сложных ИИ-агентов. Ultrafast, напротив, предполагает высокую доплату за экономию времени.
Это даёт корпоративным архитекторам более точный выбор: использовать дорогой инференс там, где скорость приносит бизнесу пользу, а основную массу автономной работы переносить на модели, чьи возможности всё ближе к передовым, но без их высоких цен.
Читайте также
Anthropic обнаружила систему, похожую на Crispr. Что теперь?
OpenAI: ChatGPT каждую неделю охватывает 1,2 млрд человек
OpenAI бросает вызов Microsoft, запуская собственный офисный пакет в духе ChatGPT
OpenAI запустила Dots — постоянно работающих ИИ-напарников и ChatGPT Space для совместной работы с людьми
Флорида просит суд запретить ChatGPT выдавать себя за человека и общаться с детьми
Сможет ли чат-бот распутать лабиринт госуслуг? Белый дом скоро узнает
Новые отчёты о кампаниях раскрывают, сколько американские политики тратят на инструменты ИИ
Основатель Instinct сообщил: более половины сделок на платформе связаны с путешествиями
Autoheal хочет взять на себя работу, которую оставляют ИИ-агенты для программирования, и обещает снизить затраты на задачу до 30%
Новая речевая модель ElevenLabs v4 делает голоса ИИ выразительнее и стабильнее
Reco привлекла $55 млн на фоне наплыва стартапов, защищающих ИИ-агентов
Microsoft Research представила Quine — ИИ-систему для изучения сложных процессов в биологии
Марисса Майер делает ставку на то, что фотоплёнка расскажет о вашей жизни больше, чем почта — с Dazzle
Google AI Overviews подсказал женщине охотиться на милых мелких птиц вне сезона — и она сама вызвала полицию
Хватит стыдить людей за использование ИИ — пора объединяться, чтобы не дать ИИ сделать нас ненужными
Тимнит Гебру считает, что экзистенциальной угрозы от ИИ нет
GPT-6.1 Astra слишком склонна к обману, чтобы выпускать её, — OpenAI пошла на самые решительные меры безопасности за всю историю компании
Данные показывают: ИИ уничтожил рабочие места в креативных отраслях
OpenAI снова открыла тариф Pro за $200, но вдвое сократила кредиты API и подталкивает пользователей к оплате по факту использования
ИИ-бум захватил климатическую неделю — и рады этому не все
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram