OpenAI представила GPT-6.1 Sol — модель для программирования, работы с документами и многошаговых бизнес-задач. Компания ставит её между GPT-6 Sol и более мощной GPT-6 Astra.
Главное обещание — близкая к Astra производительность при заметно меньших расходах. Стандартные входные и выходные токены GPT-6.1 Sol стоят в пять раз дешевле, чем у старшей модели.
По внутренним тестам OpenAI, новинка сравнялась с Astra в DeepSWE v1.1. Этот тест проверяет, как ИИ справляется с долгими задачами разработки в реальных кодовых базах. Результат GPT-6 Sol новая модель превысила на 6,4 процентного пункта.
В AutomationBench, где моделям поручают цепочки офисных и бизнес-операций, GPT-6.1 Sol обошла GPT-6 Sol на 4,8 пункта. На тесте управления компьютером OSWorld 2.0 она отстала от Astra лишь на 2,1 пункта, но одна задача обходилась примерно в семь раз дешевле.
Компания также заявляет о снижении числа фактических ошибок. В специально отобранном наборе сложных диалогов хотя бы одна ошибка встречалась в 7,7% ответов против 11,4% у GPT-6 Sol. OpenAI подчёркивает, что эта выборка не отражает обычное использование.
Модель уже доступна в API под именем gpt-6.1-sol. Для запросов объёмом до 272 тысяч входных токенов миллион входных токенов стоит $2, выходных — $10; для более длинных запросов действуют повышенные тарифы. Контекст вмещает 1,05 млн токенов, а максимальный ответ — 128 тысяч. Модель принимает текст и изображения, но не работает с аудио и видео.
GPT-6.1 Sol также появилась у подписчиков Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex. В обычном чате на момент запуска её нет.
В документах по безопасности OpenAI присвоила модели критический уровень кибервозможностей и высокий уровень возможностей в биологии и химии. Поэтому для неё действует тот же набор защитных мер, что и для GPT-6 Astra.