OpenAI 29 сентября выпустила GPT‑6.1 Sol — обновление рабочей модели для программирования, управления компьютером и профессиональных задач. В тестах компании новая версия приблизилась к GPT‑6 Astra, но выполняла ряд заданий примерно в пять раз дешевле. Модель уже доступна в API, ChatGPT Work и Codex платным пользователям; в обычном Chat её пока нет.

Неделю назад GPT‑6 Sol и Luna сделали новое поколение моделей заметно дешевле предшественников. GPT‑6.1 Sol сохраняет стандартные тарифы Sol — $2 за миллион входных и $10 за миллион выходных токенов, — но цена кэшированного входа снизилась вдвое, до $0,10. Главная заявленная экономия возникает не из нового стандартного тарифа, а из меньшей расчётной стоимости выполнения конкретных тестовых задач при выбранных режимах рассуждения.

На DeepSWE модель превысила лучший результат GPT‑6 Sol на 6,4 процентного пункта и сравнялась с Astra примерно при пятой части стоимости задания. В OSWorld она отстала от Astra на 2,1 пункта, но стоила примерно в семь раз дешевле; на Terminal-Bench Science более чем удвоила результат прежней Sol, хотя Astra сохранила лучший балл — 68,1%.

Все эти сравнения провела или собрала сама OpenAI. Они получены в исследовательской среде и API, а результаты конкурентов взяты из публичных отчётов с не полностью одинаковыми условиями. Поэтому релиз доказывает доступность более сильной Sol по прежнему базовому тарифу и с более дешёвым кэшем, но не независимое равенство Astra и не гарантированное пятикратное снижение расходов в реальной работе.