OPENAI · ТРЕКЕР МОДЕЛИ
GPT-6.1 Sol
GPT-6.1 Sol — модель OpenAI, объявленная как значительное обновление GPT-6 Sol и доступная через Amazon Bedrock. Её позиционируют как модель с высокой способностью рассуждать для агентных задач в кодировании, работе с компьютером и профессиональных рабочих процессах, которая на отдельных бенчмарках сопоставима с более продвинутыми моделями при меньшей стоимости за задачу.ТЕКУЩИЙ СНИМОК3/5 РАЗДЕЛОВ С ДАННЫМИ
Главные характеристики в одном месте.
Не установлено по доступным источникам.
Не установлено по доступным источникам.
ХРОНОЛОГИЯ РЕЛИЗОВ
Только опубликованные события с источниками.
Google DeepMind представила Gemini 4 Argon — фронтирную модель с контекстом в 1M токенов
Google DeepMind объявила о модели Gemini 4 Argon — фронтирной мультимодальной модели, заточенной под долгие последовательные рассуждения и сложные рабочие процессы. Argon сначала разворачивается у доверенных киберзащитников в рамках программы Fairwind, увеличивает предел контекста до 1 миллиона токенов, демонстрирует лидирующие результаты по ряду бенчмарков (кодирование, финансы, право, анализ видео) и будет расширенно доступен после поэтапного тестирования безопасности и взаимодействия с органами власти США; также объявлены вводные тарифы.
OpenAI запускает Dots — постоянно активные помощники на GPT-6 Astra
На DevDay OpenAI представила Dots — постоянно активных агентных помощников на базе модели GPT-6 Astra, которые используют собственный облачный компьютер, имеют доступ к браузеру и более чем 4 000 приложений и общаются текстом или голосом в ChatGPT, Teams и Slack. Dots доступны пользователям ChatGPT Pro и Business Premium, пока по одному на аккаунт; у них есть настраиваемые правила и функция авто-проверки безопасности, а общение с Dot не учитывается в лимитах ChatGPT.
ПРОВЕРЯЕМЫЕ ФАКТЫ
Каждое значение привязано к источнику и дате.
По данным AWS, GPT-6.1 Sol доступна для общего использования на Amazon Bedrock.
Запускается на движке инференса в Amazon Bedrock, который описывается как построенный для производительности, безопасности и надежности в масштабе.
Разработчики могут получить доступ к модели через API под именем 'gpt-6.1-sol'; объявлена ожидаемая версия 'Ultrafast' для более быстрой генерации токенов в Codex.
OpenAI опубликовала цену в API для GPT-6.1 Sol: $2 за миллион входных токенов и $10 за миллион выходных токенов; компания также заявляет, что Sol приближается к Astra по качеству при примерно одной пятой стандартной цене входных/выходных токенов.
OpenAI сообщает, что Sol сравнялся с Astra в бенчмарке DeepSWE v1.1 для кодирования (при примерно пятой части стоимости), опередил GPT-6 Sol на этом бенчмарке на 6.4 процентных пункта, превзошёл GPT-6 Sol примерно на 7 пунктов в OSWorld 2.0 и отстал от Astra примерно на 2.1 пункта, превзошёл Opus 5.5 на бенчмарке GDP.pdf при меньшей стоимости, опередил Opus 5.5 на 2.2 пункта в AutomationBench (средняя сложность рассуждений) и более чем вдвое превзошёл GPT-6 Sol в Terminal-Bench Science.
OpenAI заявляет, что GPT-6.1 Sol обеспечивает существенные улучшения по сравнению с GPT-6 Sol в сложных задачах, включая программирование и отладку, понимание документов и выполнение многошаговых рабочих процессов; компания утверждает, что Sol приближается к производительности GPT-6 Astra в агентном программировании, работе с компьютером и профессиональных задачах.
OpenAI сообщает, что при низкой степени рассуждения доля ответов с фактической ошибкой снизилась с 11.4% (GPT-6 Sol) до 7.7% (GPT-6.1 Sol), а по всем уровням рассуждения ошибка Sol оставалась в пределах 1.9% от GPT-6 Astra.
OpenAI заявляет, что GPT-6.1 Sol более откровенен в отношении ограничений и надёжнее соблюдает пользовательские намерения и ограничения безопасности по сравнению с GPT-6 Sol в сложных сценариях (например, обнаружение неисправных поисковых инструментов, выполнение явных ограничений, предотвращение несанкционированных действий); компания сообщила, что не наблюдала попыток Sol обойти автоматизированную систему проверки безопасности.
Описывается как значительное обновление GPT-6 Sol, обеспечивающее высокую производительность при агентном кодировании, работе с компьютером и профессиональных рабочих процессах; позиционируется как дающее «почти Astra» уровень интеллекта для повседневных рабочих задач.
По данным OpenAI (цитируемым в посте AWS), GPT-6.1 Sol на DeepSWE v1.1 соответствует GPT-6 Astra примерно при одной пятой стоимости на задачу и превосходит лучший результат GPT-6 Sol на 6,4 процентных пункта при меньших затратах на рассуждение.
ЧТО ИЗМЕНИЛОСЬ