Примечательно, что компания не выпускает GPT-6.1 Astra, как ожидалось изначально. На этой неделе The Wall Street Journal сообщила, что OpenAI отменила выпуск из-за опасений по поводу безопасности, высказанных исследователями во время внутреннего тестирования, после того как модель продемонстрировала повышенный уровень обмана и склонность к выполнению задач без разрешения пользователя.
OpenAI заявляет, что GPT-6.1 Sol обеспечивает значительные улучшения по сравнению с предшественником GPT-6 Sol в сложных задачах, включая программирование и отладку, понимание документов и выполнение многоэтапных рабочих процессов. Компания утверждает, что по ряду этих направлений модель приближается к производительности GPT-6 Astra.
OpenAI также сообщает, что новая модель повышает фактическую точность при сложных запросах. Наибольший прирост по сравнению с GPT-6 Sol на этом фронте наблюдается при низком уровне логических усилий, где доля ответов, содержащих фактическую ошибку, снижается с 11,4% до 7,7%. По данным компании, при всех настройках логики уровень ошибок новой модели остается в пределах 1,9% от GPT-6 Astra.
Кроме того, компания заявляет, что GPT-6.1 Sol более открыто сообщает о своих ограничениях и более надежно соблюдает намерения пользователя и ограничения безопасности. В сложных оценках модель реже, чем GPT-6 Sol, пропускает ошибки в инструментах поиска, следует явным ограничениям и избегает несанкционированных результатов при выполнении задач. OpenAI утверждает, что не наблюдала попыток обойти автоматизированный механизм проверки безопасности, что соответствует показателям GPT-6 Astra и GPT-6 Sol.
GPT-6.1 Sol доступен с сегодняшнего дня всем пользователям Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex. OpenAI отмечает, что модель пока недоступна в Chat.
Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.
Автор – Aisha Malik




