Языковая модель GPT-5.6 Sol от OpenAI заняла первое место в рейтинге Design Arena, набрав 1353 балла по системе Elo и опередив предыдущего лидера на 60 пунктов.
Новая версия модели GPT-5.6 Sol, разработанная OpenAI, установила рекорд на платформе Design Arena, специализирующейся на оценке производительности языковых моделей. По данным рейтинга, опубликованным 12 июля, модель набрала 1353 балла по шкале Elo, что на 60 пунктов превышает результат её предшественника — GPT-5.
Design Arena представляет собой открытую площадку для сравнения возможностей ИИ-моделей в решении задач, связанных с генерацией и анализом текстов. Рейтинг формируется на основе результатов тестирования, проводимого как разработчиками, так и независимыми исследователями. Показатель Elo, традиционно используемый в шахматах и других интеллектуальных играх, адаптирован здесь для оценки точности, логической связности и креативности ответов моделей.
Ранее лидерство в рейтинге удерживали модели от Google DeepMind и Anthropic, однако GPT-5.6 Sol стала первой, преодолевшей отметку в 1350 баллов. Представители OpenAI пока не комментировали достижение, однако в сообществе разработчиков уже обсуждаются возможные причины такого скачка: среди них — оптимизация архитектуры нейросети и расширение обучающего датасета.
Стоит отметить, что Design Arena не является единственным бенчмарком для оценки языковых моделей. Другие платформы, такие как LMSYS Chatbot Arena, используют иные методики, включая сравнение с человеческими оценками. Тем не менее, лидерство в одном из ключевых рейтингов может укрепить позиции OpenAI на рынке корпоративных и исследовательских решений в сфере ИИ.