Новость
OpenAI выпустила GPT-5.6: лидер по кодингу и новый парето-фронтир
Новое семейство моделей OpenAI заняло второе место в общем рейтинге и первое по кодингу, обойдя Fable 5. Также отмечается, что модели задают новый парето-фронтир по соотношению цена/качество.
Согласно тестам Artificial Analysis, новое семейство моделей OpenAI GPT-5.6 заняло второе место по общим баллам и первое место по кодингу, обойдя даже Fable 5. По стоимости модели двигают парето-фронтир: практически для любой цены за задачу находится комбинация модели и уровня размышлений от OpenAI, которая превосходит известные альтернативы. Дешёвая Luna на высоком уровне размышлений и выше практически не имеет конкурентов в бюджетном сегменте, а для более дорогих задач лучше использовать Sol, а не Terra. По офисным задачам и хардкорной науке модели немного уступают Fable 5, но превосходят всех в создании презентаций. В остальном показатели либо на уровне, либо выше. Отмечается, что при такой цене и без ограничений вроде «только 50% лимитов» модели являются выдающимися.
-
OpenAI выпустила GPT-5.6: лидер по кодингу и новый парето-фронтир
AI Product | Igor Akimov
Тесты GPT-5.6 Artificial Analysis На втором месте по общим баллам, на 1 месте по кодингу (даже Terra обходит Fable 5) По стоимости двигает парето-фронтир, то есть практически на любую цену за задачу находится какая-то комбинация модели и уровня размышлений от OpenAI, что лучше, чем известные модели. Причем дешевая Luna на high и выше практически не имеет конкурентов в "дешевом" сегменте, а дальше лучше использовать Sol, а не Terra. По офисным задачам чуть хуже Fable 5, по хардкорной науке тоже, но презентации делает лучше всех. Остальное все либо на уровне, либо выше. Короче, за такую цену и без всяких там глупостей типа "только 50% лимитов можете гонять" - офигенные модели выпустили. https://artificialanalysis.ai/articles/gpt-5-6-has-landed