Новость
Opus 5 показала 30,2% на бенчмарке ARC-AGI 3
Модель Opus 5 набрала 30,2% на бенчмарке ARC-AGI 3. Результат отмечается как заметный в контексте оценки возможностей искусственного общего интеллекта.
Недавний тест показал, что модель Opus 5 достигла результата 30,2% на бенчмарке ARC-AGI 3. Этот бенчмарк используется для оценки навыков рассуждения и решения проблем в системах ИИ. Результат стал поводом для обсуждения прогресса в направлении AGI.
Источники
1
-
Opus 5 показала 30,2% на бенчмарке ARC-AGI 3
AI Post
A recent test shows Opus 5 achieved a 30.2% score on the ARC-AGI 3 benchmark. This result is notable in the ongoing evaluation of artificial general intelligence (AGI) capabilities. The benchmark is designed to assess reasoning and problem-solving skills in AI systems. Developments such as this contribute to the discussion about how close AGI is to becoming a practical reality. 📰 @aipost