Модель Opus 5 набрала 30,2% на бенчмарке ARC-AGI 3. Результат отмечается как заметный в контексте оценки возможностей искусственного общего интеллекта.

Недавний тест показал, что модель Opus 5 достигла результата 30,2% на бенчмарке ARC-AGI 3. Этот бенчмарк используется для оценки навыков рассуждения и решения проблем в системах ИИ. Результат стал поводом для обсуждения прогресса в направлении AGI.

Источники 1
  • Opus 5 показала 30,2% на бенчмарке ARC-AGI 3 AI Post
    A recent test shows Opus 5 achieved a 30.2% score on the ARC-AGI 3 benchmark.
    
    This result is notable in the ongoing evaluation of artificial general intelligence (AGI) capabilities. The benchmark is designed to assess reasoning and problem-solving skills in AI systems.
    
    Developments such as this contribute to the discussion about how close AGI is to becoming a practical reality.
    
    📰 @aipost