Claude Opus 5 занял первое место в Artificial Analysis интеллектуальном индексе v4.1

robot
Генерация тезисов в процессе
深潮 TechFlow, 25 июля, Anthropic’s Claude Opus 5 (версии max и xhigh) получил наивысшую оценку интеллекта в Artificial Analysis Intelligence Index v4.1. Индекс объединяет 9 тестовых бенчмарков, включая GDPval-AA v2, GPQA Diamond и Humanity’s Last Exam. Ранее Opus 5 уже демонстрировал лидирующую производительность на ряде бенчмарков: в Frontier-Bench он набрал в 2 раза больше, чем предыдущее поколение, возглавил бенчмарк для AI-агентов AA-Briefcase и по соотношению цена/качество оказался лучше, чем Fable 5.
Посмотреть Оригинал
На этой странице может содержаться сторонний контент, который предоставляется исключительно в информационных целях (не в качестве заявлений/гарантий) и не должен рассматриваться как поддержка взглядов компании Gate или как финансовый или профессиональный совет. Подробности смотрите в разделе «Отказ от ответственности» .
  • Награда
  • комментарий
  • Репост
  • Поделиться
комментарий
Добавить комментарий
Добавить комментарий
Нет комментариев
  • Закреплено