Kimi K3 набирает 1543 Elo в бенчмарке для офисных задач; он в 10 раз дороже, чем K2.6.

В обновленном бенчмарке AA-Briefcase от Artificial Analysis Kimi K3 набрала 1543 балла Elo, уступив только Claude Fable 5 (1574) и опередив GPT-5.6 Sol. Бенчмарк оценивает модели по извлечению информации, анализу документов и генерации итоговых материалов на основе 91 конфиденциальной задачи.

Однако рост производительности K3 сопровождался существенно более высокими затратами: 10,57 доллара за задачу — примерно в 10 раз больше, чем у Kimi K2.6. В среднем модель выполняла 83 итерации и генерировала 120 000 токенов на задачу, а на завершение требовалось 56,4 минуты — примерно в 2,5 раза дольше, чем у Fable 5.

Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев