Kimi K2.5

Kimi K2.5 — модель разработчика Moonshot AI, семейство Kimi. Ниже — места в рейтингах, цены, режимы работы и ближайшие альтернативы.

История рейтинга

Загружаем историю замеров…

Главное

  • Место в общем рейтинге53-еиз 402замер 13 сентября 2026
  • Цена за 1 млн токенов$0,45 / $2,25вход / выходу отдельных провайдеров до $0,60 / $3,33
  • Контекст262 144токеновответ до 235 929 токенов
  • ПринимаетТекст, изображенияотвечает: текст
  • В каталогах с27 января 2026
  • БесплатноНеттолько платные тарифы

Для каких задач

Места по открытым замерам оценок людей, лучший режим модели; замеры 11 сентября 2026 — 13 сентября 2026.

Бенчмарки

  • Индекс программирования46,862-е из 125лучший результат 81,6 у Claude Fable 5.1

Проверка на реальных провайдерах

ТестРезультат по площадкамПлощадокПрогоновДата
GPQA Diamond — вопросы уровня аспирантуры65,9 % — 90,0 %113012 сентября 2026
τ-bench — сценарии поддержки авиакомпании60,4 % — 73,7 %113112 сентября 2026

Дизайн и вёрстка

  • Agents: godotgamedev 8-еиз 28· побед 60 %
  • Android-приложения 26-еиз 35· побед 58 %
  • Мобильные приложения 26-еиз 40· побед 55 %
  • Веб-приложения 27-еиз 39· побед 52 %
  • Полноценные приложения 28-еиз 41· побед 55 %
  • ASCII-графика 29-еиз 61· побед 46 %

Индексы — сводные оценки независимой лаборатории тестирования; проверка на площадках — прогоны агрегатора у провайдеров, показан диапазон результатов; дизайн — парные сравнения вёрстки и кода по категориям.

Места в рейтингах

РейтингМестоОценкаРежимВыборкаДата замера
Общий зачёт
53-еиз 402
1 446 1 442–1 449базовый70 51313 сентября 2026
Программирование
39-еиз 397
1 485 1 471–1 498базовый1 76913 сентября 2026
Математика
36-еиз 384
1 469 1 460–1 479базовый3 91613 сентября 2026
Русский язык
65-еиз 366
1 436 1 429–1 443базовый7 99213 сентября 2026
Веб-разработка
64-еиз 127
1 436 1 431–1 442базовый19 04211 сентября 2026
Работа с изображениями
39-еиз 152
1 267 1 261–1 273базовый26 64613 сентября 2026
Работа с документами
34-еиз 44
1 430 1 423–1 437базовый21 56913 сентября 2026

Оценка — рейтинг по парным сравнениям людей, рядом интервал разброса; для агентных задач показана доля успешных выполнений. Выборка — число голосов или прогонов в снимке.

Популярность: доля токенов через API-агрегаторы за 30 дней не зафиксирована.

Сколько это стоит на практике

  • $1,26Чат-помощник1 000 сообщений: 300 токенов запроса и 500 токенов ответа каждоевход 300 000 · выход 500 000 токенов
  • $2,70Разбор документов100 документов по 50 000 токенов входа, ответ 2 000 токеноввход 5 000 000 · выход 200 000 токенов
  • $3,60Программирование200 задач по 20 000 токенов входа и 4 000 токенов ответавход 4 000 000 · выход 800 000 токенов

Сумма = вход × цена входа + выход × цена выхода, цены за 1 млн токенов, проверены 10 сентября 2026. Токены рассуждения оплачиваются как ответ.

Альтернативы

  • Лидер общего рейтингаClaude Fable 5.11-е из 402 в общем зачётецена $10 / $50выше на 52 места
  • Дешевле при том же уровнеGLM 5.3 Flash24-е из 402 в общем зачётецена $0,09 / $0,30дешевле в 6,9 раза, на 29 мест выше
  • Американская альтернативаClaude Opus 52-е из 402 в общем зачётецена $5 / $25разработчик Anthropic, США

Подбор по последнему снимку общего зачёта и ценам за 1 млн токенов (вход + выход).

Данные и источники

Обновлено 18 сентября 2026. Каталог, цены и режимы проверяются ежедневно по нескольким API-агрегаторам и провайдерам. Места — по открытым замерам оценок людей, интервалы приведены как в замере. Популярность — доля наблюдённых токенов через API-агрегаторы за 30 дней.

Как мы считаем: методика