Рейтинг моделей с изображениями на входе
Таблица по открытым замерам оценок людей: оценка, интервал и число голосов; переключайте категорию и дату снимка.
Динамика рейтинга
Как считается
Оценки и интервалы приведены как в открытых замерах оценок людей, без пересчёта; доля использования — по публичным данным API-агрегаторов (топ-K моделей и строка «прочие»); характеристики и цены — из каталогов и провайдеров с датой наблюдения. Интервал у оценки не равен диапазону мест: соседние модели с пересекающимися интервалами статистически неразличимы.
Полная методика: источники, частота обновления, что означает число
Смысл числа
- Метрика
- рейтинг Брэдли — Терри (Elo-подобная шкала) с интервалом из источника
- Единица выборки
- голос в парном сравнении
- Окно
- снимок датасета от 13 сентября 2026
- Как читать
- интервал не равен диапазону мест: модели с пересекающимися интервалами статистически неразличимы
Таблица борда
Снимок от 13 сентября 2026, категория «школьные задания», 102 строк. Оценка и интервал — из источника; интервал не равен диапазону мест.
| Место | Модель | Разработчик | Оценка | Интервал | Голоса | Лицензия |
|---|---|---|---|---|---|---|
| 1 | GLM 5.3 Flash | Z.ai | 1 357 | 1 321–1 393 | 289 | MIT |
| 2 | Claude Fable 5 | Anthropic | 1 353 | 1 336–1 370 | 1 318 | Proprietary |
| 3 | Claude Fable 5.1 в режиме max | Anthropic | 1 348 | 1 316–1 379 | 345 | Proprietary |
| 4 | Claude Opus 5 в режиме high | Anthropic | 1 346 | 1 328–1 365 | 1 073 | Proprietary |
| 5 | Qwen3.8 Max (0902) | Alibaba Qwen | 1 344 | 1 323–1 366 | 769 | Proprietary |
| 6 | GPT-5.4 в режиме high | OpenAI | 1 338 | 1 326–1 349 | 3 264 | Proprietary |
| 7 | Claude Opus 4.7 в режиме high | Anthropic | 1 337 | 1 325–1 349 | 2 906 | Proprietary |
| 8 | Claude Opus 4.6 в режиме high | Anthropic | 1 337 | 1 325–1 349 | 2 701 | Proprietary |
| 9 | Claude Opus 4.7 | Anthropic | 1 336 | 1 324–1 348 | 2 968 | Proprietary |
| 10 | GPT-5.5 в режиме high | OpenAI | 1 336 | 1 324–1 348 | 2 842 | Proprietary |
| 11 | Claude Opus 4.8 в режиме high | Anthropic | 1 335 | 1 320–1 350 | 1 671 | Proprietary |
| 12 | Gemini 3.6 Flash в режиме high | 1 329 | 1 301–1 358 | 445 | Proprietary | |
| 13 | GPT-5.5 · 5.5 | OpenAI | 1 329 | 1 317–1 341 | 2 955 | Proprietary |
| 14 | Claude Opus 4.6 | Anthropic | 1 328 | 1 317–1 339 | 3 551 | Proprietary |
| 15 | Gemini 3.5 Flash в режиме medium | 1 325 | 1 305–1 344 | 921 | Proprietary | |
| 16 | Claude Opus 4.8 | Anthropic | 1 325 | 1 310–1 339 | 1 835 | Proprietary |
| 17 | GPT-5.6 Sol в режиме xhigh | OpenAI | 1 322 | 1 299–1 344 | 697 | Proprietary |
| 18 | Gemini 3.1 Pro Preview | 1 317 | 1 308–1 326 | 5 453 | Proprietary | |
| 19 | GPT-5.6 Terra в режиме xhigh | OpenAI | 1 317 | 1 294–1 339 | 718 | Proprietary |
| 20 | Gemini 3 Pro | 1 314 | 1 299–1 328 | 1 708 | Proprietary | |
| 21 | Claude Sonnet 5 в режиме high | Anthropic | 1 313 | 1 294–1 332 | 1 010 | Proprietary |
| 22 | Gemini 3 Flash Preview | 1 313 | 1 304–1 322 | 4 992 | Proprietary | |
| 23 | GPT-5.4 | OpenAI | 1 312 | 1 300–1 324 | 2 907 | Proprietary |
| 24 | Claude Sonnet 4.6 | Anthropic | 1 312 | 1 301–1 323 | 3 526 | Proprietary |
| 25 | Gemini 3.5 Flash в режиме high | 1 312 | 1 293–1 331 | 1 045 | Proprietary | |
| 26 | Kimi K2.6 | Moonshot AI | 1 310 | 1 297–1 323 | 2 136 | Modified MIT |
| 27 | Gemma 4 31B | 1 309 | 1 300–1 318 | 5 774 | Apache 2.0 | |
| 28 | Grok 4.5 | xAI | 1 308 | 1 286–1 331 | 731 | Proprietary |
| 29 | Muse Spark | Meta | 1 300 | 1 281–1 320 | 913 | Proprietary |
| 30 | Gemini 3 Flash Preview в режиме minimal | 1 299 | 1 290–1 308 | 4 807 | Proprietary | |
| 31 | Kimi K2.5 · thinking | Moonshot AI | 1 296 | 1 286–1 307 | 3 495 | Modified MIT |
| 32 | Gemma 4 26B A4B | 1 293 | 1 282–1 304 | 3 654 | Apache 2.0 | |
| 33 | Gemini 3.5 Flash Lite | 1 292 | 1 264–1 320 | 454 | Proprietary | |
| 34 | Qwen3.8 27B | Alibaba Qwen | 1 291 | 1 263–1 318 | 479 | Apache 2.0 |
| 35 | GPT-5.6 Luna в режиме xhigh | OpenAI | 1 289 | 1 266–1 313 | 693 | Proprietary |
| 36 | Qwen3.5 397B A17B | Alibaba Qwen | 1 289 | 1 279–1 300 | 3 372 | Apache 2.0 |
| 37 | Qwen3.7 Plus | Alibaba Qwen | 1 288 | 1 271–1 306 | 1 147 | Proprietary |
| 38 | GPT-5.4 Mini в режиме high | OpenAI | 1 286 | 1 275–1 298 | 3 333 | Proprietary |
| 39 | GPT-5.2 Chat | OpenAI | 1 286 | 1 274–1 299 | 2 382 | Proprietary |
| 40 | Seed 2.0 Pro | ByteDance Seed | 1 284 | 1 270–1 299 | 1 737 | Proprietary |
| 41 | Muse Spark 1.3 в режиме max | Meta | 1 283 | 1 242–1 325 | 196 | Proprietary |
| 42 | Gemini 2.5 Flash · flash-preview-09-2025 | 1 283 | 1 260–1 306 | 601 | Proprietary | |
| 43 | Gemini 2.5 Pro | 1 281 | 1 272–1 290 | 5 287 | Proprietary | |
| 44 | Qwen3 VL 235B A22B Instruct | Alibaba Qwen | 1 281 | 1 266–1 296 | 1 552 | Apache 2.0 |
| 45 | Muse Spark 1.1 | Meta | 1 280 | 1 259–1 302 | 788 | Proprietary |
| 46 | GPT-5 | OpenAI | 1 280 | 1 263–1 297 | 1 310 | Proprietary |
| 47 | GPT-5.2 в режиме high | OpenAI | 1 279 | 1 267–1 291 | 2 795 | Proprietary |
| 48 | Grok 4.20 Multi-Agent | xAI | 1 274 | 1 262–1 285 | 3 163 | Proprietary |
| 49 | GPT-5.1 в режиме high | OpenAI | 1 272 | 1 256–1 289 | 1 167 | Proprietary |
| 50 | GLM 5V Turbo | Z.ai | 1 270 | 1 260–1 280 | 4 595 | Proprietary |
| 51 | Gemini 3.1 Flash Lite Preview | 1 269 | 1 259–1 280 | 3 777 | Proprietary | |
| 52 | MiniMax M3 | MiniMax | 1 268 | 1 253–1 283 | 1 775 | MiniMax Community License |
| 53 | Grok 4.20 | xAI | 1 265 | 1 255–1 276 | 3 476 | Proprietary |
| 54 | MiMo-V2.5 | Xiaomi | 1 264 | 1 253–1 275 | 3 435 | MIT |
| 55 | Grok 4.6 в режиме high | xAI | 1 264 | 1 232–1 296 | 326 | Proprietary |
| 56 | Kimi K2.5 · instant | Moonshot AI | 1 263 | 1 240–1 287 | 548 | Modified MIT |
| 57 | GPT-5.2 | OpenAI | 1 262 | 1 251–1 274 | 2 896 | Proprietary |
| 58 | Qwen3.5-122B-A10B | Alibaba Qwen | 1 261 | 1 247–1 275 | 1 860 | Apache 2.0 |
| 59 | ChatGPT-4o (latest) | OpenAI | 1 255 | 1 242–1 268 | 2 079 | Proprietary |
| 60 | Qwen3.5-27B | Alibaba Qwen | 1 255 | 1 244–1 266 | 3 209 | Apache 2.0 |
| 61 | MiMo-V2 Omni | Xiaomi | 1 253 | 1 238–1 269 | 1 583 | Proprietary |
| 62 | GPT-5.5 · 5.5-instant | OpenAI | 1 253 | 1 235–1 272 | 1 128 | Proprietary |
| 63 | ERNIE 5.0 | Baidu | 1 252 | 1 223–1 281 | 354 | Proprietary |
| 64 | GPT-4.1 | OpenAI | 1 249 | 1 232–1 265 | 1 483 | Proprietary |
| 65 | Hunyuan Vision 1.5 | Tencent | 1 246 | 1 213–1 278 | 296 | Proprietary |
| 66 | Gemini 2.5 Flash · flash | 1 245 | 1 236–1 254 | 4 749 | Proprietary | |
| 67 | Grok 4.3 | xAI | 1 244 | 1 233–1 256 | 2 874 | Proprietary |
| 68 | Inkling Small | Thinking Machines Lab | 1 244 | 1 216–1 272 | 435 | Apache 2.0 |
| 69 | GPT-5.1 | OpenAI | 1 243 | 1 227–1 259 | 1 356 | Proprietary |
| 70 | Qwen3 VL 235B A22B Thinking | Alibaba Qwen | 1 236 | 1 204–1 268 | 298 | Apache 2.0 |
| 71 | o4 Mini | OpenAI | 1 235 | 1 220–1 251 | 1 590 | Proprietary |
| 72 | o3 | OpenAI | 1 234 | 1 220–1 249 | 1 932 | Proprietary |
| 73 | GPT-5 в режиме high | OpenAI | 1 231 | 1 214–1 247 | 1 400 | Proprietary |
| 74 | Claude Opus 4 · 20250514 | Anthropic | 1 229 | 1 196–1 262 | 306 | Proprietary |
| 75 | Mistral Medium 3.5 | Mistral AI | 1 228 | 1 205–1 250 | 761 | Modified MIT |
| 76 | GPT-5.4 Nano в режиме high | OpenAI | 1 227 | 1 215–1 238 | 3 274 | Proprietary |
| 77 | GPT-4.1 Mini | OpenAI | 1 215 | 1 198–1 232 | 1 311 | Proprietary |
| 78 | Claude Sonnet 4 | Anthropic | 1 213 | 1 177–1 249 | 232 | Proprietary |
| 79 | Gemini 2.5 Flash Lite · 09-2025-no-thinking | 1 212 | 1 190–1 234 | 600 | Proprietary | |
| 80 | Mistral Large 3 2512 | Mistral AI | 1 212 | 1 186–1 237 | 576 | Apache 2.0 |
| 81 | GPT-5 Mini в режиме high | OpenAI | 1 211 | 1 192–1 231 | 984 | Proprietary |
| 82 | Claude 3.7 Sonnet · 20250219 | Anthropic | 1 206 | 1 169–1 242 | 218 | Proprietary |
| 83 | Claude Opus 4 · 20250514-thinking-16k | Anthropic | 1 195 | 1 151–1 240 | 162 | Proprietary |
| 84 | Claude 3.7 Sonnet · 20250219-thinking-32k | Anthropic | 1 194 | 1 152–1 235 | 174 | Proprietary |
| 85 | Gemini 2.5 Flash Lite · 06-17-thinking | 1 191 | 1 174–1 207 | 1 328 | Proprietary | |
| 86 | Step 3 | StepFun | 1 186 | 1 147–1 225 | 217 | Apache 2.0 |
| 87 | Gemini 2.0 Flash | 1 178 | 1 156–1 199 | 761 | Proprietary | |
| 88 | Mistral Small 3.2 24B | Mistral AI | 1 175 | 1 152–1 199 | 616 | Apache 2.0 |
| 89 | Grok 4.1 Fast | xAI | 1 172 | 1 158–1 187 | 1 964 | Proprietary |
| 90 | Grok 4 | xAI | 1 171 | 1 153–1 190 | 1 071 | Proprietary |
| 91 | Mistral Medium 3 | Mistral AI | 1 167 | 1 147–1 188 | 815 | Proprietary |
| 92 | GLM 4.5V | Z.ai | 1 167 | 1 128–1 205 | 216 | MIT |
| 93 | Llama 4 Maverick | Meta | 1 165 | 1 140–1 190 | 529 | Llama 4 |
| 94 | Mistral Medium 3.1 | Mistral AI | 1 164 | 1 151–1 178 | 2 102 | Proprietary |
| 95 | Gemma 3 27B | 1 163 | 1 145–1 182 | 1 031 | Gemma | |
| 96 | Mistral Small 3.1 24B | Mistral AI | 1 158 | 1 137–1 179 | 813 | Apache 2.0 |
| 97 | GPT-5 Nano в режиме high | OpenAI | 1 157 | 1 122–1 192 | 262 | Proprietary |
| 98 | GLM 4.6V | Z.ai | 1 156 | 1 120–1 193 | 268 | MIT |
| 99 | Step-1o Turbo | StepFun | 1 156 | 1 121–1 192 | 238 | Proprietary |
| 100 | Llama 4 Scout | Meta | 1 150 | 1 125–1 176 | 482 | Llama |
| 101 | Claude 3.5 Sonnet | Anthropic | 1 137 | 1 098–1 176 | 210 | Proprietary |
| 102 | Claude 3.5 Haiku | Anthropic | 1 118 | 1 079–1 157 | 213 | Proprietary |
Данные на 13 сентября 2026. Как мы считаем: методика
Свежесть данных
Снимок замеров опубликован 13 сентября 2026; всего снимков борда в архиве: 148.
- замеры оценок людей: загружено 18 сентября 2026, 08:25 UTC
- каталог моделей и цены: загружено 18 сентября 2026, 08:51 UTC
- доли использования: загружено 18 сентября 2026, 08:51 UTC
Другие рейтинги
- Рейтинг агентов
- Рейтинг работы с документами
- Рейтинг редактирования изображений
- Рейтинг видео из изображения
- Популярность моделей по использованию через API-агрегаторы
- Рейтинг поисковых моделей
- Рейтинг текстовых моделей
- Рейтинг моделей для кода
- Рейтинг моделей для творческих текстов
- Рейтинг моделей для математики
- Рейтинг моделей для русского языка
- Рейтинг генерации изображений
- Рейтинг генерации видео
- Рейтинг редактирования видео
- Рейтинг моделей для веб-разработки
Данные и источники
Обновлено 18 сентября 2026. Каталог, цены и режимы проверяются ежедневно по нескольким API-агрегаторам и провайдерам. Места — по открытым замерам оценок людей, интервалы приведены как в замере.