gpt-oss-120b

gpt-oss-120b — модель разработчика OpenAI, семейство Gpt Oss. Ниже — места в рейтингах, цены, режимы работы и ближайшие альтернативы.

История рейтинга

Загружаем историю замеров…

Главное

  • Место в общем рейтинге176-еиз 402Индекс интеллекта 12,3 · 70-е из 95
    замер 13 сентября 2026
  • Цена за 1 млн токенов$0,15 / $0,60вход / выходпакетная обработка $0,15 / $0,60 · у отдельных провайдеров до $0,35 / $0,95
  • Контекст131 072токеновответ до 65 536 токенов
  • ПринимаетТекстотвечает: текст
  • В каталогах с5 августа 2025
  • БесплатноНеттолько платные тарифы

Для каких задач

Места по открытым замерам оценок людей, лучший режим модели; замеры 13 сентября 2026.

Бенчмарки

  • Индекс интеллекта12,370-е из 95лучший результат 53,4 у Claude Fable 5.1
  • Индекс программирования30,485-е из 125лучший результат 81,6 у Claude Fable 5.1
  • Индекс агентных задач6,264-е из 95лучший результат 58,0 у Claude Fable 5.1

Дизайн и вёрстка

  • Игры 106-еиз 107· побед 41 %
  • Визуализация данных 107-еиз 106· побед 44 %
  • 3D-сцены 109-еиз 100· побед 29 %
  • Компоненты интерфейса 112-еиз 104· побед 36 %
  • Код 117-еиз 108· побед 33 %
  • Сайты 118-еиз 114· побед 33 %

Индексы — сводные оценки независимой лаборатории тестирования; проверка на площадках — прогоны агрегатора у провайдеров, показан диапазон результатов; дизайн — парные сравнения вёрстки и кода по категориям.

Места в рейтингах

РейтингМестоОценкаРежимВыборкаДата замера
Общий зачёт
176-еиз 402
1 366 1 361–1 370базовый29 95513 сентября 2026
Программирование
176-еиз 397
1 381 1 373–1 388базовый6 33513 сентября 2026
Математика
161-еиз 384
1 387 1 373–1 401базовый1 76313 сентября 2026
Русский язык
185-еиз 366
1 340 1 327–1 352базовый2 12013 сентября 2026

Оценка — рейтинг по парным сравнениям людей, рядом интервал разброса; для агентных задач показана доля успешных выполнений. Выборка — число голосов или прогонов в снимке.

Популярность: 0,46 % наблюдённых токенов через API-агрегаторы за 30 дней (по 17 сентября 2026).

Режимы работы

РежимЧто этоМеста в рейтингахЦена за 1 млн токенов
режим low, режим medium, режим highуровни рассуждения без отдельных замеров · medium по умолчаниюРейтинг не измеренкак у модели
Пакетная обработкаответы в течение суток, дешевле обычного тарифаРейтинг не измерен$0,15 / $0,60

Режимы — уровни рассуждения одной модели и маршруты доступа. Токены рассуждения оплачиваются как ответ; цена одна, кроме пакетной обработки и бесплатного маршрута.

Сколько это стоит на практике

  • $0,35Чат-помощник1 000 сообщений: 300 токенов запроса и 500 токенов ответа каждоевход 300 000 · выход 500 000 токенов
  • $0,87Разбор документов100 документов по 50 000 токенов входа, ответ 2 000 токеноввход 5 000 000 · выход 200 000 токенов
  • $1,08Программирование200 задач по 20 000 токенов входа и 4 000 токенов ответавход 4 000 000 · выход 800 000 токенов

Сумма = вход × цена входа + выход × цена выхода, цены за 1 млн токенов, проверены 18 сентября 2026. Токены рассуждения оплачиваются как ответ.

Альтернативы

  • Лидер общего рейтингаClaude Fable 5.11-е из 402 в общем зачётецена $10 / $50выше на 175 мест
  • Дешевле у OpenAIGPT-5 Nano218-е из 402 в общем зачётецена $0,05 / $0,40дешевле в 1,7 раза, на 42 места ниже
  • Дешевле при том же уровнеGemma 4 26B A4B 80-е из 402 в общем зачётецена $0,09 / $0,30дешевле в 1,9 раза, на 96 мест выше
  • Китайская альтернативаQwen3.8 Max (0902)14-е из 402 в общем зачётецена $2 / $6разработчик Alibaba Qwen, Китай

Подбор по последнему снимку общего зачёта и ценам за 1 млн токенов (вход + выход).

Данные и источники

Обновлено 18 сентября 2026. Каталог, цены и режимы проверяются ежедневно по нескольким API-агрегаторам и провайдерам. Места — по открытым замерам оценок людей, интервалы приведены как в замере. Популярность — доля наблюдённых токенов через API-агрегаторы за 30 дней.

Как мы считаем: методика