DEV Community

TechNotes
TechNotes

Posted on

Opus 5.5, Fable 5.1, GPT-6, DeepSeek и Grok: цены и скорость

Осень 2026 года выдалась самой плотной за историю этой гонки. За четыре недели вышли модели от четырёх лабораторий, и выбрать между ними по рекламным таблицам уже не получается. Ниже — что и когда выпустили, почему цифры производителей стоит делить и насколько быстро модели решают задачи на самом деле.

Календарь релизов уместился в один месяц

1 сентября 2026 года Anthropic выпустила Claude Fable 5.1. Через два дня OpenAI показала GPT-6 Astra. 10 сентября DeepSeek выпустила V4.1 Flash без презентации, а 21 сентября xAI выпустила Grok 4.7.

Следующий день оказался самым плотным: 22 сентября Anthropic выпустила Claude Opus 5.5, а OpenAI — GPT-6 Sol и GPT-6 Luna. 28 сентября вышла Claude Sonnet 5.5, 29 сентября — GPT-6.1 Sol. GPT-6.1 Astra OpenAI в ожидавшийся день так и не выпустила.

Таблицам производителей верить можно только грубо

Цифры компаний выгодны их собственным моделям, и причины просты: выбор тестов, уровень рассуждения, собственная обвязка. Один и тот же тест в разных обвязках даёт разные числа. Terminal-Bench 4.0 для Grok 4.7 — 37,6 % у xAI против 33 % у Artificial Analysis. Сравнивать по таблицам разных компаний можно, но результат будет грубым.

Скорость печати: разрыв почти в четыре раза

Скорость вывода в токенах в секунду. Данные: Artificial Analysis, 3 октября 2026 года. График: Технозаметки

По данным Artificial Analysis на 3 октября 2026 года лидирует DeepSeek V4.1 Flash — 224 токена в секунду. Дальше идут Claude Sonnet 5.5 (140), GPT-6 Luna (125), DeepSeek V4 Pro (109), Claude Opus 5.5 на максимальном уровне (93), Grok 4.7 (79), Claude Fable 5.1 (68), GPT-6.1 Sol (61). Замыкает список GPT-6 Astra с 54 токенами в секунду.

Время до первого слова расходится ещё сильнее

Время до первого токена ответа, в секундах. Данные: Artificial Analysis, 3 октября 2026 года. График: Технозаметки

Здесь разброс куда драматичнее. Обе модели DeepSeek отвечают за 1–2 секунды, Grok 4.7 — за 43. GPT-6 Luna доходит до первого токена за 133 секунды, Claude Fable 5.1 — за 187, GPT-6.1 Sol — за 282, GPT-6 Astra — за 319. Claude Sonnet 5.5 тратит 444 секунды, а Claude Opus 5.5 на максимальном уровне — 689 секунд.

Сколько часов чистой печати уходит на весь прогон

Сколько часов чистой печати ушло на весь прогон индекса: выходные токены, делённые на скорость вывода. Оценка по данным Artificial Analysis. График: Технозаметки

Если поделить выходные токены прогона индекса на скорость печати, картина такая (оценка по данным Artificial Analysis, 3 октября 2026). Claude Sonnet 5.5: 420 млн токенов при 140 токенов/с — около 840 часов. Примерно столько же у Grok 4.7. Claude Opus 5.5 и Claude Fable 5.1 — около 780 часов, DeepSeek V4 Pro — около 410, GPT-6 Astra и GPT-6.1 Sol — около 300 часов.

Это именно оценка, а не замер: запросы идут параллельно, скорость меняется со временем.

Тест BitsMinds: качество против минут

Одна и та же задача: сколько минут ушло у Opus 5.5, Fable 5.1 и GPT-6 Astra. Данные: BitsMinds, 22 сентября 2026 года. График: Технозаметки

22 сентября 2026 года BitsMinds прогнали Opus 5.5, Fable 5.1 и GPT-6 Astra на трёх заданиях: развязка шоссе в SVG, ярмарка у моря, страница запуска ракеты. По одной попытке на максимальном рассуждении.

Качество: Opus 5.5 — 10 очков, Fable — 9, Astra — 8. По времени развязка заняла у Opus 59 минут, у Fable 26, у Astra 16. Ярмарка: 63, 35 и 27 минут. Ракета: 77, 49 и 28 минут. Opus рассуждал около часа до первой строки кода, а Astra оказалась быстрее более чем вдвое в каждом раунде.

DataCamp: дешёвая итерация против одного долгого круга

DataCamp сравнил Opus 5.5 и GPT-6 Sol на клоне «Тетриса» с переворотом гравитации каждые 20 секунд. Механику правильно сделали обе модели, но подошли к ней по-разному.

  • Sol: 6 ходов, 9 вызовов инструментов, 5 баллов из 5, 26 центов
  • Opus: 3 хода, 2 вызова инструментов, 4,3 балла, 87 центов

Sol быстро пробовала и исправляла, Opus долго думал и писал сразу. Итог: у Sol выше балл и втрое ниже цена.

Одна модель и одна задача могут отличаться в пять раз

Grok 4.7 на средней задаче индекса выдаёт 81 тысячу выходных токенов. При 188 токенах/с в день выхода это около семи минут. При 40 токенах/с через четыре дня — больше получаса. При нынешних 79 токенах/с — около семнадцати минут.

Быстрее решает и лучше решает — это разные модели

Если нужен результат с первой попытки и вы готовы ждать, берите Opus 5.5 на высоком рассуждении. Если нужен рабочий вариант за четверть часа и дешевле, смотрите на GPT-6 Astra и GPT-6.1 Sol. А если задача поддаётся итерациям, Sol обойдётся втрое дешевле одного долгого круга Opus.

Что делать с этими числами дальше, зависит от вашего сценария: в полной версии есть прейскурант API за миллион токенов, разбор кэша на длинной сессии, сравнение подписок, а также инструкции, как проверить модели на своих задачах и как с этим работать из России.

Текст подготовлен с использованием искусственного интеллекта.

Top comments (0)