Семь новых моделей в GPTIK: Grok 4.6, Gemini 3.7 Flash, гигант Qwen3.8 и дешёвое распознавание речи

Обновили каталог: сразу семь новинок, от флагманского Grok 4.6 до крошечных моделей распознавания речи, которые стоят копейки в прямом смысле слова. Три из них уже вошли в мировой топ по индексу качества Artificial Analysis. Рассказываем, что появилось и кому пригодится.
На графике свежий срез индекса качества: Grok 4.6 набирает 61 балл и стоит вровень с GPT-5.6 Sol, Gemini 3.7 Flash с 56 баллами обгоняет модели классом выше, а DeepSeek V4 Pro 0813 держит 53 балла при цене в разы ниже конкурентов.
По данным сайта artificialanalysis.ai.
Grok 4.6: флагман SpaceXAI для долгих агентных задач
SpaceXAI выпустила Grok 4.6 всего через 35 дней после версии 4.5, и это не косметика. База осталась та же, но модель прошла длинный дополнительный цикл обучения с упором на агентные сценарии. Результат: 61 балл в индексе Artificial Analysis против 56 у предшественницы, 65,9% на DeepSWE 1.1 и 69,9% на CursorBench. Любопытный эффект, который отмечают сами разработчики: на длинных цепочках задач модель начала перепроверять свою работу, прежде чем двигаться дальше.
Контекст 500 тысяч токенов, есть vision и вызов функций. Цена ступенчатая, и тут легко просчитаться:
- промпт до 200 тысяч токенов: 300 ₽ за миллион токенов на входе, 900 ₽ на выходе;
- промпт длиннее 200 тысяч токенов: 600 ₽ и 1800 ₽ соответственно, чтение кеша 150 ₽ за миллион.
Ступень применяется ко всему запросу целиком, включая ответ, а не только к токенам сверх порога. Гоняете длинные документы? Закладывайте в расчёты вторую ступень.
Gemini 3.7 Flash: рабочая лошадка Google, которая подешевела на старте
Google выпустила Gemini 3.7 Flash через три недели после 3.6 и называет её своей самой умной «рабочей лошадкой» для кодинга и агентов. Прогресс заметный. На бенчмарке агентного программирования DeepSWE модель выросла с 49,0% до 65,3%, на FrontierCode с 34,4% до 43,6%. При 56 баллах в общем индексе она обходит немало моделей потяжелее, взгляните на график выше.
Модель понимает текст, картинки, аудио, видео и файлы. Контекст миллион токенов. Цена 56,25 ₽ за миллион токенов на входе и 281,25 ₽ на выходе: Google запустила новинку по промо-тарифу, так что сейчас 3.7 Flash стоит дешевле, чем 3.6 Flash на старте.
Есть и batch-вариант вдвое дешевле: 28,125 ₽ и 140,625 ₽. Подходит там, где мгновенный ответ не нужен: пакетная обработка документов, ночные пайплайны, массовая классификация.
Qwen3.8 2.4T: открытый гигант от Alibaba
Alibaba впервые выложила в открытые веса модель класса Qwen-Max: 2,4 триллиона параметров, из которых на каждый токен активны 95 миллиардов, внутри 512 экспертов. Архитектура внимания гибридная: полное внимание лишь на каждом четвёртом слое, остальные работают на быстром линейном. За счёт этого контекст в миллион токенов не превращается в вечное ожидание ответа.
В индексе Artificial Analysis модель набирает 58 баллов, среди открытых моделей выше только Kimi K3. Цена в каталоге 300 ₽ на входе и 900 ₽ на выходе за миллион токенов. Нужна мощная модель с прозрачной архитектурой и без привязки к закрытым экосистемам? Это главный кандидат.
DeepSeek V4 Pro 0813: флагманское качество по старой цене
DeepSeek довела флагман V4 Pro до стабильного релиза. Датированная версия 0813 несёт 1,6 триллиона параметров и миллион токенов контекста, а главный скачок случился в агентном кодинге: на DeepSWE модель выросла с 12,8 до 62,7 балла, на Terminal Bench с 72,1 до 87,9.
Теперь тонкость с ценами. Базовая DeepSeek V4 Pro недавно подорожала до 175,2/350,4 ₽ за миллион токенов, а версия 0813 закреплена по прежней цене: 65,25 ₽ на входе и 130,5 ₽ на выходе. То же качество, почти втрое дешевле. DeepSeek уже предупредила о будущем росте цен, так что датированная версия остаётся способом зафиксировать выгодный тариф.
Qwen3 ASR: распознавание речи за копейки
Две компактные модели распознавания речи от команды Qwen, на 1,7 и 0,6 миллиарда параметров. Понимают 30 языков, включая русский, плюс 22 китайских диалекта, не теряются в шуме и даже распознают пение. Старшая по качеству спорит с сильнейшими коммерческими API.
Тарификация посекундная:
- Qwen3 ASR 1.7B стоит 0,001125 ₽ за секунду, час аудио обойдётся примерно в 4 ₽;
- Qwen3 ASR 0.6B стоит 0,0004995 ₽ за секунду, час выйдет меньше 2 ₽.
Для сравнения: транскрибация часа аудио через Whisper стоит около 54 ₽. Разница в 13-30 раз. Расшифровываете звонки, подкасты или лекции в заметных объёмах? Экономия набегает ощутимая.
Что в итоге
Семь моделей на любой бюджет: флагманы Grok 4.6 и Qwen3.8 для сложных агентных задач, быстрая и недорогая Gemini 3.7 Flash для повседневной работы, DeepSeek V4 Pro 0813 для тех, кто считает деньги, и Qwen3 ASR для массовой расшифровки аудио. Все модели уже доступны в каталоге GPTIK, оплата в рублях с баланса. Заходите и пробуйте.





