Назад к статьям

Семь новых моделей в GPTIK: Grok 4.6, Gemini 3.7 Flash, гигант Qwen3.8 и дешёвое распознавание речи

Команда GPTIK
Семь новых моделей в GPTIK: Grok 4.6, Gemini 3.7 Flash, гигант Qwen3.8 и дешёвое распознавание речи

Обновили каталог: сразу семь новинок, от флагманского Grok 4.6 до крошечных моделей распознавания речи, которые стоят копейки в прямом смысле слова. Три из них уже вошли в мировой топ по индексу качества Artificial Analysis. Рассказываем, что появилось и кому пригодится.

На графике свежий срез индекса качества: Grok 4.6 набирает 61 балл и стоит вровень с GPT-5.6 Sol, Gemini 3.7 Flash с 56 баллами обгоняет модели классом выше, а DeepSeek V4 Pro 0813 держит 53 балла при цене в разы ниже конкурентов.

По данным сайта artificialanalysis.ai.

Grok 4.6: флагман SpaceXAI для долгих агентных задач

SpaceXAI выпустила Grok 4.6 всего через 35 дней после версии 4.5, и это не косметика. База осталась та же, но модель прошла длинный дополнительный цикл обучения с упором на агентные сценарии. Результат: 61 балл в индексе Artificial Analysis против 56 у предшественницы, 65,9% на DeepSWE 1.1 и 69,9% на CursorBench. Любопытный эффект, который отмечают сами разработчики: на длинных цепочках задач модель начала перепроверять свою работу, прежде чем двигаться дальше.

Контекст 500 тысяч токенов, есть vision и вызов функций. Цена ступенчатая, и тут легко просчитаться:

  • промпт до 200 тысяч токенов: 300 ₽ за миллион токенов на входе, 900 ₽ на выходе;
  • промпт длиннее 200 тысяч токенов: 600 ₽ и 1800 ₽ соответственно, чтение кеша 150 ₽ за миллион.

Ступень применяется ко всему запросу целиком, включая ответ, а не только к токенам сверх порога. Гоняете длинные документы? Закладывайте в расчёты вторую ступень.

Gemini 3.7 Flash: рабочая лошадка Google, которая подешевела на старте

Google выпустила Gemini 3.7 Flash через три недели после 3.6 и называет её своей самой умной «рабочей лошадкой» для кодинга и агентов. Прогресс заметный. На бенчмарке агентного программирования DeepSWE модель выросла с 49,0% до 65,3%, на FrontierCode с 34,4% до 43,6%. При 56 баллах в общем индексе она обходит немало моделей потяжелее, взгляните на график выше.

Модель понимает текст, картинки, аудио, видео и файлы. Контекст миллион токенов. Цена 56,25 ₽ за миллион токенов на входе и 281,25 ₽ на выходе: Google запустила новинку по промо-тарифу, так что сейчас 3.7 Flash стоит дешевле, чем 3.6 Flash на старте.

Есть и batch-вариант вдвое дешевле: 28,125 ₽ и 140,625 ₽. Подходит там, где мгновенный ответ не нужен: пакетная обработка документов, ночные пайплайны, массовая классификация.

Qwen3.8 2.4T: открытый гигант от Alibaba

Alibaba впервые выложила в открытые веса модель класса Qwen-Max: 2,4 триллиона параметров, из которых на каждый токен активны 95 миллиардов, внутри 512 экспертов. Архитектура внимания гибридная: полное внимание лишь на каждом четвёртом слое, остальные работают на быстром линейном. За счёт этого контекст в миллион токенов не превращается в вечное ожидание ответа.

В индексе Artificial Analysis модель набирает 58 баллов, среди открытых моделей выше только Kimi K3. Цена в каталоге 300 ₽ на входе и 900 ₽ на выходе за миллион токенов. Нужна мощная модель с прозрачной архитектурой и без привязки к закрытым экосистемам? Это главный кандидат.

DeepSeek V4 Pro 0813: флагманское качество по старой цене

DeepSeek довела флагман V4 Pro до стабильного релиза. Датированная версия 0813 несёт 1,6 триллиона параметров и миллион токенов контекста, а главный скачок случился в агентном кодинге: на DeepSWE модель выросла с 12,8 до 62,7 балла, на Terminal Bench с 72,1 до 87,9.

Теперь тонкость с ценами. Базовая DeepSeek V4 Pro недавно подорожала до 175,2/350,4 ₽ за миллион токенов, а версия 0813 закреплена по прежней цене: 65,25 ₽ на входе и 130,5 ₽ на выходе. То же качество, почти втрое дешевле. DeepSeek уже предупредила о будущем росте цен, так что датированная версия остаётся способом зафиксировать выгодный тариф.

Qwen3 ASR: распознавание речи за копейки

Две компактные модели распознавания речи от команды Qwen, на 1,7 и 0,6 миллиарда параметров. Понимают 30 языков, включая русский, плюс 22 китайских диалекта, не теряются в шуме и даже распознают пение. Старшая по качеству спорит с сильнейшими коммерческими API.

Тарификация посекундная:

  • Qwen3 ASR 1.7B стоит 0,001125 ₽ за секунду, час аудио обойдётся примерно в 4 ₽;
  • Qwen3 ASR 0.6B стоит 0,0004995 ₽ за секунду, час выйдет меньше 2 ₽.

Для сравнения: транскрибация часа аудио через Whisper стоит около 54 ₽. Разница в 13-30 раз. Расшифровываете звонки, подкасты или лекции в заметных объёмах? Экономия набегает ощутимая.

Что в итоге

Семь моделей на любой бюджет: флагманы Grok 4.6 и Qwen3.8 для сложных агентных задач, быстрая и недорогая Gemini 3.7 Flash для повседневной работы, DeepSeek V4 Pro 0813 для тех, кто считает деньги, и Qwen3 ASR для массовой расшифровки аудио. Все модели уже доступны в каталоге GPTIK, оплата в рублях с баланса. Заходите и пробуйте.

Новые модели в GPTIK: Grok 4.6, Qwen3.8 и дешёвая расшифровка аудио

Новые модели в GPTIK: Grok 4.6, Qwen3.8 и дешёвая расшифровка аудио

13 августа 2026 г. Команда GPTIK

Добавили в каталог пять моделей: флагман SpaceXAI для долгих агентных прогонов, открытый Qwen3.8 на 2,4 триллиона параметров, вышедший из preview DeepSeek V4 Pro и две модели распознавания речи, которые дешевле Whisper в 13 и 30 раз.

Новые модели в GPTIK: Qwen3.8 Max и GPT Transcribe

Новые модели в GPTIK: Qwen3.8 Max и GPT Transcribe

9 августа 2026 г. Команда GPTIK

Добавили в каталог флагман Alibaba на 2,4 триллиона параметров с контекстом в миллион токенов и новое распознавание речи от OpenAI, которое стало точнее и дешевле прошлого поколения. Разбираем, что они умеют и где реально пригодятся.

Qwen3.7 Flash и пакетный Gemini: две новые модели в каталоге

Qwen3.7 Flash и пакетный Gemini: две новые модели в каталоге

29 июля 2026 г. Команда GPTIK

Добавили Qwen3.7 Flash — дешёвую мультимодальную модель с контекстом в миллион токенов и ступенчатым ценником, и пакетный режим Gemini 3.6 Flash, который считает вдвое дешевле обычного. Разбираем, что они умеют и кому пригодятся.

Grok STT 1.0 в GPTIK: распознавание речи за 15 рублей в час

Grok STT 1.0 в GPTIK: распознавание речи за 15 рублей в час

27 июля 2026 г. Команда GPTIK

Добавили в каталог Grok STT 1.0 - модель распознавания речи от SpaceXAI, создателей Grok. Точность на уровне лидеров рынка, а час аудио стоит 15 рублей - в три с половиной раза дешевле Whisper. Рассказываем, что она умеет и кому пригодится.

Снизили цены: Gemini 3.6 Flash подешевела вдвое

Снизили цены: Gemini 3.6 Flash подешевела вдвое

14 августа 2026 г. Команда GPTIK

Скидки в каталоге GPTIK: Gemini 3.6 Flash и её batch-вариант теперь стоят вдвое дешевле, Qwen3 VL 30B подешевела на 13% и вдобавок получила вдвое больший лимит ответа.

DeepSeek V4 Flash 0731: та же цена, агентные навыки как у флагманов

DeepSeek V4 Flash 0731: та же цена, агентные навыки как у флагманов

31 июля 2026 г. Команда GPTIK

Добавили в каталог новую сборку DeepSeek V4 Flash. Архитектура и цена не изменились, а по агентным бенчмаркам модель обошла собственную старшую версию и почти догнала Claude Opus 4.8. Разбираем, что она умеет и в чём подвох.