Назад к статьям

Новые модели в GPTIK: Qwen3.8 Max и GPT Transcribe

Команда GPTIK
Новые модели в GPTIK: Qwen3.8 Max и GPT Transcribe

В каталоге две новинки, и задачи у них совсем разные. Qwen3.8 Max, тяжёлый флагман Alibaba для долгих агентных сценариев. GPT Transcribe, свежее распознавание речи от OpenAI: точнее прошлого поколения и при этом дешевле.

Qwen3.8 Max: флагман на 2,4 триллиона параметров

Команда Qwen выкатила модель 3 августа. В июле её показывали как preview на WAIC в Шанхае, теперь она доступна всем.

Под капотом Mixture-of-Experts: 2,4 триллиона параметров всего, около 95 миллиардов активируются на запросе. Контекст миллион токенов, ответ до 131 тысячи. Плюс бюджет рассуждений до 262 тысяч, если задача требует длинной цепочки шагов.

Цена в GPTIK: 300 ₽ за миллион токенов входа, 900 ₽ за миллион выхода. Ступеней нет, от длины запроса цена не растёт.

На вход идёт не только текст. Картинки, видео. Вызов функций тоже есть.

Где она сильна

Главная заявка модели, агентные задачи. На OSWorld-Verified, где модель садится за компьютер и доводит задачу до конца, Qwen3.8 Max набирает 86,1. Claude Fable 5 там же 85,0, GPT-5.6 Sol Max 83,2, Gemini 3.1 Pro 76,2.

Terminal-Bench 2.1: 86,6. А вот DeepSWE, где надо править код прямо в репозитории, показателен: прошлое поколение Qwen набирало 21,6, эта модель 56,6. Больше чем вдвое.

Мультимодальные результаты крепкие: OmniDocBench 1.5 даёт 92,1, VideoMME с субтитрами 90,4, MMMU-Pro 82,3, Parametric CAD Bench 91,5.

По независимому индексу Artificial Analysis у модели 58 баллов, девятое место из 185. На графике видно расклад: по интеллекту она в верхней группе, но стоит правее зелёной зоны выгодных вариантов. Качество высокое, а за задачу платить придётся больше, чем лидерам по соотношению цена/качество.

Соотношение интеллекта и стоимости задачи у актуальных моделей. По данным сайта artificialanalysis.ai.

Честно про минус

Та же Artificial Analysis отмечает вещь, о которой в анонсах обычно молчат: модель очень многословная. На прогоне бенчмарков она выдала 150 миллионов токенов при медиане 66 миллионов по остальным.

Для счёта это важнее, чем кажется. Цена за токен у Qwen3.8 Max умеренная, но токенов она тратит заметно больше, и итог за ту же задачу может выйти выше, чем прикидываешь по прайсу. Гоняете потоком? Посчитайте на своих объёмах, а не на цене за миллион.

Кому пригодится

Агентам, которые ворочают целый репозиторий. Разбору юридических и финансовых документов. Длинному видео и вытаскиванию структурированных данных. Словом, всему, где надо держать в голове гору контекста и не терять нить на десятом шаге.

GPT Transcribe: распознавание речи подешевело

Тут всё проще. GPT Transcribe, новая модель OpenAI для перевода аудио в текст.

Цена в GPTIK: 0,675 ₽ за минуту аудио. У OpenAI это $0,0045 за минуту против $0,006 у прошлой gpt-4o-transcribe, то есть минус четверть к предыдущему поколению.

Точность подтянули ровно там, где старые модели спотыкались чаще всего: речь с акцентом, многоязычное аудио, совсем короткие реплики, имена собственные, числа. Те самые места, из-за которых расшифровку потом приходилось вычитывать руками.

В каталоге уже жили whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe и grok-stt-1.0. Новинка встаёт в этот ряд и обходит gpt-4o-transcribe сразу по двум статьям, точности и цене. При прочих равных теперь логичнее брать её.

Обе модели уже в каталоге. Оплата в рублях с баланса, отдельных подписок заводить не нужно.

DeepSeek V4 Flash 0731: та же цена, агентные навыки как у флагманов

DeepSeek V4 Flash 0731: та же цена, агентные навыки как у флагманов

31 июля 2026 г. Команда GPTIK

Добавили в каталог новую сборку DeepSeek V4 Flash. Архитектура и цена не изменились, а по агентным бенчмаркам модель обошла собственную старшую версию и почти догнала Claude Opus 4.8. Разбираем, что она умеет и в чём подвох.

Qwen3.7 Flash и пакетный Gemini: две новые модели в каталоге

Qwen3.7 Flash и пакетный Gemini: две новые модели в каталоге

29 июля 2026 г. Команда GPTIK

Добавили Qwen3.7 Flash — дешёвую мультимодальную модель с контекстом в миллион токенов и ступенчатым ценником, и пакетный режим Gemini 3.6 Flash, который считает вдвое дешевле обычного. Разбираем, что они умеют и кому пригодятся.

Grok STT 1.0 в GPTIK: распознавание речи за 15 рублей в час

Grok STT 1.0 в GPTIK: распознавание речи за 15 рублей в час

27 июля 2026 г. Команда GPTIK

Добавили в каталог Grok STT 1.0 - модель распознавания речи от SpaceXAI, создателей Grok. Точность на уровне лидеров рынка, а час аудио стоит 15 рублей - в три с половиной раза дешевле Whisper. Рассказываем, что она умеет и кому пригодится.

Claude Opus 5 и свежие Gemini в GPTIK: от флагмана до модели за 45 ₽

Claude Opus 5 и свежие Gemini в GPTIK: от флагмана до модели за 45 ₽

27 июля 2026 г. Команда GPTIK

Добавили в каталог четыре модели: Claude Opus 5 и его быстрый вариант, Gemini 3.6 Flash и Gemini 3.5 Flash Lite. Разбираем, чем они отличаются, что показывают на бенчмарках и под какие задачи брать каждую.

Kimi K3 в GPTIK: гигантская модель для кода и агентов

Kimi K3 в GPTIK: гигантская модель для кода и агентов

21 июля 2026 г. Команда GPTIK

Добавили в каталог MoonshotAI Kimi K3 — многомодальную модель на 2,8 триллиона параметров с контекстом почти в миллион токенов. Рассказываем, что она умеет и кому пригодится.

Новые модели в GPTIK: серия GPT-5.6 от OpenAI (Sol, Terra, Luna)

Новые модели в GPTIK: серия GPT-5.6 от OpenAI (Sol, Terra, Luna)

10 июля 2026 г. Команда GPTIK

Добавили в каталог все шесть моделей серии GPT-5.6: флагманский Sol, сбалансированный Terra, экономичный Luna и их Pro-версии. Рассказываем, что они умеют, сколько стоят и кому пригодятся.