Новые модели в GPTIK: Qwen3.8 Max и GPT Transcribe

В каталоге две новинки, и задачи у них совсем разные. Qwen3.8 Max, тяжёлый флагман Alibaba для долгих агентных сценариев. GPT Transcribe, свежее распознавание речи от OpenAI: точнее прошлого поколения и при этом дешевле.
Qwen3.8 Max: флагман на 2,4 триллиона параметров
Команда Qwen выкатила модель 3 августа. В июле её показывали как preview на WAIC в Шанхае, теперь она доступна всем.
Под капотом Mixture-of-Experts: 2,4 триллиона параметров всего, около 95 миллиардов активируются на запросе. Контекст миллион токенов, ответ до 131 тысячи. Плюс бюджет рассуждений до 262 тысяч, если задача требует длинной цепочки шагов.
Цена в GPTIK: 300 ₽ за миллион токенов входа, 900 ₽ за миллион выхода. Ступеней нет, от длины запроса цена не растёт.
На вход идёт не только текст. Картинки, видео. Вызов функций тоже есть.
Где она сильна
Главная заявка модели, агентные задачи. На OSWorld-Verified, где модель садится за компьютер и доводит задачу до конца, Qwen3.8 Max набирает 86,1. Claude Fable 5 там же 85,0, GPT-5.6 Sol Max 83,2, Gemini 3.1 Pro 76,2.
Terminal-Bench 2.1: 86,6. А вот DeepSWE, где надо править код прямо в репозитории, показателен: прошлое поколение Qwen набирало 21,6, эта модель 56,6. Больше чем вдвое.
Мультимодальные результаты крепкие: OmniDocBench 1.5 даёт 92,1, VideoMME с субтитрами 90,4, MMMU-Pro 82,3, Parametric CAD Bench 91,5.
По независимому индексу Artificial Analysis у модели 58 баллов, девятое место из 185. На графике видно расклад: по интеллекту она в верхней группе, но стоит правее зелёной зоны выгодных вариантов. Качество высокое, а за задачу платить придётся больше, чем лидерам по соотношению цена/качество.
Соотношение интеллекта и стоимости задачи у актуальных моделей. По данным сайта artificialanalysis.ai.
Честно про минус
Та же Artificial Analysis отмечает вещь, о которой в анонсах обычно молчат: модель очень многословная. На прогоне бенчмарков она выдала 150 миллионов токенов при медиане 66 миллионов по остальным.
Для счёта это важнее, чем кажется. Цена за токен у Qwen3.8 Max умеренная, но токенов она тратит заметно больше, и итог за ту же задачу может выйти выше, чем прикидываешь по прайсу. Гоняете потоком? Посчитайте на своих объёмах, а не на цене за миллион.
Кому пригодится
Агентам, которые ворочают целый репозиторий. Разбору юридических и финансовых документов. Длинному видео и вытаскиванию структурированных данных. Словом, всему, где надо держать в голове гору контекста и не терять нить на десятом шаге.
GPT Transcribe: распознавание речи подешевело
Тут всё проще. GPT Transcribe, новая модель OpenAI для перевода аудио в текст.
Цена в GPTIK: 0,675 ₽ за минуту аудио. У OpenAI это $0,0045 за минуту против $0,006 у прошлой gpt-4o-transcribe, то есть минус четверть к предыдущему поколению.
Точность подтянули ровно там, где старые модели спотыкались чаще всего: речь с акцентом, многоязычное аудио, совсем короткие реплики, имена собственные, числа. Те самые места, из-за которых расшифровку потом приходилось вычитывать руками.
В каталоге уже жили whisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe и grok-stt-1.0. Новинка встаёт в этот ряд и обходит gpt-4o-transcribe сразу по двум статьям, точности и цене. При прочих равных теперь логичнее брать её.
Обе модели уже в каталоге. Оплата в рублях с баланса, отдельных подписок заводить не нужно.





