Назад к статьям

Qwen3.7 Flash и пакетный Gemini: две новые модели в каталоге

Команда GPTIK
Qwen3.7 Flash и пакетный Gemini: две новые модели в каталоге

Обновили каталог: добавили две модели. Обе вышли на этой неделе и настолько разные, что в один пост попали только по дате.

Qwen3.7 Flash: дёшево смотреть и понимать

Alibaba выкатила Qwen3.7 Flash 27 июля, модели буквально два дня от роду. Это младший и самый быстрый тир семейства Qwen3.7, которое команда Qwen показала ещё в мае на саммите в Ханчжоу вместе с собственным AI-ускорителем.

Flash умеет смотреть. Не в переносном смысле: она берёт картинки и видео и рассуждает о том, что на них происходит. Разработчик напирает на три вещи: распознавание объектов, пространственное понимание (что где лежит относительно чего) и работу с реальными сценами, а не с вылизанными тестовыми картинками. Отдельно заявлены мультимодальные агенты: посмотреть на экран, понять, что там, нажать куда надо.

Внутри гибридный режим рассуждений. Хочет, расписывает цепочку размышлений; хочет, отвечает сразу, без раскачки.

Контекст миллион токенов, до 65 536 токенов на ответ. Миллион, если совсем грубо, это целая книга с иллюстрациями за один запрос.

Ценник ступенчатый, и это важно. На коротких запросах, до 32 тысяч токенов на входе, миллион входных стоит 4,5 ₽, миллион выходных — 19,5 ₽. Дёшево до неприличия. Дальше цена растёт: с 32 тысяч это уже 15 ₽ и 60 ₽, с 256 тысяч — 30 ₽ и 120 ₽. Считается по всему запросу целиком, включая ответ, а не только по той части промпта, что вылезла за порог.

То есть миллионный контекст доступен, но по верхней ставке. Держите это в голове, когда прикидываете бюджет: закинуть книгу целиком выйдет вшестеро дороже, чем можно решить по первой цифре. Впрочем, даже 30 ₽ за миллион для мультимодальной модели — всё ещё дёшево.

Про бенчмарки скажем честно: их нет. Модель вышла позавчера, независимые замеры ещё не опубликованы, агрегаторы показывают ноль результатов. Так что верить пока приходится Alibaba на слово и собственным глазам. Alibaba обещает, что относительно прошлого поколения, 3.6 Flash, подтянули мультимодальное понимание и агентные сценарии.

Забирать её стоит туда, где картинок много, а бюджет конечный: разбор скриншотов и фотографий, вытаскивание данных из изображений, обработка больших пачек, визуальные агенты.

Gemini 3.6 Flash в пакетном режиме: вдвое дешевле, если готовы подождать

Здесь новость про режим, а не про саму модель. Gemini 3.6 Flash появилась в каталоге 21 июля; Google зовёт её рабочей лошадкой семейства и преемницей 3.5 Flash.

Что показывает Google в сравнении с прошлым поколением (Google DeepMind):

  • SWE-Bench Pro (реальные задачи по коду): 58,7% против 55,1%
  • OSWorld-Verified (работа за компьютером): 83,0% против 78,4%
  • DeepSWE v1.1 (агентное программирование): 49% против 37%

Третья строчка и есть главное. Плюс двенадцать пунктов за одно поколение, это много. Google отдельно отмечает, что модель проходит сложные сценарии за меньшее число шагов и меньшее число вызовов инструментов, точнее правит код и реже лезет в файлы, которые её не просили трогать. Последнее особенно приятно всем, кто хоть раз ловил агента за самодеятельностью.

Пакетный режим устроен просто. Задачи отправляются не по одной с мгновенным ответом, а пачкой, результат приходит в течение суток, обычно сильно быстрее. За готовность подождать Google даёт скидку 50% на вход и выход, причём постоянную, не акционную.

В цифрах: обычная Gemini 3.6 Flash стоит 225 ₽ / 1125 ₽ за миллион токенов, пакетная 112,5 ₽ / 562,5 ₽. Ровно половина. Модель та же, качество то же, меняется только время ожидания.

Всё, где ответ не горит, теперь считается вдвое дешевле. Ночные очереди, извлечение данных из архива документов, классификация больших выборок, разбор переписки, отчёты по расписанию, разметка датасета.

Одна деталь напоследок. Пакетный режим отзывается на полное имя google/gemini-3.6-flash:batch. Короткое gemini-3.6-flash по-прежнему ведёт в обычный, мгновенный режим: мы намеренно оставили как было, чтобы ничей работающий код внезапно не начал отвечать с задержкой.

Коротко

Много картинок и мало денег, берите Qwen3.7 Flash. Много задач и нет спешки, берите пакетную Gemini. Обе уже в каталоге, оплата в рублях с баланса.

Claude Opus 5 и свежие Gemini в GPTIK: от флагмана до модели за 45 ₽

Claude Opus 5 и свежие Gemini в GPTIK: от флагмана до модели за 45 ₽

27 июля 2026 г. Команда GPTIK

Добавили в каталог четыре модели: Claude Opus 5 и его быстрый вариант, Gemini 3.6 Flash и Gemini 3.5 Flash Lite. Разбираем, чем они отличаются, что показывают на бенчмарках и под какие задачи брать каждую.

Новые модели в GPTIK: Claude Sonnet 5 и Nano Banana 2 Lite

Новые модели в GPTIK: Claude Sonnet 5 и Nano Banana 2 Lite

1 июля 2026 г. Команда GPTIK

Добавили в каталог две свежие нейросети: мощный Claude Sonnet 5 от Anthropic для кода и агентов и быструю модель генерации картинок Nano Banana 2 Lite от Google. Рассказываем, что умеют и кому пригодятся.

Nano Banana 2 в GPTIK: модель Google для картинок и топ-4 мирового рейтинга

Nano Banana 2 в GPTIK: модель Google для картинок и топ-4 мирового рейтинга

18 июня 2026 г. Команда GPTIK

Добавили в каталог Google Nano Banana 2 (Gemini 3.1 Flash Image) — модель для генерации и редактирования изображений. По независимому рейтингу Artificial Analysis она четвёртая в мире по качеству. Рассказываем, что умеет и кому пригодится.

Grok STT 1.0 в GPTIK: распознавание речи за 15 рублей в час

Grok STT 1.0 в GPTIK: распознавание речи за 15 рублей в час

27 июля 2026 г. Команда GPTIK

Добавили в каталог Grok STT 1.0 - модель распознавания речи от SpaceXAI, создателей Grok. Точность на уровне лидеров рынка, а час аудио стоит 15 рублей - в три с половиной раза дешевле Whisper. Рассказываем, что она умеет и кому пригодится.

Снизили цены: шесть моделей Qwen, Kimi и GLM подешевели, одна вдвое

Снизили цены: шесть моделей Qwen, Kimi и GLM подешевели, одна вдвое

27 июля 2026 г. Команда GPTIK

Обновили каталог, у шести моделей упали цены. Сильнее всех подешевел Qwen3 30B A3B Instruct: вход стал дешевле на 52%. Показываем, что и на сколько изменилось.

Kimi K3 в GPTIK: гигантская модель для кода и агентов

Kimi K3 в GPTIK: гигантская модель для кода и агентов

21 июля 2026 г. Команда GPTIK

Добавили в каталог MoonshotAI Kimi K3 — многомодальную модель на 2,8 триллиона параметров с контекстом почти в миллион токенов. Рассказываем, что она умеет и кому пригодится.