Снизили цены: Gemini 3.6 Flash подешевела вдвое

Хорошие новости для тех, кто считает расходы на нейросети: снизили цены сразу на три модели. Главная скидка досталась Gemini 3.6 Flash, она подешевела ровно вдвое.
Что почём теперь (цены за миллион токенов, вход / выход):
- Gemini 3.6 Flash: было 225 / 1125 ₽, стало 112,5 / 562,5 ₽. Минус 50%.
- Gemini 3.6 Flash (batch): было 112,5 / 562,5 ₽, стало 56,25 / 281,25 ₽. Тоже минус 50%.
- Qwen3 VL 30B: было 22,5 / 90 ₽, стало 19,5 / 78 ₽. Минус 13%.
С Gemini 3.6 Flash история простая: Google выпустила следующее поколение, и предыдущее подешевело. При этом модель никуда не делась и хуже не стала: тот же миллион токенов контекста, та же мультимодальность с картинками, аудио и видео. Если она уже стоит в ваших пайплайнах, расходы просто упали вдвое, ничего перенастраивать не нужно.
Batch-вариант при своих 56,25 ₽ за вход становится одним из самых дешёвых способов прогнать большой объём документов через сильную модель. Мгновенного ответа он не обещает, зато для ночной обработки очередей это то, что надо.
У Qwen3 VL 30B скидка скромнее, зато с бонусом: лимит ответа вырос вдвое, с 16 до 32 тысяч токенов. Для vision-задач вроде разбора сканов и скриншотов модель и раньше была одной из самых доступных, а теперь стала ещё выгоднее.
Новые цены уже действуют, ничего включать не нужно. Заходите и пользуйтесь.





