Назад к статьям

Claude Opus 5 и свежие Gemini в GPTIK: от флагмана до модели за 45 ₽

Команда GPTIK
Claude Opus 5 и свежие Gemini в GPTIK: от флагмана до модели за 45 ₽

Пополнили каталог сразу четырьмя моделями. Две от Anthropic: Claude Opus 5 и его ускоренный близнец Opus 5 Fast. Две от Google: Gemini 3.6 Flash и Gemini 3.5 Flash Lite. Вышли они почти одновременно, за последнюю неделю июля.

Разброс цен внутри одного анонса получился семнадцатикратный. 45 ₽ за миллион входных токенов у Flash Lite против 750 ₽ у Opus 5. Так что интереснее не сам факт пополнения, а вопрос, какую из четырёх брать под свою задачу.

Картина зеркальная. Claude Opus 5 забирает первое место по индексу интеллекта, но он же самый медленный из четвёрки: около 53 токенов в секунду. Flash Lite ровно наоборот, скромные 36 баллов индекса при 417 токенах в секунду, почти в восемь раз быстрее. Gemini 3.6 Flash сидит посередине по обоим параметрам.

Индекс интеллекта и скорость генерации. По данным сайта artificialanalysis.ai.

Claude Opus 5: самая умная и самая въедливая

По замерам Artificial Analysis модель набирает 61 балл индекса интеллекта и занимает первое место среди 190 моделей. Сама Anthropic описывает релиз как скачок для линейки Opus, заточенный под долгоживущих агентов.

Цифры из официального анонса стоит читать как заявления вендора, но они показательны. На Frontier-Bench v0.1 модель более чем вдвое превосходит прошлое поколение Opus 4.8, причём при меньшей стоимости за задачу. На ARC-AGI 3 результат втрое выше следующей лучшей модели. На OSWorld 2.0, где нейросеть управляет компьютером, она обходит лучший результат Fable 5 примерно за треть стоимости. В органической химии прибавка к Opus 4.8 составила 10,2 пункта, в предсказании функций белков 7,7.

С ценой вышло приятно: в долларах Opus 5 стоит ровно столько же, сколько стоил Opus 4.8. Пять долларов за миллион входных токенов, двадцать пять за миллион выходных. Поколение выросло, ценник остался.

А вот дальше начинается характер, и о нём честнее предупредить сразу. Вместе с релизом Anthropic выложила системную карту, а её подробный разбор вышел на Хабре. Картина оттуда неоднозначная, и дальнейшие наблюдения — как раз из этого разбора.

Opus 5 стала первой моделью Claude, прошедшей тест на «ленивое расследование»: получив противоречивые данные, она не отмахивается от нестыковок, а докапывается до причины. Оборотная сторона той же черты, увы, тоже есть. На высоких уровнях усилий модель работает хуже, чем на средних. В одном эпизоде с задачей по теории вероятностей она поменяла решение тридцать раз подряд. Пилотные пользователи жаловались, что она слишком усердствует и без конца перепроверяет уже проверенное.

Показателен контраст двух задач оттуда же. В моделировании РНК-последовательностей Opus 5 обошла 75-й процентиль среди 57 сильнейших специалистов по ML-биологии в США, а местами превзошла и лучшего человека в выборке. Зато в открытом задании на проектирование белковых связок, где дали бюджет в десять тысяч долларов и сутки времени, до результата не дошла: одна попытка выдала всего семнадцать неранжированных вариантов. Гладко было на бумаге.

Так что это модель для долгой и глубокой работы, где ценится дотошность, а не быстрая реакция. Сложный код, длинные агентные сценарии, разбор запутанных данных. Контекст миллион токенов, ответ до 128 тысяч, есть зрение, работа с файлами и вызов функций. В каталоге лежит как claude-opus-5: 750 ₽ за миллион входных токенов и 3750 ₽ за миллион выходных.

Opus 5 Fast: тот же ум, когда ждать некогда

У флагмана есть слабое место, и это задержка. До первого токена может пройти около семидесяти секунд при медиане в три секунды у сопоставимых моделей. Когда нейросеть думает над задачей полчаса, разница незаметна. Когда отвечает живому человеку в интерфейсе, она решает всё.

Для таких случаев Anthropic и выпустила ускоренный вариант. Внутри та же модель с теми же возможностями, но, по заявлению компании, отвечает она в два с половиной раза быстрее, а стоит ровно вдвое дороже базовой.

Арифметика простая. Берите Fast там, где ожидание обходится дороже разницы в цене: интерактивные интерфейсы, живое общение, задачи с дедлайном. В фоновой обработке и ночных прогонах переплачивать смысла нет, никто же не сидит и не смотрит в экран.

Ищите как claude-opus-5-fast: 1500 ₽ вход, 7500 ₽ выход.

Gemini 3.6 Flash: универсал, который слышит и смотрит

Google выпустила 3.6 Flash как новую рабочую лошадку линейки, на замену 3.5 Flash. Индекс интеллекта 50 баллов, 26-е место из 190, скорость 235 токенов в секунду.

Прибавка к прошлому поколению заметнее всего на агентных задачах. DeepSWE, бенчмарк агентной разработки от Datacurve, показывает 49% против 37% у предшественницы. На MLE-Bench с задачами инженерии машинного обучения 63,9%, на OSWorld-Verified по управлению компьютером 83,0%.

Но любопытнее другая цифра. Новая версия тратит примерно на 17% меньше выходных токенов, чем старая. Не потому что стала молчаливее: она просто доходит до результата за меньшее число шагов рассуждения и вызовов инструментов. В агентных сценариях, где модель наматывает десятки кругов, это прямая экономия на счёте.

И главное её отличие от обоих Claude: Gemini принимает на вход аудио и видео, а не один лишь текст с картинками. Плюс PDF. Ни одна модель Anthropic в нашем каталоге так пока не умеет. Контекст миллион токенов, ответ до 64 тысяч, знания свежие, по март 2026 года против января 2025 у предыдущей версии.

Обращаться можно по gemini-3.6-flash. Цена: 225 ₽ вход и 1125 ₽ выход.

Gemini 3.5 Flash Lite: массовый поток за копейки

Самая дешёвая из четвёрки и при этом самая быстрая в своём классе. Индекс интеллекта 36 баллов, что при медиане 16 у моделей той же ценовой категории выглядит уверенно. По скорости 417 токенов в секунду против медианы 104, то есть примерно вчетверо быстрее соседей по прайсу.

Разрыв с прошлым поколением приличный: Terminal-Bench 2.1 подрос с 31% до 54%, GDM-MRCR v2 на длинном контексте с 60,1% до 72,2%, а GDPval-AA v2 по реальным рабочим задачам с 642 до 1140.

Модель сделана под объём. Агентный поиск, обработка документов пачками, перевод, разбор входящего потока писем. Всё то, где запросов тысячи, каждый несложный, а счёт набегает именно количеством. Аудио, видео и файлы она понимает так же, как старшая 3.6 Flash, контекст такой же миллионный.

Алиас gemini-3.5-flash-lite, 45 ₽ вход и 375 ₽ выход.

Что выбрать под свою задачу

МодельВход, ₽ / 1MВыход, ₽ / 1MКогда брать
Claude Opus 57503750Сложный код, долгие агенты, глубокий разбор
Claude Opus 5 Fast15007500То же, но когда важна скорость ответа
Gemini 3.6 Flash2251125Универсальные задачи, аудио и видео на входе
Gemini 3.5 Flash Lite45375Массовый поток, документы, перевод

Главное правило: не тащите флагман туда, где справится Lite. Семнадцатикратная разница в цене входа заметно бьёт по счёту за месяц, если гонять через Opus 5 обычную рутину вроде разбора почты.

Обратное тоже верно. На по-настоящему сложной задаче дешёвая модель выйдет дороже: потратите десяток попыток и своё время там, где Opus 5 справился бы с первого раза.

Все четыре уже в каталоге. Заходите и пробуйте.

Новые модели в GPTIK: Claude Sonnet 5 и Nano Banana 2 Lite

Новые модели в GPTIK: Claude Sonnet 5 и Nano Banana 2 Lite

1 июля 2026 г. Команда GPTIK

Добавили в каталог две свежие нейросети: мощный Claude Sonnet 5 от Anthropic для кода и агентов и быструю модель генерации картинок Nano Banana 2 Lite от Google. Рассказываем, что умеют и кому пригодятся.

Nano Banana 2 в GPTIK: модель Google для картинок и топ-4 мирового рейтинга

Nano Banana 2 в GPTIK: модель Google для картинок и топ-4 мирового рейтинга

18 июня 2026 г. Команда GPTIK

Добавили в каталог Google Nano Banana 2 (Gemini 3.1 Flash Image) — модель для генерации и редактирования изображений. По независимому рейтингу Artificial Analysis она четвёртая в мире по качеству. Рассказываем, что умеет и кому пригодится.

Kimi K3 в GPTIK: гигантская модель для кода и агентов

Kimi K3 в GPTIK: гигантская модель для кода и агентов

21 июля 2026 г. Команда GPTIK

Добавили в каталог MoonshotAI Kimi K3 — многомодальную модель на 2,8 триллиона параметров с контекстом почти в миллион токенов. Рассказываем, что она умеет и кому пригодится.

Grok STT 1.0 в GPTIK: распознавание речи за 15 рублей в час

Grok STT 1.0 в GPTIK: распознавание речи за 15 рублей в час

27 июля 2026 г. Команда GPTIK

Добавили в каталог Grok STT 1.0 - модель распознавания речи от SpaceXAI, создателей Grok. Точность на уровне лидеров рынка, а час аудио стоит 15 рублей - в три с половиной раза дешевле Whisper. Рассказываем, что она умеет и кому пригодится.

Новые модели в GPTIK: серия GPT-5.6 от OpenAI (Sol, Terra, Luna)

Новые модели в GPTIK: серия GPT-5.6 от OpenAI (Sol, Terra, Luna)

10 июля 2026 г. Команда GPTIK

Добавили в каталог все шесть моделей серии GPT-5.6: флагманский Sol, сбалансированный Terra, экономичный Luna и их Pro-версии. Рассказываем, что они умеют, сколько стоят и кому пригодятся.

Grok 4.5 в GPTIK: новый флагман SpaceXAI для кода и рассуждений

Grok 4.5 в GPTIK: новый флагман SpaceXAI для кода и рассуждений

9 июля 2026 г. Команда GPTIK

Добавили в каталог Grok 4.5, свежую модель SpaceXAI (создатели Grok). Сильна в коде, рассуждениях и STEM, понимает картинки и файлы, контекст на 500K токенов. Рассказываем, что умеет и сколько стоит.