Компания Google выпустила минорные обновления своих языковых моделей — Gemini 3.6 Flash и Gemini 3.5 Flash Lite, скорректировав тарифную сетку и оптимизировав алгоритмы потребления токенов.
Модель Gemini 3.6 Flash получила оптимизацию внутренней архитектуры, благодаря чему теперь расходует чуть меньше токенов при обработке запросов. Стоимость миллиона выходных токенов (output tokens) снизилась с $9 до $7,5. Несмотря на снижение цены, разработчики отмечают, что тарифы на модель остаются относительно высокими для сегмента быстрых решений.
Для облегченной версии Gemini 3.5 Flash Lite обновление принесло существенные изменения в стоимости использования:
- Стоимость миллиона выходных токенов увеличилась с $1,5 до $2,5.
- Входные токены (input tokens) теперь тарифицируются по единой ставке $0,3 за миллион для всех типов данных (ранее стоимость составляла $0,5 за аудио и $0,25 за текст и другие форматы).
Хотя разработчики заявляют об улучшении качества ответов и росте производительности нейросети, по данным аналитической платформы Artificial Analysis, средняя стоимость выполнения одной стандартной задачи (task) для Gemini 3.5 Flash Lite выросла более чем в два раза — с $0,04 до $0,09.
На фоне точечной оптимизации моделей линейки Flash, ожидаемое крупное обновление флагманской версии Gemini 3.5 Pro пока остается без официальных анонсов со стороны Google.




Пока нет комментариев. Будьте первым!