Gemini 3 Flash Preview — это высокоскоростная и ценная модель мышления, предназначенная для агентских рабочих процессов, многократных чатов и помощи в кодировании. Он обеспечивает производительность рассуждений и использования инструментов почти на уровне Pro со значительно меньшей задержкой, чем более крупные варианты Gemini, что делает его хорошо подходящим для интерактивной разработки, длительных циклов агентов и задач совместного кодирования. По сравнению с Gemini 2.5 Flash он обеспечивает значительные улучшения качества рассуждений, мультимодального понимания и надежности. Модель поддерживает контекстное окно токена 1M и мультимодальные входные данные, включая текст, изображения, аудио, видео и PDF-файлы, с текстовым выводом. Он включает в себя настраиваемые рассуждения с помощью уровней мышления (минимальный, низкий, средний, высокий), структурированный вывод, использование инструментов и автоматическое кэширование контекста. Gemini 3 Flash Preview оптимизирован для пользователей, которым нужны убедительные аргументы и агентское поведение без затрат и задержек, присущих полномасштабным передовым моделям.
Провайдеры
Одна и та же модель может быть доступна у разных провайдеров. Маршрутизация выбирает эндпоинт по политике, цене, задержке и доступности.
| Провайдер | Тариф | Задержка P50 | Ток/с P50 |
|---|---|---|---|
| ru_openrouter | Ввод23 ₽/M Вывод136 ₽/M | — | — |
| bothub | Ввод0,04 ₽/M Вывод216 ₽/M | — | — |
Тарифы
Тарифы зависят от модальности: токены (₽/1M), аудио/embedding (часто только ввод), видео и запуски — в отдельных единицах. Текущие тарифы по провайдерам — в таблице выше; ниже — история прайс-листа в разрезе провайдеров (₽/1M токенов, 7 дней). Провайдеры — в подсказке на графике.
Производительность
Пропускная способность — скорость генерации (ток/с, выше лучше). Задержка — полный round-trip (ниже лучше). TTFT — время до первого токена (ниже лучше). Графики разбиты по провайдерам — нажмите expand для деталей.
Бенчмарки
Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.
Результаты по категориям
Арена моделей
Арена агентов
Метрики из арены дизайна
Активность
Объём запросов и токенов к модели за последние 7 дней.
Доступность
Доля успешных ответов за период. Мониторинг эндпоинтов и автоматический fallback при ошибках upstream.
Быстрый старт
Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Mart. Меняется только slug модели: google/gemini-3-flash-preview-20251217.
curl -s "https://llmmart.ru/api/v1/chat/completions" \
-H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/gemini-3-flash-preview-20251217",
"messages": [
{"role": "user", "content": "Привет!"}
]
}'Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.