Google: Gemini 3 Flash Preview

google/gemini-3-flash-preview-20251217

Модальности

Цена ввод / вывод

— / —за 1M токенов

Контекст1.0M

Релиз17 дек. 2025 г.

Провайдеры

Одна и та же модель может быть доступна у разных провайдеров. Маршрутизация выбирает эндпоинт по политике, цене, задержке и доступности.

Нет активных эндпоинтов для этой модели.

Производительность

Пропускная способность — скорость генерации (ток/с, выше лучше). Задержка — полный round-trip (ниже лучше). TTFT — время до первого токена (ниже лучше). Графики разбиты по провайдерам — нажмите expand для деталей.

Пропускная способность—лучший провайдер

Задержка—P50, лучший провайдер

Регион

Период

Пропускная способность

Выше — лучше

Загрузка…

Задержка

Ниже — лучше

Загрузка…

E2E задержка

Ниже — лучше

Загрузка…

TTFT

Ниже — лучше

Загрузка…

Ошибки tool call

Ниже — лучше

Загрузка…

Ошибки structured output

Ниже — лучше

Загрузка…

Тарифы

Базовая цена за миллион токенов. Эффективная цена учитывает prompt caching: повторяющийся контекст тарифицируется по ставке cache_read.

Ввод (list)—за 1M токенов

Вывод—за 1M токенов

Эффективная цена ввода

Фактическая стоимость prompt + cache_read на миллион токенов.

Ниже — лучше

Загрузка…

Cache read токены

Доля контекста, прочитанного из кэша провайдера.

Загрузка…

Бенчмарки

Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.

Arena	Категория	Elo	Win rate	Ранг
agents	Godotgamedev	1218	52.3%	#8
agents	Agenticslides	1073	39.3%	#9
agents	Agenticslides(Python-Pptx)	1075	39.3%	#9
agents	Fullstack	1130	47.1%	#17
agents	Mobileapps	1187	49.8%	#17
agents	Webapps	1184	49.5%	#17
agents	Androidnative	1062	47.9%	#24
models	3d	1263	62.7%	#28
models	Codecategories	1240	57.6%	#33
models	Website	1240	57.0%	#33
models	Gamedev	1233	58.3%	#38

Активность

Объём запросов и токенов к модели за последние 7 дней.

Запросы

Число обращений к модели.

Загрузка…

Токены

Prompt и completion суммарно.

—

Загрузка…

Доступность

Доля успешных ответов за период. Мониторинг эндпоинтов и автоматический fallback при ошибках upstream.

Успешные запросы

Процент ответов без ошибки.

Выше — лучше

Загрузка…

Быстрый старт

Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Router. Меняется только slug модели: google/gemini-3-flash-preview-20251217.

curl -s "https://llmmart.ru/api/v1/v1/chat/completions" \
  -H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemini-3-flash-preview-20251217",
    "messages": [
      {"role": "user", "content": "Привет!"}
    ]
  }'

Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.

Ещё модели от Google

Все модели (36)

Google: Gemini 3 Flash Preview

Провайдеры

Производительность

Пропускная способность

Задержка

E2E задержка

TTFT

Ошибки tool call

Ошибки structured output

Тарифы

Эффективная цена ввода

Cache read токены

Бенчмарки

Активность

Запросы

Токены

Доступность

Успешные запросы

Быстрый старт

Ещё модели от Google

Google: Nano Banana 2 (Gemini 3.1 Flash Image)

Google: Nano Banana Pro (Gemini 3 Pro Image)

Google: Gemini Embedding 2

Google: Gemini 3.5 Flash

Google: Gemini 3.1 Flash Lite

Google: Chirp 3

Google: Gemini 3.1 Flash TTS Preview

Google: Veo 3.1 Fast

Google: Veo 3.1 Lite

Google: Gemini Embedding 2 Preview

Google: Gemma 4 26B A4B

Google: Gemma 4 26B A4B (free)