·4 мин. чтения

Gemini 3.8 Flash в PlusVibe: обзор, цена и сравнение с 3.7 Flash

Обзор Gemini 3.8 Flash в PlusVibe: контекст 1M токенов, цена от 3,78 ₽ за 1M входных токенов, чем отличается от Gemini 3.7 Flash и пример подключения через API.

Gemini 3.8 Flash в PlusVibe: обзор, цена и сравнение с 3.7 Flash

Gemini 3.8 Flash — быстрая модель Google с контекстом 1M токенов

Gemini 3.8 Flash от Google доступна в каталоге PlusVibe через OpenAI-совместимый API. Это быстрая модель с окном в миллион токенов, приёмом изображений на входе и рассуждениями в режиме thinking, включёнными постоянно. Подходит для задач, где важны скорость и объём контекста, а не максимальное качество на сложных задачах — для этого в линейке есть Gemini 3.1 Pro.

Что изменилось относительно Gemini 3.7 Flash

Gemini 3.8 Flash — следующая версия внутри той же ветки семейства. По заявленным в каталоге характеристикам она не отличается от 3.7 Flash: то же окно контекста 1 000 000 токенов, тот же лимит ответа 65 000 токенов, та же поддержка изображений на входе, тот же единственный режим рассуждений thinking без возможности его отключить, тот же срез знаний — апрель 2025 года.

Единственное измеримое отличие — цена: вариант по умолчанию у 3.8 Flash дешевле 3.7 Flash примерно на 14% и по входным, и по выходным токенам. Сопоставимых бенчмарков качества в каталоге нет, поэтому мы не утверждаем, что 3.8 лучше 3.7 по качеству ответов — если это критично для вашей задачи, сравните обе версии на своих примерах.

Характеристики Gemini 3.8 Flash

ПараметрЗначение Контекст1 000 000 токенов Максимальный вывод65 000 токенов РассужденияДа, режим thinking, отключить нельзя Tool calling / function callingПоддерживается JSON modeНе заявлен ВводТекст, изображения ВыводТолько текст Срез знаний в каталогеАпрель 2025

Окно в миллион токенов и приём изображений делают модель удобной для больших документов, скриншотов и сканов, длинной истории диалога или агентных сценариев с накопленным контекстом. Изображения модель только принимает — сгенерировать картинку ей нельзя.

Цена и пример расчёта

Цена варианта по умолчанию google/gemini-3.8-flash составляет 3,78 ₽ за 1M входных токенов и 18,86 ₽ за 1M выходных токенов. Кэш входных токенов стоит 0,38 ₽ за 1M (в 10 раз дешевле обычного входа), запись в кэш — 4 ₽ за 1M.

Например, запрос с 1M новых входных токенов и 200 000 выходных токенов будет стоить: 1 × 3,78 ₽ + 0,2 × 18,86 ₽ = 7,55 ₽. Это ориентир для конкретного объёма токенов: у Gemini рассуждения биллятся как выходные токены, поэтому даже простой запрос с включённым thinking может выйти дороже, чем кажется по длине видимого ответа.

В каталоге также доступны варианты с суффиксами: google/gemini-3.8-flash:ag2 — 9,43 / 47,15 ₽, google/gemini-3.8-flash:network — 4,72 / 23,58 ₽, google/gemini-3.8-flash:network2 — 9,90 / 49,50 ₽ за 1M входа и выхода. Не-дефолтные варианты стоят до 2,6 раза дороже — переключайтесь на них только при отказе основного маршрута, не по умолчанию.

Цены актуальны на 10 сентября 2026 года и могут измениться — текущие значения смотрите в каталоге моделей или в эндпоинте /v1/models.

Как вызвать модель

Используйте обычный endpoint Chat Completions. В поле model передаётся публичный ID google/gemini-3.8-flash:

curl https://plusvibeapi.ru/v1/chat/completions \
  -H "Authorization: Bearer sk-pv-ВАШ_КЛЮЧ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemini-3.8-flash",
    "messages": [{"role": "user", "content": "Опиши, что происходит на этом скриншоте."}],
    "max_tokens": 2000
  }'

Тот же вызов через Python SDK:

from openai import OpenAI

client = OpenAI(
    api_key="sk-pv-ВАШ_КЛЮЧ",
    base_url="https://plusvibeapi.ru/v1",
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Составь краткое резюме этого документа."}],
    max_tokens=2000,
)
print(response.choices[0].message.content)

Для каких задач подходит

  • Обработка больших объёмов текста и изображений. Миллион токенов контекста и приём картинок хватает на документы, скриншоты и сканы без предварительного дробления.
  • Потоковые и массовые сценарии. По нашим собственным измерениям трафика вариант Ag держит пропускную способность около 1500 токенов в секунду при доступности около 99% — это заметно быстрее, чем у более тяжёлой Gemini 3.1 Pro в том же трафике (около 750 токенов в секунду).
  • Агентные пайплайны с инструментами. Tool calling поддерживается, thinking помогает модели последовательно выбирать шаги.
  • Классификация и извлечение данных из смешанного текста и изображений.

Ограничения

Рассуждения нельзя отключить: в отличие от Gemini 3.1 Pro и 3.5 Flash, у которых в каталоге есть режим «без рассуждений», 3.7 и 3.8 Flash всегда думают в режиме thinking, и эти токены оплачиваются как выходные. Для очень простых и дешёвых запросов, где thinking не нужен, это может оказаться дороже, чем ожидается по факту — в таком случае разумнее протестировать 3.5 Flash.

JSON mode в каталоге не заявлен: для строгого машинного формата ответа нужно проверять и парсить вывод на стороне приложения, а не полагаться на встроенный режим. Модель принимает изображения, но не генерирует их — для генерации картинок нужна отдельная модель. Срез знаний — апрель 2025 года, тот же, что у 3.7 Flash: версия не стала «свежее» по знаниям, свежие факты передавайте в контексте или через инструмент.

Как и у любой reasoning-модели, thinking не гарантирует правильный ответ — он снижает вероятность грубых ошибок на многошаговых задачах, но не исключает их. Не пропускайте результат дальше по цепочке без проверки, особенно в агентных сценариях с вызовом инструментов.

Как начать тестирование

Возьмите набор реальных запросов вашего сценария: один длинный документ, один запрос с изображением и один агентный сценарий с инструментом. Сравните с Gemini 3.7 Flash на тех же данных — учитывая близкие характеристики, разница в качестве может оказаться небольшой, а разница в цене (около 14% в пользу 3.8 Flash) — стабильной. Отдельно замерьте, во сколько токенов рассуждений обходятся ваши типовые запросы, прежде чем оценивать реальную стоимость на объёме.

Gemini 3.8 Flash уже доступна в PlusVibe. Начните с варианта по умолчанию google/gemini-3.8-flash и сравните расход с Gemini 3.7 Flash на своих данных.

Gemini 3.8 FlashGoogle Gemini APIGemini API Россиябольшой контекстPlusVibe моделицена Gemini 3.8 Flashreasoning модель

Попробуйте PlusVibe API

OpenAI-совместимый API: GPT, Claude, Gemini, видео и изображения — один рублёвый ключ. Работает из России без VPN, оплата рублями.

Читайте также

Gemini 3.8 Flash в PlusVibe: обзор, цена и сравнение с 3.7 Flash | PlusVibe API