Почему Gemini API недоступен из России
Google публикует официальный список регионов, где доступны Gemini API и Google AI Studio. России в этом списке нет: из соседних стран в него входят Казахстан, Узбекистан, Армения, Грузия — Российская Федерация отсутствует.
На практике это означает три блокировки на пути разработчика:
- Регистрация и ключи. Получить API-ключ в Google AI Studio (aistudio.google.com) с российским IP нельзя — сервис отвечает, что регион не поддерживается. Бесплатный тариф (free tier) действует только в тех же поддерживаемых регионах, поэтому «попробовать бесплатно» из России тоже не получается.
- Запросы. Региональные ограничения применяются к самому сервису: даже ключ, созданный через зарубежный аккаунт, при вызовах с российских IP рискует отклоняться.
- Оплата. Платный тариф Gemini API требует способ оплаты, который принимает Google. Российские банковские карты — включая «Мир» — для этого не подходят: платить в долларах или евро российской картой невозможно.
Обход через VPN проблему не решает: аккаунт могут заблокировать за нестандартное поведение, оплата российской картой всё равно не пройдёт, а стабильность VPN из России не гарантирована. Для команды или продукта в продакшене такой «доступ» — не вариант.
Какие модели Gemini доступны через PlusVibe
Рабочий путь для разработчика из России — российский API-агрегатор, который держит доступ к моделям Google на своей инфраструктуре и проксирует запросы. PlusVibe API отдаёт Gemini через единый OpenAI-совместимый эндпоинт с оплатой в рублях.
В живом каталоге на 28 августа 2026 года три модели Gemini:
- Gemini 3.1 Pro — флагман линейки. Контекст 1 000 000 токенов, до 65 000 токенов на ответ, принимает изображения, поддерживает режим рассуждения (thinking) и обычный режим без него. Хорош для сложного анализа больших документов и мультимодальных задач.
- Gemini 3.5 Flash — быстрая модель для потоковых задач: тот же контекст в 1 000 000 токенов и лимит ответа 65 000 токенов, изображения, режим рассуждения. Самая дешёвая модель линейки в нашем каталоге.
- Gemini 3.1 Flash Lite — облегчённая версия: контекст 1 000 000 токенов, ответ до 32 000 токенов, изображения принимаются, но режима рассуждения нет. Подходит для массовой классификации, извлечения данных и других высоконагруженных задач без сложного мышления.
Все три модели поддерживают вызов инструментов (function calling), JSON-режим для структурированных ответов и кэширование промптов. База знаний: у Gemini 3.1 Pro и 3.1 Flash Lite — апрель 2025 года, у Gemini 3.5 Flash — январь 2025 года; для фактов свежее этих дат просите модель опираться на ваш контекст или подключайте поиск инструментов. Актуальный список и цены всегда видны на странице plusvibeapi.ru/models и в эндпоинте /v1/models.
Как вызывать Gemini через PlusVibe
Интерфейс полностью совместим с OpenAI: тот же формат запросов и ответов, меняется только адрес эндпоинта и ключ. Базовый адрес — https://plusvibeapi.ru/v1, авторизация — заголовок Authorization: Bearer <ключ>. Ключ создаётся в личном кабинете и начинается с sk-pv-.
curl
curl https://plusvibeapi.ru/v1/chat/completions \
-H "Authorization: Bearer sk-pv-ВАШ_КЛЮЧ" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash",
"messages": [
{"role": "user", "content": "Кратко объясни, что такое RAG."}
],
"max_tokens": 512
}'
Python (openai SDK)
from openai import OpenAI
client = OpenAI(
base_url="https://plusvibeapi.ru/v1",
api_key="sk-pv-ВАШ_КЛЮЧ",
)
resp = client.chat.completions.create(
model="gemini-3.1-pro",
messages=[
{"role": "system", "content": "Ты опытный аналитик данных."},
{"role": "user", "content": "Составь план анализа клиентских обращений за квартал."},
],
max_tokens=1024,
)
print(resp.choices[0].message.content)
Идентификаторы моделей в запросе — gemini-3.1-pro, gemini-3.5-flash, gemini-3.1-flash-lite: ровно те, что возвращает /v1/models. Если в вашем коде уже используется OpenAI SDK, миграция сводится к замене base_url и ключа — структуры запросов и ответов остаются прежними.
Цены и расчёт стоимости (на 28 августа 2026 года)
Цены — из живого каталога plusvibeapi.ru/api/catalog, в рублях за 1 000 000 токенов, по варианту, который отдаётся по умолчанию:
| Модель | Вход, ₽/1M | Выход, ₽/1M | Кэш, ₽/1M | Контекст | Макс. ответ | Изображения |
|---|---|---|---|---|---|---|
gemini-3.5-flash | 8,52 | 51,10 | 0,85 | 1 000 000 | 65 000 | да |
gemini-3.1-pro | 11,32 | 67,96 | 1 | 1 000 000 | 65 000 | да |
gemini-3.1-flash-lite | 12 | 72 | 1 | 1 000 000 | 32 000 | да |
Обратите внимание: по текущему прайсу Gemini 3.5 Flash дешевле, чем 3.1 Flash Lite. Ориентируйтесь на фактические цены каталога, а не на слово «Lite» в названии.
Пример расчёта. Чат-бот поддержки с RAG пропускает 50 млн входных и 10 млн выходных токенов в месяц (в расчёте использованы точные цены каталога — если перемножать округлённые значения из таблицы, итог может отличаться на единицы рублей):
- Gemini 3.5 Flash: 50 × 8,52 + 10 × 51,10 = 426 + 511 = 937 ₽ в месяц.
- Gemini 3.1 Pro: 50 × 11,32 + 10 × 67,96 ≈ 566 + 680 = около 1 246 ₽ в месяц.
- Gemini 3.1 Flash Lite: 50 × 12 + 10 × 72 = 600 + 720 = 1 320 ₽ в месяц.
Кэширование промптов. Токены входного промпта, которые повторяются между запросами (длинный системный промпт, общая база знаний), тарифицируются по кэш-ставке. Для Gemini 3.5 Flash это 0,85 ₽ за 1M вместо 8,52 ₽ — в 10 раз дешевле. На задачах с большим повторяющимся контекстом это ощутимая часть экономии.
Vision: как отправить изображение
Мультимодальность — одна из главных причин, по которой разработчики выбирают Gemini. Все три модели в нашем каталоге принимают изображения на вход: формат стандартный для OpenAI-совместимых API — часть сообщения с типом image_url.
resp = client.chat.completions.create(
model="gemini-3.5-flash",
messages=[
{
"role": "user",
"content": [
{"type": "text", "text": "Что изображено на этой схеме? Перечисли основные блоки."},
{
"type": "image_url",
"image_url": {"url": "https://example.com/diagram.png"},
},
],
}
],
max_tokens=1024,
)
print(resp.choices[0].message.content)
Типичные сценарии: разбор скриншотов интерфейса и ошибок, чтение диаграмм и графиков, извлечение данных из фотографий документов, модерация пользовательского контента.
Важная оговорка: по каталогу вход всех трёх вариантов — только текст и изображения. Аудио и видео, которые Gemini умеет принимать в нативном API Google, через наш каталог не передаются — об этом честно написано в разделе ограничений ниже.
Что ещё важно знать
- Стриминг. Потоковые ответы работают штатно: как и в OpenAI API, достаточно передать
stream: trueв запросе чат-комплитов — токены приходят по мере генерации. Для длинных ответов это единственный способ не упираться в клиентские таймауты. - Режим рассуждения. Gemini 3.1 Pro и Gemini 3.5 Flash поддерживают thinking-режим: модель рассуждает перед ответом, что повышает качество на сложных задачах. Токены рассуждения тарифицируются как выход. У 3.1 Flash Lite режима рассуждения нет.
- Инструменты и структурированный вывод. Все три модели принимают описания функций (function calling) и умеют отвечать в заданной JSON-схеме — это закрывает типовые агентные сценарии: извлечение данных, маршрутизацию обращений, заполнение форм.
- Длинный контекст. Миллион токенов на входе — это десятки страниц документов или крупная кодовая база в одном запросе. Кэш-ставка на повторяющуюся часть промпта делает такие запросы заметно дешевле.
Оплата и документы для российских компаний
Пополнение баланса — в рублях: российскими банковскими картами и через СБП, без зарубежных платёжных инструментов.
Для юридических лиц и ИП:
- Счета и закрывающие документы. Счёт на юрлицо, закрывающие документы направляются через ЭДО (электронный документооборот) по фактически потреблённым услугам за календарный месяц.
- Без НДС. Сервис работает как ИП на УСН: в счёте и первичном документе указывается «Без НДС», входного НДС к вычету нет.
- Постоплата. Для организаций доступна договорная отсрочка платежа по фактическому потреблению API — это не банковский кредит, а соглашение по ст. 823 ГК РФ. Работает лестница лимитов: сначала предоплата, затем лимит до 5 000 ₽ (карточка организации, проверка по открытым реестрам и соглашение, подписанное уполномоченным лицом; срок оплаты — 14 календарных дней), после двух вовремя оплаченных периодов — до 10 000 ₽, свыше — индивидуальные условия по отдельному соглашению. Доступ к постоплате зависит от проверки организации — он не гарантирован автоматически. Подробности и заявка — на странице постоплаты для юрлиц.
Чего у нас нет: честные ограничения
Мы предоставляем три модели Gemini в OpenAI-совместимом формате чат-комплитов. Ряд возможностей, которые есть в нативном API Google, через наш каталог недоступны:
- Аудио и видео на вход. Нативный Gemini принимает аудиофайлы и видеозаписи; у наших вариантов вход ограничен текстом и изображениями.
- Генерация медиа. Изображения (Imagen), видео (Veo) и синтез речи (TTS) в экосистеме Google существуют, но наши варианты Gemini работают только «текст (+изображения) на вход, текст на выход».
- Нативные инструменты Google. Grounding с Google Search, Files API, Batch API и Live API — это специфичные интерфейсы Google; у нас единый OpenAI-совместимый эндпоинт с вызовом инструментов и JSON-режимом.
- Другие версии Gemini. В каталоге сейчас именно три перечисленные модели. Состав может меняться — актуальный список всегда в живом каталоге.
Итог
Прямой доступ к Gemini API из России закрыт: региона нет в официальном списке Google, оплата российской картой невозможна. Через PlusVibe API вы получаете три модели Gemini — 3.1 Pro, 3.5 Flash и 3.1 Flash Lite — с контекстом в миллион токенов, приёмом изображений и оплатой в рублях. Подключение занимает несколько минут: точка входа https://plusvibeapi.ru/v1, формат — стандартный OpenAI. Создайте аккаунт и сделайте первый запрос — документация здесь.