В каталоге PlusVibe сейчас три модели семейства GPT-6 от OpenAI: GPT-6 Sol, GPT-6 Luna и GPT-6 Astra. Astra появилась первой, Sol и Luna мы открыли 23 сентября 2026 года. Все три работают через один ключ и один базовый адрес, оплата в рублях. Ниже — чем они отличаются на бумаге и в цене и как выбрать модель под задачу.
Что общего у всех трёх
- Контекст 272 000 токенов и ответ до 128 000 токенов.
- Ввод текстом и изображениями — скриншоты, схемы и фото документов можно передавать прямо в сообщении.
- Вызов инструментов (function calling) для агентов и интеграций.
- Настраиваемые рассуждения через параметр
reasoning_effort. Токены рассуждения оплачиваются как выход. - Два эндпоинта:
/v1/chat/completionsдля OpenAI SDK и большинства инструментов и/v1/responsesдля Codex. Мы проверили оба на каждой из трёх моделей 24 сентября.
Чем модели отличаются
GPT-6 LunaGPT-6 SolGPT-6 Astra Назначение по каталогубыстрая и недорогая модель для частых задачфлагманские рассуждения, код и агентные сценариидлинный контекст, изображения, настраиваемые рассуждения Уровниreasoning_effortminimal, low, medium, high, xhigh, maxminimal, low, medium, high, xhigh, maxminimal, low, medium, high
JSON-режимдадане заявлен в каталоге
Контекст / ответ272K / 128K272K / 128K272K / 128K
Цены каналов по умолчанию в рублях за 1M токенов подставляются из живого каталога; ставки чтения из кеша — на страницах GPT-6 Luna, GPT-6 Sol и GPT-6 Astra:
| Модель | Вход | Выход |
|---|---|---|
| gpt-6-luna | 3,81 ₽/1M | 19,07 ₽/1M |
| gpt-6-sol | 14,24 ₽/1M | 71,2 ₽/1M |
| gpt-6-astra | 103,09 ₽/1M | 515,43 ₽/1M |
Разница в цене большая: на 24 сентября 2026 года Sol дороже Luna в несколько раз, а Astra дороже Sol ещё в несколько раз. Поэтому выбор модели здесь в первую очередь вопрос бюджета. Как посчитать: 1 000 запросов по 2 000 входных и 500 выходных токенов — это 2 × цена входа + 0,5 × цена выхода из таблицы выше. Актуальные значения — на страницах моделей.
Какую модель выбрать
GPT-6 Luna — поток и частые запросы
Классификация обращений, извлечение полей из документов, короткие ответы, черновики текстов, первичная обработка данных в пайплайне. Luna поддерживает JSON-режим и все шесть уровней рассуждений: для простых задач хватает minimal или low, и выходных токенов на рассуждения почти не уходит.
GPT-6 Sol — код, агенты и сложная логика
Каталог позиционирует Sol как флагман семейства по рассуждениям: изменения в коде, агентные цепочки с инструментами, задачи, где ошибка на раннем шаге ломает весь результат. Уровни xhigh и max дают модели больше места на размышления. Включайте их там, где это окупается качеством, — каждый токен рассуждения оплачивается по цене выхода.
GPT-6 Astra — только после проверки на своих задачах
Astra — самая дорогая модель семейства. У неё четыре уровня рассуждений вместо шести, и JSON-режим в каталоге для неё не заявлен. Мы не публикуем собственных бенчмарков, поэтому не станем утверждать, что Astra лучше Sol на какой-то конкретной задаче. Честный способ решить — прогнать одинаковые запросы на Sol и Astra и сравнить ответы и счёт.
Схема, которая обычно работает
Начните с Luna. Если качество не устраивает — поднимите reasoning_effort. Если и этого мало — переключитесь на Sol. Дорогую модель подключайте точечно, на тех шагах пайплайна, где её разница с дешёвой вы увидели на собственных данных.
Как вызвать через API
curl https://plusvibeapi.ru/v1/chat/completions \
-H "Authorization: Bearer sk-pv-ВАШ_КЛЮЧ" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-sol",
"reasoning_effort": "high",
"messages": [{"role": "user", "content": "Найди ошибку в этой функции и предложи исправление."}]
}'
Python SDK OpenAI:
from openai import OpenAI
client = OpenAI(
api_key="sk-pv-ВАШ_КЛЮЧ",
base_url="https://plusvibeapi.ru/v1",
)
response = client.chat.completions.create(
model="gpt-6-luna",
reasoning_effort="low",
response_format={"type": "json_object"},
messages=[{"role": "user", "content": "Извлеки из текста имя, телефон и город. Верни JSON."}],
)
print(response.choices[0].message.content)
Подробнее о параметре и о том, как считаются токены рассуждения, — в разделе «Режим рассуждений». Структурированный вывод описан в разделе «Структурированный вывод».
Codex CLI
Codex CLI ходит в эндпоинт /v1/responses. Пропишите провайдера в ~/.codex/config.toml и укажите нужную модель семейства:
model = "gpt-6-sol"
model_provider = "plusvibe"
model_reasoning_effort = "high"
[model_providers.plusvibe]
name = "PlusVibe API"
base_url = "https://plusvibeapi.ru/v1"
wire_api = "responses"
env_key = "PLUSVIBE_API_KEY"
Затем задайте переменную окружения PLUSVIBE_API_KEY со своим ключом и запустите codex. Строка wire_api = "responses" обязательна. Полная инструкция — в документации по Codex CLI. Cursor подключается через OpenAI-совместимый адрес, см. инструкцию для Cursor.
Каналы и резерв
У каждой модели GPT-6 в каталоге два канала с одинаковой ценой. Если вызывать модель по имени без суффикса ("model": "gpt-6-sol"), шлюз отправит запрос в основной канал. При ответе 429, ошибке 5xx или пустом ответе он сам переключится на второй канал. Если указать суффикс канала (например, gpt-6-sol:network), запрос пойдёт только туда, без переключения. Для рабочей нагрузки оставляйте имя без суффикса. Как устроены варианты модели — в разделе «Маршрутизация и лимиты».
Если вы на GPT-5.6
Линейка GPT-5.6 (GPT-5.6 Sol и соседние модели) остаётся в каталоге. Переход на GPT-6 — это смена значения model, формат запроса тот же. Прежде чем переключать весь трафик, сравните обе версии на своих запросах, в том числе по цене. Обзор предыдущего поколения — в статье «GPT-5.6: обзор новой линейки Sol, Terra, Luna».
GPT-6 через PlusVibe
Три модели семейства, один ключ, оплата в рублях. Для юрлиц — договор и оплата по счёту.
Попробовать →Все модели и актуальные цены — в каталоге PlusVibe.



