Режим рассуждений (reasoning)
Уровни reasoning для PlusVibe API: reasoning_effort в Chat Completions, reasoning.effort в Responses API и native thinking для Claude на /v1/messages. Значения none, minimal, low, medium, high, xhigh и max зависят от модели.
Режим рассуждений может повысить качество на сложных задачах, но обычно увеличивает задержку и расход выходных токенов. Формат параметра зависит от эндпоинта, а доступные уровни — от конкретной модели.
Формат параметра
| Параметр | Тип | Описание |
|---|---|---|
reasoning_effort | string | Верхнеуровневое поле для /v1/chat/completions. |
reasoning.effort | string | Вложенное поле для /v1/responses — канонический формат Responses API. |
PlusVibe распознаёт
none, minimal, low, medium, high, xhigh и max. Не каждая модель принимает каждый уровень. Правильное написание — medium, не middle.Как уровни применяются
| Параметр | Тип | Описание |
|---|---|---|
GPT-5 / o3 / o4 | native | Уровень передаётся модели в формате выбранного эндпоинта. |
GLM / Qwen | binary | none, minimal, low выключают thinking; medium и выше включают. |
Gemini | binary | Нижние уровни дают thinkingBudget=0, medium и выше — автоматический бюджет. |
DeepSeek / Kimi | native | Рассуждение встроено в модель и не переключается этим параметром. |
Claude | /v1/messages | Extended thinking задаётся объектом thinking с budget_tokens. |
Chat Completions (curl)
curl https://plusvibeapi.ru/v1/chat/completions \
-H "Authorization: Bearer $PLUSVIBE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-luna",
"reasoning_effort": "high",
"messages": [{"role": "user", "content": "Реши задачу пошагово: 17 * 23"}]
}'Chat Completions (OpenAI SDK)
from openai import OpenAI
client = OpenAI(base_url="https://plusvibeapi.ru/v1", api_key=os.environ["PLUSVIBE_API_KEY"])
r = client.chat.completions.create(model="gpt-5.6-luna", reasoning_effort="high",
messages=[{"role":"user","content":"Привет!"}])
print(r.choices[0].message.content)Responses API (curl)
curl https://plusvibeapi.ru/v1/responses \
-H "Authorization: Bearer $PLUSVIBE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-luna",
"reasoning": {"effort": "high"},
"input": "Реши задачу пошагово: 17 * 23"
}'Claude: native thinking
Модели Claude поддерживают «родной» режим размышления через эндпоинт /v1/messages — параметр thinking с бюджетом токенов budget_tokens:
from anthropic import Anthropic
client = Anthropic(base_url="https://plusvibeapi.ru", api_key=os.environ["PLUSVIBE_API_KEY"])
r = client.messages.create(model="claude-opus-4.8", max_tokens=1024,
thinking={"type":"enabled","budget_tokens":1024},
messages=[{"role":"user","content":"Привет!"}])
print(r.content)Для Claude не считайте Chat-параметр
reasoning_effort эквивалентом extended thinking. Используйте /v1/messages и native thinking. Подключение инструментов — в разделе Подключение к инструментам.