Режим рассуждений (reasoning)

Уровни reasoning для PlusVibe API: reasoning_effort в Chat Completions, reasoning.effort в Responses API и native thinking для Claude на /v1/messages. Значения none, minimal, low, medium, high, xhigh и max зависят от модели.

Режим рассуждений может повысить качество на сложных задачах, но обычно увеличивает задержку и расход выходных токенов. Формат параметра зависит от эндпоинта, а доступные уровни — от конкретной модели.

Формат параметра

ПараметрТипОписание
reasoning_effortstringВерхнеуровневое поле для /v1/chat/completions.
reasoning.effortstringВложенное поле для /v1/responses — канонический формат Responses API.
PlusVibe распознаёт none, minimal, low, medium, high, xhigh и max. Не каждая модель принимает каждый уровень. Правильное написание — medium, не middle.

Как уровни применяются

ПараметрТипОписание
GPT-5 / o3 / o4nativeУровень передаётся модели в формате выбранного эндпоинта.
GLM / Qwenbinarynone, minimal, low выключают thinking; medium и выше включают.
GeminibinaryНижние уровни дают thinkingBudget=0, medium и выше — автоматический бюджет.
DeepSeek / KiminativeРассуждение встроено в модель и не переключается этим параметром.
Claude/v1/messagesExtended thinking задаётся объектом thinking с budget_tokens.

Chat Completions (curl)

curl https://plusvibeapi.ru/v1/chat/completions \
  -H "Authorization: Bearer $PLUSVIBE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-luna",
    "reasoning_effort": "high",
    "messages": [{"role": "user", "content": "Реши задачу пошагово: 17 * 23"}]
  }'

Chat Completions (OpenAI SDK)

from openai import OpenAI

client = OpenAI(base_url="https://plusvibeapi.ru/v1", api_key=os.environ["PLUSVIBE_API_KEY"])
r = client.chat.completions.create(model="gpt-5.6-luna", reasoning_effort="high",
    messages=[{"role":"user","content":"Привет!"}])
print(r.choices[0].message.content)

Responses API (curl)

curl https://plusvibeapi.ru/v1/responses \
  -H "Authorization: Bearer $PLUSVIBE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-luna",
    "reasoning": {"effort": "high"},
    "input": "Реши задачу пошагово: 17 * 23"
  }'

Claude: native thinking

Модели Claude поддерживают «родной» режим размышления через эндпоинт /v1/messages — параметр thinking с бюджетом токенов budget_tokens:

from anthropic import Anthropic

client = Anthropic(base_url="https://plusvibeapi.ru", api_key=os.environ["PLUSVIBE_API_KEY"])
r = client.messages.create(model="claude-opus-4.8", max_tokens=1024,
    thinking={"type":"enabled","budget_tokens":1024},
    messages=[{"role":"user","content":"Привет!"}])
print(r.content)
Для Claude не считайте Chat-параметр reasoning_effort эквивалентом extended thinking. Используйте /v1/messages и native thinking. Подключение инструментов — в разделе Подключение к инструментам.