← К блогу

API GPT-5.6: полное руководство, вызов, цены и модели

LLM · 2026.07.30 · ~10 мин чтения

OpenAI разделил GPT-5.6 на три API-slug — gpt-5.6-sol, terra, luna — но многие всё ещё вызывают API как ChatGPT или GPT-5.5 (gpt-5.5-pro). Итог — 403 или счёт, который не сходится. Ниже проверяем: Responses vs Chat Completions, выбор модели и нужен ли отдельный slug для Pro.

GPT-5.6 вышел в феврале 2026 для сложных рассуждений и агентного кода. От API-ключа до полной таблицы цен — в порядке «запустить → выбрать → контролировать расходы» — с примерами Python/cURL и типичными ошибками.

1. Что такое GPT-5.6? Чем отличается от GPT-5.5?

GPT-5.6 — frontier-серия OpenAI с датой отсечения знаний 16 февраля 2026 года, ориентированная на сложное рассуждение, Agent-кодинг и мультимодальные задачи. По сравнению с GPT-5.5 OpenAI выделяет три момента:

Измерение GPT-5.5 GPT-5.6
Именование Один gpt-5.5 + отдельный gpt-5.5-pro Sol / Terra / Luna — три уровня + алиас gpt-5.6
Режим Pro Переключение на модель gpt-5.5-pro Та же модель + reasoning.mode: "pro"
Эффективность токенов Базовый уровень Официально экономичнее; для той же задачи можно немного снизить max_output_tokens
Контекст Зависит от модели Все три поддерживают до ~1,05 млн токенов на вход и 128K на выход

В community-бенчмарках GPT-5.6 Sol входит в лидеры по метрикам вроде Terminal-Bench 2.1 (Agent-кодинг) — но в продакшене ориентируйтесь на задержку, счёт и соответствие требованиям вашей задачи, а не только на рейтинги.

2. Какие модели доступны? Всё в одной таблице

Slug модели Позиционирование Цена входа (короткий контекст) Цена выхода (короткий контекст) Сценарий
gpt-5.6-sol Флагман, сложная профессиональная работа $5.00 / 1M $30.00 / 1M Проектирование архитектуры, сложные баги, длинные цепочки рассуждений, критичные Agents
gpt-5.6-terra Баланс интеллекта и стоимости $2.50 / 1M $15.00 / 1M Ежедневный RAG, поддержка, задачи средней сложности по коду
gpt-5.6-luna Чувствительность к цене, высокая параллельность $1.00 / 1M $6.00 / 1M Классификация, извлечение, массовые саммари
gpt-5.6 (алиас) → Маршрутизация на Sol как Sol как Sol По умолчанию, если не хотите выбирать

Общие возможности (одинаковы для всех трёх):

  • Вход: текст + изображение, выход: текст
  • Многоязычность и визуальное понимание
  • Поддержка v1/responses, v1/chat/completions, v1/batch
  • reasoning.effort: none / low / medium / high / xhigh / max (по умолчанию medium)

Выбор одной фразой:

  • Не уверены → сначала gpt-5.6-terra для бенчмарка, при необходимости переход на Sol
  • Важнее цена, чем интеллект → Luna
  • Один запрос определяет квартальную стратегию → Sol, при необходимости режим Pro

3. Endpoint GPT-5.6: какой API использовать?

У OpenAI сейчас два основных пути; новые функции — в первую очередь через Responses API:

Endpoint URL Когда использовать
Responses API (рекомендуется) POST /v1/responses Многоходовое состояние, вызовы инструментов, режим reasoning, структурированный вывод
Chat Completions (совместимость) POST /v1/chat/completions Существующий код на OpenAI SDK, быстрая миграция
Batch POST /v1/batch Офлайн-массовая обработка, не в реальном времени

Base URL для всех:

text
https://api.openai.com/v1

Заголовки аутентификации (одинаковы для обоих API):

http
Authorization: Bearer $OPENAI_API_KEY
Content-Type: application/json

У GPT-5.6 нет отдельного поддомена — используется тот же api.openai.com, что и у обычного OpenAI API; различие в поле model тела запроса.

4. Быстрый старт: от API Key до первого ответа

4.1 Подключение и ключ

  1. Войти на OpenAI Platform
  2. Settings → API keys — создать Secret Key (показывается один раз, обязательно сохраните)
  3. Billing — привязать способ оплаты; GPT-5.6 оплачивается по токенам, без «безлимитного API по подписке»
  4. Корпоративные пользователи могут задать Spend limits и ключи на уровне проекта

Переменная окружения (рекомендуется):

bash
export OPENAI_API_KEY="sk-..."

4.2 Responses API (рекомендуемый способ)

cURL:

bash
curl https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-terra",
    "input": "Объясните в трёх предложениях разницу в выборе между GPT-5.6 Terra и Sol.",
    "max_output_tokens": 512
  }'

Python (официальный SDK ≥ 1.x):

python
from openai import OpenAI

client = OpenAI()  # читает OPENAI_API_KEY

response = client.responses.create(
    model="gpt-5.6-terra",
    input="Объясните в трёх предложениях разницу в выборе между GPT-5.6 Terra и Sol.",
    max_output_tokens=512,
)

print(response.output_text)

Node.js:

javascript
import OpenAI from "openai";

const client = new OpenAI();

const response = await client.responses.create({
  model: "gpt-5.6-terra",
  input: "Объясните в трёх предложениях разницу в выборе между GPT-5.6 Terra и Sol.",
  max_output_tokens: 512,
});

console.log(response.output_text);

4.3 Chat Completions (совместимость со старым кодом)

bash
curl https://api.openai.com/v1/chat/completions \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "messages": [
      {"role": "user", "content": "Hello, GPT-5.6!"}
    ],
    "max_tokens": 256
  }'

При миграции достаточно заменить model с gpt-5.5 на gpt-5.6-sol / terra / luna; структура ответа не меняется.

4.4 Потоковый вывод (SSE)

Responses API с "stream": true — удобно для чат-UI и длинных ответов:

python
stream = client.responses.create(
    model="gpt-5.6-luna",
    input="Напишите пятистрочное стихотворение о cloud native.",
    stream=True,
)

for event in stream:
    if event.type == "response.output_text.delta":
        print(event.delta, end="", flush=True)

В Chat Completions — stream=True, разбор choices[0].delta.content.

5. Ключевые параметры: reasoning, инструменты и мультимодальность

5.1 Глубина рассуждения: reasoning.effort

Управляет тем, сколько модель «думает» — чем глубже, тем выше обычно задержка и расход токенов:

Значение Типичное применение
none Очень быстрый ответ, почти без рассуждений
low / medium Уровень по умолчанию, повседневный диалог и лёгкий код
high / xhigh / max Математика, сложная отладка, многошаговое планирование

Без указания GPT-5.6 использует medium по умолчанию.

5.2 Режим Pro: reasoning.mode

В эпоху GPT-5.5 нужно было переключаться на gpt-5.5-pro; в GPT-5.6 Pro включается на том же slug:

json
{
  "model": "gpt-5.6-sol",
  "input": "Спроектируйте мультитенантный API сервиса заказов с маршрутами и моделью данных.",
  "reasoning": {
    "mode": "pro",
    "effort": "high"
  },
  "max_output_tokens": 4096
}
  • Биллинг: по-прежнему по цене токенов выбранного Sol/Terra/Luna, но режим Pro выполняет больше внутренних рассуждений — итоговых токенов часто больше
  • Не ищите slug вроде gpt-5.6-pro (не существует)

5.3 Ввод изображений (мультимодальность)

Все три GPT-5.6 поддерживают vision. Пример Responses API:

json
{
  "model": "gpt-5.6-terra",
  "input": [
    {
      "role": "user",
      "content": [
        {"type": "input_text", "text": "Какие единые точки отказа есть на этой архитектурной диаграмме?"},
        {"type": "input_image", "image_url": "https://example.com/diagram.png"}
      ]
    }
  ]
}

Можно передавать inline-изображения в base64 (удобно для приватных развёртываний).

5.4 Вызовы инструментов (Function / Tools)

В сценариях Agent объявляйте в поле tools Responses API функции или встроенные инструменты (например, web_search, file_search). Модель возвращает tool_calls; ваш сервис выполняет и передаёт результат — как у GPT-5.5, но GPT-5.6 стабильнее на сложных цепочках инструментов. Схема: документация по инструментам Responses API.

6. GPT-5.6 pricing: полная таблица цен (2026)

Ниже официальные цены OpenAI за миллион токенов (USD). Короткий контекст — вход ≤ 272K токенов; выше — длинный контекст.

6.1 Стандарт (короткий контекст)

Модель Вход Вход при попадании в кэш Запись в кэш Выход
gpt-5.6-sol $5.00 $0.50 $6.25 $30.00
gpt-5.6-terra $2.50 $0.25 $3.125 $15.00
gpt-5.6-luna $1.00 $0.10 $1.25 $6.00

6.2 Длинный контекст (вход > 272K)

Модель Вход Вход при попадании в кэш Запись в кэш Выход
gpt-5.6-sol $10.00 $1.00 $12.50 $45.00
gpt-5.6-terra $5.00 $0.50 $6.25 $22.50
gpt-5.6-luna $2.00 $0.20 $2.50 $9.00

6.3 Пример расчёта счёта

Допустим, вызов Terra: 20K вход + 2K выход, без попадания в кэш:

text
Вход:  20 000 / 1 000 000 × $2.50 = $0.05
Выход:  2 000 / 1 000 000 × $15.00 = $0.03
Итого ≈ $0.08 / вызов

При 10 000 подобных вызовов в день → около $800/день. Поэтому Luna + кэш + batch критичны для высоконагруженных продуктов.

6.4 Прочие факторы стоимости

Пункт Описание
Prompt Caching Повторяющийся system prompt / длинный префикс документа сильно снижает цену входа (см. колонку «попадание в кэш»)
Batch API Нереалтайм-задачи часто со скидкой — офлайн-оценка и разметка данных
Резидентность данных Для eligible-моделей после 2026-03-05: региональный endpoint обработки +10%
Сравнение с GPT-5.5 Sol по той же цене, что GPT-5.5 ($5/$30), но GPT-5.6 часто экономит токены — фактический счёт может быть ниже

На странице Usage в консоли смотрите группировку по model — надёжнее, чем заучивать формулы.

7. Выбор по сценарию: Sol, Terra или Luna?

Сценарий Рекомендуемая модель reasoning Примечание
Продакшен Agent по коду / сложные баги Sol high или mode: pro Задержка в обмен на точность
Внутренний корпоративный Copilot Terra medium Оптимальное соотношение цена/качество
Классификация логов, теги, извлечение Luna low / none Большой объём, чувствительность к цене
Очень длинный RAG (>272K) Terra или Luna medium Учитывайте надбавку за длинный контекст
Ревью архитектуры, аудит безопасности Sol pro + high Не экономьте на модели
Мультимодальная поддержка (изображение+текст) Terra medium Sol только при эскалации

Связь с подпиской ChatGPT: ChatGPT Plus/Pro — это подписка на продукт; API с оплатой по токенам — отдельная линия. GPT-5.6 в приложении ≠ автоматический API-квота; для интеграции нужен отдельный API-биллинг.

8. Чеклист миграции с GPT-5.5 / GPT-4.1

  1. Изменить строку model: gpt-5.5gpt-5.6-sol (или terra/luna)
  2. Логика Pro: удалить gpt-5.5-pro, использовать reasoning.mode: "pro"
  3. Снизить max_output_tokens: GPT-5.6 компактнее — сначала −20% и A/B
  4. Регрессионные тесты: тот же набор промптов — качество, задержка, USD/запрос
  5. Мониторинг попаданий в кэш: для Agents с фиксированным system prompt обязательно включите caching
  6. Версия SDK: пакет Python openai ≥ версии с поддержкой Responses API

9. Частые ошибки и устранение

HTTP / явление Причина Действие
401 Недействительный или просроченный ключ Пересоздать ключ, проверить переменную окружения
403 / model_not_found Аккаунт без GPT-5.6 или региональные ограничения Проверить видимость модели в консоли; связаться с продажами
429 Лимит скорости Повтор с экспоненциальной задержкой; увеличить квоту или снизить параллелизм
context_length_exceeded Вход > 1,05M или выход > 128K Обрезка, саммари или сегментированный RAG
Резкий рост счёта Злоупотребление reasoning.mode: pro + effort: max Pro только на критических путях; по умолчанию terra + medium
Обрыв потока Таймаут шлюза Увеличить read_timeout reverse proxy или использовать нестриминговый Batch

10. Семишаговый чеклист (можно запустить сегодня)

  1. Создать API Key на Platform, задать месячный hard limit (например, $50).
  2. Прогнать smoke-тест Responses API на Terra.
  3. Перевести продакшен-model с gpt-5.5 на gpt-5.6-terra, наблюдать счёт неделю.
  4. Включить Prompt Caching для фиксированного system prompt, проверить снижение стоимости входа.
  5. Сложные задачи маршрутизировать отдельно на Sol, ограничить QPS.
  6. Офлайн-оценку вести через Batch API.
  7. Настроить алерты по стоимости model × endpoint в дашборде.

11. Итог

Правильный способ работы с API GPT-5.6 в 2026 году:

  • Endpoint: в приоритете v1/responses, совместимость — v1/chat/completions
  • Модели: sol — самый сильный, terra — на каждый день, luna — на объём; gpt-5.6 = Sol
  • Цены: Sol от $5 / $30 (миллион input/output токенов), Terra вдвое дешевле, Luna примерно в пять раз
  • Параметры: reasoning.effort управляет глубиной; для Pro — reasoning.mode: "pro", без фантомных имён моделей

Сначала бенчмарк Terra, подстраховка Sol, объём Luna — плюс кэш и Batch — устойчивее, чем сразу везде Sol.


Ссылки и дополнительное чтение

API в облаке — сборка и подпись всё ещё на Mac

API GPT-5.6 запускает агентов и пайплайны, но упаковка iOS/macOS, сборки Xcode и подпись кода требуют нативного macOS.
Hashvps Cloud Mac (M4): логика API локально, Archive, TestFlight и CI в облаке.

На главную

Hashvps · Mac Cloud

Выделенный Mac Cloud

Выделенные вычисления + эксклюзивный IP.

На главную
Акция