OpenAI разделил GPT-5.6 на три API-slug — gpt-5.6-sol, terra, luna — но многие всё ещё вызывают API как ChatGPT или GPT-5.5 (gpt-5.5-pro). Итог — 403 или счёт, который не сходится. Ниже проверяем: Responses vs Chat Completions, выбор модели и нужен ли отдельный slug для Pro.
GPT-5.6 вышел в феврале 2026 для сложных рассуждений и агентного кода. От API-ключа до полной таблицы цен — в порядке «запустить → выбрать → контролировать расходы» — с примерами Python/cURL и типичными ошибками.
1. Что такое GPT-5.6? Чем отличается от GPT-5.5?
GPT-5.6 — frontier-серия OpenAI с датой отсечения знаний 16 февраля 2026 года, ориентированная на сложное рассуждение, Agent-кодинг и мультимодальные задачи. По сравнению с GPT-5.5 OpenAI выделяет три момента:
| Измерение | GPT-5.5 | GPT-5.6 |
|---|---|---|
| Именование | Один gpt-5.5 + отдельный gpt-5.5-pro |
Sol / Terra / Luna — три уровня + алиас gpt-5.6 |
| Режим Pro | Переключение на модель gpt-5.5-pro |
Та же модель + reasoning.mode: "pro" |
| Эффективность токенов | Базовый уровень | Официально экономичнее; для той же задачи можно немного снизить max_output_tokens |
| Контекст | Зависит от модели | Все три поддерживают до ~1,05 млн токенов на вход и 128K на выход |
В community-бенчмарках GPT-5.6 Sol входит в лидеры по метрикам вроде Terminal-Bench 2.1 (Agent-кодинг) — но в продакшене ориентируйтесь на задержку, счёт и соответствие требованиям вашей задачи, а не только на рейтинги.
2. Какие модели доступны? Всё в одной таблице
| Slug модели | Позиционирование | Цена входа (короткий контекст) | Цена выхода (короткий контекст) | Сценарий |
|---|---|---|---|---|
gpt-5.6-sol |
Флагман, сложная профессиональная работа | $5.00 / 1M | $30.00 / 1M | Проектирование архитектуры, сложные баги, длинные цепочки рассуждений, критичные Agents |
gpt-5.6-terra |
Баланс интеллекта и стоимости | $2.50 / 1M | $15.00 / 1M | Ежедневный RAG, поддержка, задачи средней сложности по коду |
gpt-5.6-luna |
Чувствительность к цене, высокая параллельность | $1.00 / 1M | $6.00 / 1M | Классификация, извлечение, массовые саммари |
gpt-5.6 (алиас) |
→ Маршрутизация на Sol | как Sol | как Sol | По умолчанию, если не хотите выбирать |
Общие возможности (одинаковы для всех трёх):
- Вход: текст + изображение, выход: текст
- Многоязычность и визуальное понимание
- Поддержка
v1/responses,v1/chat/completions,v1/batch reasoning.effort:none/low/medium/high/xhigh/max(по умолчаниюmedium)
Выбор одной фразой:
- Не уверены → сначала
gpt-5.6-terraдля бенчмарка, при необходимости переход на Sol - Важнее цена, чем интеллект → Luna
- Один запрос определяет квартальную стратегию → Sol, при необходимости режим Pro
3. Endpoint GPT-5.6: какой API использовать?
У OpenAI сейчас два основных пути; новые функции — в первую очередь через Responses API:
| Endpoint | URL | Когда использовать |
|---|---|---|
| Responses API (рекомендуется) | POST /v1/responses |
Многоходовое состояние, вызовы инструментов, режим reasoning, структурированный вывод |
| Chat Completions (совместимость) | POST /v1/chat/completions |
Существующий код на OpenAI SDK, быстрая миграция |
| Batch | POST /v1/batch |
Офлайн-массовая обработка, не в реальном времени |
Base URL для всех:
https://api.openai.com/v1
Заголовки аутентификации (одинаковы для обоих API):
Authorization: Bearer $OPENAI_API_KEY
Content-Type: application/json
У GPT-5.6 нет отдельного поддомена — используется тот же
api.openai.com, что и у обычного OpenAI API; различие в полеmodelтела запроса.
4. Быстрый старт: от API Key до первого ответа
4.1 Подключение и ключ
- Войти на OpenAI Platform
- Settings → API keys — создать Secret Key (показывается один раз, обязательно сохраните)
- Billing — привязать способ оплаты; GPT-5.6 оплачивается по токенам, без «безлимитного API по подписке»
- Корпоративные пользователи могут задать Spend limits и ключи на уровне проекта
Переменная окружения (рекомендуется):
export OPENAI_API_KEY="sk-..."
4.2 Responses API (рекомендуемый способ)
cURL:
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-terra",
"input": "Объясните в трёх предложениях разницу в выборе между GPT-5.6 Terra и Sol.",
"max_output_tokens": 512
}'
Python (официальный SDK ≥ 1.x):
from openai import OpenAI
client = OpenAI() # читает OPENAI_API_KEY
response = client.responses.create(
model="gpt-5.6-terra",
input="Объясните в трёх предложениях разницу в выборе между GPT-5.6 Terra и Sol.",
max_output_tokens=512,
)
print(response.output_text)
Node.js:
import OpenAI from "openai";
const client = new OpenAI();
const response = await client.responses.create({
model: "gpt-5.6-terra",
input: "Объясните в трёх предложениях разницу в выборе между GPT-5.6 Terra и Sol.",
max_output_tokens: 512,
});
console.log(response.output_text);
4.3 Chat Completions (совместимость со старым кодом)
curl https://api.openai.com/v1/chat/completions \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-sol",
"messages": [
{"role": "user", "content": "Hello, GPT-5.6!"}
],
"max_tokens": 256
}'
При миграции достаточно заменить model с gpt-5.5 на gpt-5.6-sol / terra / luna; структура ответа не меняется.
4.4 Потоковый вывод (SSE)
Responses API с "stream": true — удобно для чат-UI и длинных ответов:
stream = client.responses.create(
model="gpt-5.6-luna",
input="Напишите пятистрочное стихотворение о cloud native.",
stream=True,
)
for event in stream:
if event.type == "response.output_text.delta":
print(event.delta, end="", flush=True)
В Chat Completions — stream=True, разбор choices[0].delta.content.
5. Ключевые параметры: reasoning, инструменты и мультимодальность
5.1 Глубина рассуждения: reasoning.effort
Управляет тем, сколько модель «думает» — чем глубже, тем выше обычно задержка и расход токенов:
| Значение | Типичное применение |
|---|---|
none |
Очень быстрый ответ, почти без рассуждений |
low / medium |
Уровень по умолчанию, повседневный диалог и лёгкий код |
high / xhigh / max |
Математика, сложная отладка, многошаговое планирование |
Без указания GPT-5.6 использует medium по умолчанию.
5.2 Режим Pro: reasoning.mode
В эпоху GPT-5.5 нужно было переключаться на gpt-5.5-pro; в GPT-5.6 Pro включается на том же slug:
{
"model": "gpt-5.6-sol",
"input": "Спроектируйте мультитенантный API сервиса заказов с маршрутами и моделью данных.",
"reasoning": {
"mode": "pro",
"effort": "high"
},
"max_output_tokens": 4096
}
- Биллинг: по-прежнему по цене токенов выбранного Sol/Terra/Luna, но режим Pro выполняет больше внутренних рассуждений — итоговых токенов часто больше
- Не ищите slug вроде
gpt-5.6-pro(не существует)
5.3 Ввод изображений (мультимодальность)
Все три GPT-5.6 поддерживают vision. Пример Responses API:
{
"model": "gpt-5.6-terra",
"input": [
{
"role": "user",
"content": [
{"type": "input_text", "text": "Какие единые точки отказа есть на этой архитектурной диаграмме?"},
{"type": "input_image", "image_url": "https://example.com/diagram.png"}
]
}
]
}
Можно передавать inline-изображения в base64 (удобно для приватных развёртываний).
5.4 Вызовы инструментов (Function / Tools)
В сценариях Agent объявляйте в поле tools Responses API функции или встроенные инструменты (например, web_search, file_search). Модель возвращает tool_calls; ваш сервис выполняет и передаёт результат — как у GPT-5.5, но GPT-5.6 стабильнее на сложных цепочках инструментов. Схема: документация по инструментам Responses API.
6. GPT-5.6 pricing: полная таблица цен (2026)
Ниже официальные цены OpenAI за миллион токенов (USD). Короткий контекст — вход ≤ 272K токенов; выше — длинный контекст.
6.1 Стандарт (короткий контекст)
| Модель | Вход | Вход при попадании в кэш | Запись в кэш | Выход |
|---|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $6.25 | $30.00 |
| gpt-5.6-terra | $2.50 | $0.25 | $3.125 | $15.00 |
| gpt-5.6-luna | $1.00 | $0.10 | $1.25 | $6.00 |
6.2 Длинный контекст (вход > 272K)
| Модель | Вход | Вход при попадании в кэш | Запись в кэш | Выход |
|---|---|---|---|---|
| gpt-5.6-sol | $10.00 | $1.00 | $12.50 | $45.00 |
| gpt-5.6-terra | $5.00 | $0.50 | $6.25 | $22.50 |
| gpt-5.6-luna | $2.00 | $0.20 | $2.50 | $9.00 |
6.3 Пример расчёта счёта
Допустим, вызов Terra: 20K вход + 2K выход, без попадания в кэш:
Вход: 20 000 / 1 000 000 × $2.50 = $0.05
Выход: 2 000 / 1 000 000 × $15.00 = $0.03
Итого ≈ $0.08 / вызов
При 10 000 подобных вызовов в день → около $800/день. Поэтому Luna + кэш + batch критичны для высоконагруженных продуктов.
6.4 Прочие факторы стоимости
| Пункт | Описание |
|---|---|
| Prompt Caching | Повторяющийся system prompt / длинный префикс документа сильно снижает цену входа (см. колонку «попадание в кэш») |
| Batch API | Нереалтайм-задачи часто со скидкой — офлайн-оценка и разметка данных |
| Резидентность данных | Для eligible-моделей после 2026-03-05: региональный endpoint обработки +10% |
| Сравнение с GPT-5.5 | Sol по той же цене, что GPT-5.5 ($5/$30), но GPT-5.6 часто экономит токены — фактический счёт может быть ниже |
На странице Usage в консоли смотрите группировку по model — надёжнее, чем заучивать формулы.
7. Выбор по сценарию: Sol, Terra или Luna?
| Сценарий | Рекомендуемая модель | reasoning | Примечание |
|---|---|---|---|
| Продакшен Agent по коду / сложные баги | Sol | high или mode: pro |
Задержка в обмен на точность |
| Внутренний корпоративный Copilot | Terra | medium |
Оптимальное соотношение цена/качество |
| Классификация логов, теги, извлечение | Luna | low / none |
Большой объём, чувствительность к цене |
| Очень длинный RAG (>272K) | Terra или Luna | medium |
Учитывайте надбавку за длинный контекст |
| Ревью архитектуры, аудит безопасности | Sol | pro + high |
Не экономьте на модели |
| Мультимодальная поддержка (изображение+текст) | Terra | medium |
Sol только при эскалации |
Связь с подпиской ChatGPT: ChatGPT Plus/Pro — это подписка на продукт; API с оплатой по токенам — отдельная линия. GPT-5.6 в приложении ≠ автоматический API-квота; для интеграции нужен отдельный API-биллинг.
8. Чеклист миграции с GPT-5.5 / GPT-4.1
- Изменить строку
model:gpt-5.5→gpt-5.6-sol(или terra/luna) - Логика Pro: удалить
gpt-5.5-pro, использоватьreasoning.mode: "pro" - Снизить
max_output_tokens: GPT-5.6 компактнее — сначала −20% и A/B - Регрессионные тесты: тот же набор промптов — качество, задержка, USD/запрос
- Мониторинг попаданий в кэш: для Agents с фиксированным system prompt обязательно включите caching
- Версия SDK: пакет Python
openai≥ версии с поддержкой Responses API
9. Частые ошибки и устранение
| HTTP / явление | Причина | Действие |
|---|---|---|
401 |
Недействительный или просроченный ключ | Пересоздать ключ, проверить переменную окружения |
403 / model_not_found |
Аккаунт без GPT-5.6 или региональные ограничения | Проверить видимость модели в консоли; связаться с продажами |
429 |
Лимит скорости | Повтор с экспоненциальной задержкой; увеличить квоту или снизить параллелизм |
context_length_exceeded |
Вход > 1,05M или выход > 128K | Обрезка, саммари или сегментированный RAG |
| Резкий рост счёта | Злоупотребление reasoning.mode: pro + effort: max |
Pro только на критических путях; по умолчанию terra + medium |
| Обрыв потока | Таймаут шлюза | Увеличить read_timeout reverse proxy или использовать нестриминговый Batch |
10. Семишаговый чеклист (можно запустить сегодня)
- Создать API Key на Platform, задать месячный hard limit (например, $50).
- Прогнать smoke-тест Responses API на Terra.
- Перевести продакшен-
modelсgpt-5.5наgpt-5.6-terra, наблюдать счёт неделю. - Включить Prompt Caching для фиксированного system prompt, проверить снижение стоимости входа.
- Сложные задачи маршрутизировать отдельно на Sol, ограничить QPS.
- Офлайн-оценку вести через Batch API.
- Настроить алерты по стоимости model × endpoint в дашборде.
11. Итог
Правильный способ работы с API GPT-5.6 в 2026 году:
- Endpoint: в приоритете
v1/responses, совместимость —v1/chat/completions - Модели:
sol— самый сильный,terra— на каждый день,luna— на объём;gpt-5.6= Sol - Цены: Sol от $5 / $30 (миллион input/output токенов), Terra вдвое дешевле, Luna примерно в пять раз
- Параметры:
reasoning.effortуправляет глубиной; для Pro —reasoning.mode: "pro", без фантомных имён моделей
Сначала бенчмарк Terra, подстраховка Sol, объём Luna — плюс кэш и Batch — устойчивее, чем сразу везде Sol.
Ссылки и дополнительное чтение
- Документация OpenAI Models
- OpenAI Pricing
- GPT-5.6 Model guidance
- ChatGPT Work: бесплатно vs платно (подписка на продукт vs оплата API)
- MCP 2026: универсальный USB-порт ИИ (подключение источников данных к Agents GPT-5.6)
API в облаке — сборка и подпись всё ещё на Mac
API GPT-5.6 запускает агентов и пайплайны, но упаковка iOS/macOS, сборки Xcode и подпись кода требуют нативного macOS.
Hashvps Cloud Mac (M4): логика API локально, Archive, TestFlight и CI в облаке.