В июле OpenAI выпустила новую линейку моделей, в конце месяца дважды поменяла цены, а на осень назначила отключение Assistants API, Videos API и всего поколения GPT-4. Мы переподключали свои сервисы под эти изменения и по ходу сверяли каждый шаг с документацией — заодно выяснилось, сколько русскоязычных руководств успело устареть.

Ниже проход от пустого аккаунта до продакшена: ключ, первый запрос, выбор модели, расчёт бюджета, пополнение, лимиты, ограничения для российских команд и календарь отключений.

Заводим аккаунт и прячем ключ

На входе почта и телефон, на выходе строка вида sk-proj-..., которую вы подставите в код. Между ними три сущности, которые OpenAI разводит намеренно: аккаунт, организация и проект. Ключ выдаётся не лично вам, а проекту, и от этого зависит, по какому счёту пойдут расходы и какие лимиты к запросу применятся.

Регистрируетесь на платформе, подтверждаете почту и телефон. Внутри аккаунта создаётся организация, внутри неё дефолтный проект. Дальше идёте в раздел API keys и жмёте создание ключа.

Ключ показывается один раз

Строка целиком видна только на экране, где вы её создали. Ушли со страницы — вернуть нельзя: в списке останется огрызок вида sk-proj-...a4Kf, по которому ключ можно опознать и отозвать. Если не сохранили, то удаляйте и создавайте новый.

Кладёте его в переменную окружения, а не в код:

export OPENAI_API_KEY="sk-proj-..."

Официальные SDK читают OPENAI_API_KEY сами, поэтому в коде вы ключ вообще не упоминаете:

from openai import OpenAI

client = OpenAI()  # ключ подхватится из окружения

Кроме проектных ключей платформа выдаёт сервисные и административные. Сервисный принадлежит не человеку, а служебной учётной записи проекта: документация описывает его как ключ с правами на чтение и запись всех ресурсов проекта, и живёт он независимо от того, кто из сотрудников остался в организации. Административные управляют самой организацией и на обычных эндпоинтах не работают.

В коде и логах вы увидите префиксы sk-proj-, sk-svcacct- и sk-admin-, но отдельной страницы документации с этой классификацией у OpenAI нет — префиксы наблюдаемы на практике, а не задокументированы. Если строите на них парсинг, закладывайтесь на изменение.

Зачем отдельный проект под каждое приложение

Ключи утекают в публичные репозитории постоянно. GitHub сканирует коммиты и умеет уведомлять OpenAI, тот отзывает ключ автоматически, но между коммитом и отзывом проходит время, за которое по вашему ключу успевают потратить деньги. Помогает .gitignore с .env и pre-commit хук, который ищет в диффе строки на sk-.

Заводите отдельный проект под каждое приложение и отдельный ключ под каждую среду: один для прода, другой для стейджа, третий для локальной разработки. Тогда при утечке вы отзовёте один ключ и не остановите остальное. С 4 августа 2026 в дашбордах Usage и Costs появилась фильтрация по конкретному ключу, так что видно не только сумму по проекту, но и какой именно ключ внутри него её потратил.

Списка моделей под верификацию не существует

Компания OpenAI может попросить пройти проверку, прежде чем вы получите доступ к отдельным продуктам, функциям, моделям или программам. Единственный обязательный случай, который назван явно, к моделям отношения не имеет: бизнес-верификацию требуют рекламные продукты.

Публичного списка моделей, которые без верификации не отдаются, нет. Мы проверили страницу моделей и слова «verification» там нет ни у одной. В статьях 2025 года такой список фигурировал, сейчас формулировку из справки убрали. На практике люди упираются в верификацию на отдельных моделях вроде gpt-image-1, но заранее предсказать, где именно, нельзя.

Верификация бывает двух видов. Персональная требует оригинал непросроченного государственного документа с фотографией. Бизнес-верификация просит юридическое название точно как в реестре, актуальный адрес, налоговый или регистрационный номер и описание деятельности.

OpenAI отдельно предупреждает, что несколько попыток пройти верификацию подряд могут закончиться блокировкой доступа. Подавать заявку наугад, чтобы посмотреть, что будет, не стоит.

Выбираем поверхность API

Текст сейчас генерируют через две поверхности. Responses — основной путь, на нём строится всё новое. Chat Completions поддерживается, дедлайна отключения у него нет, но для новых проектов OpenAI рекомендует Responses.

Здесь стоит различать два случая, потому что их часто смешивают. Код на Chat Completions работает и продолжит работать: примеры из прошлогодних туториалов не сломаются, они просто написаны под поверхность, которую больше не развивают. А вот код на Assistants API перестанет отвечать 26 августа 2026, и это уже вопрос ближайшей недели.

Responses хранит контекст на стороне OpenAI, поэтому историю переписки не нужно каждый раз пересобирать и слать целиком: вы передаёте идентификатор предыдущего ответа, и продолжение цепляется к нему. Рядом работает Conversations API, который заменил Threads из Assistants API.

Адреса

Базовый адрес — https://api.openai.com/v1, дальше идёт имя поверхности.

Эндпоинт

Зачем

/v1/responses

Основная генерация, текст и мультимодальность

/v1/conversations

Хранение диалога на стороне OpenAI

/v1/chat/completions

Legacy-формат, поддерживается, но для нового кода не рекомендован

/v1/embeddings

Векторные представления текста

/v1/moderations

Проверка контента, бесплатно

/v1/batch

Пакетная обработка со скидкой 50%

/v1/models

Список доступных вам моделей

Минимальный запрос

from openai import OpenAI

client = OpenAI()

response = client.responses.create(

    model="gpt-5.6-terra",

    input="Объясни в двух предложениях, что такое эмбеддинги."

)

print(response.output_text)

То же через curl:

curl https://api.openai.com/v1/responses \

  -H "Authorization: Bearer $OPENAI_API_KEY" \

  -H "Content-Type: application/json" \

  -d '{

    "model": "gpt-5.6-terra",

    "input": "Объясни в двух предложениях, что такое эмбеддинги."

  }'

Стриминг включается одним флагом:

stream = client.responses.create(

    model="gpt-5.6-terra",

    input="Напиши план статьи про векторные базы.",

    stream=True,

)

for event in stream:

    if event.type == "response.output_text.delta":

        print(event.delta, end="", flush=True)

Переезд со старого кода

Миграция не сводится к замене одного метода на другой. Меняется структура запроса: вместо массива messages с ролями приходит input, системный промпт задаётся в instructions. Если у вас накручена своя логика на формат ответа, её придётся переписывать.

Торопиться некуда, пока вы не на Assistants API. Но новые возможности прикручивают к Responses, и разрыв между поверхностями растёт с каждым релизом.

Три модели вместо mini и nano

gpt-5.6-terra из примеров выше — средняя из трёх моделей, которые OpenAI выпустила 9 июля 2026 вместо привычной схемы «модель плюс mini плюс nano». Названия сменились на имена: Sol, Terra и Luna. Это три ступени одного релиза GPT-5.6, а не три разных поколения.

Модель

Роль

Контекст

Max output

Обучена по

gpt-5.6-sol

Фронтир, максимум способностей

1 050 000

128 000

16.02.2026

gpt-5.6-terra

Рабочая лошадь

1 050 000

128 000

16.02.2026

gpt-5.6-luna

Дёшево и массово

1 050 000

128 000

16.02.2026

Окно контекста в миллион токенов у всех трёх одинаковое.

Кроме текстовых моделей в каталоге API есть:

  • gpt-image-2 для картинок, вышел 21 апреля 2026 и заменил DALL·E, который удалён из API 12 мая

  • gpt-transcribe — рекомендованная модель для расшифровки записанной речи, $0,0045 за минуту

  • whisper-1 из API не убрали, он стоит $0,006 за минуту и остался под конкретные задачи: пословные и посегментные таймкоды, перевод на английский, субтитры

  • gpt-realtime-2.1 для голосовых диалогов в реальном времени

  • gpt-audio-1.5 для аудио: $2,50 и $10,00 за миллион текстовых токенов, $32,00 и $64,00 за миллион аудиотокенов

  • gpt-4o-mini-tts для синтеза речи: $0,60 за миллион входных текстовых и $12,00 за миллион выходных аудиотокенов

  • text-embedding-3-small за $0,02 и text-embedding-3-large за $0,13 за миллион токенов

  • omni-moderation-latest для проверки контента, бесплатно

  • gpt-5.3-codex под задачи с кодом

Цен на эмбеддинги на общей странице прайса нет: раздела Embeddings там не существует, цифры опубликованы только на карточках моделей, и в сообществе на это регулярно жалуются.

Правило выбора

Между Luna и Sol двадцатипятикратная разница по входным токенам. На типовых задачах вроде классификации или извлечения полей из текста разрыв в качестве такого масштаба не даёт, поэтому начинать имеет смысл с Terra, а двигаться от неё в обе стороны по результатам на своих данных.

Luna берите на всё, где задача формальная и объём большой: классификация, извлечение полей, разметка, короткие ответы по шаблону. Sol имеет смысл там, где неверный ответ стоит дороже разницы в тарифе: сложный анализ, код, длинные цепочки рассуждений, юридические и финансовые тексты.

Кроме модели вы выбираете уровень рассуждения. Раньше их было четыре, теперь шесть: none, low, medium по умолчанию, high, xhigh и max. Чем выше уровень, тем больше модель думает перед ответом и тем больше токенов тратит.

response = client.responses.create(

    model="gpt-5.6-sol",

    input="Найди ошибку в этом SQL-запросе: ...",

    reasoning={"effort": "high"},

)

Видео закрывается

Sora 2 и Videos API объявлены устаревшими 24 марта 2026 и выключаются 24 сентября, веб-версия и приложение закрылись ещё 26 апреля. Замена в документации не указана, преемника в API мы не нашли. Купленные кредиты Sora разрешено перенаправить на Codex.

Модели для кибербезопасности, gpt-5.6-cyber и семейство Daybreak, по общей подписке не выдаются: доступ открывают вручную через программу Trusted Access for Cyber, и OpenAI прямо пишет, что одобрение не автоматическое.

Режимы скорости

Fast mode с 30 июля заменил Priority Processing, работает до 2,5 раз быстрее и стоит вдвое дороже. В коде принимаются оба значения, service_tier: 'priority' и service_tier: 'fast'.

13 августа для Sol анонсировали Ultrafast — до 14 раз быстрее стандартного режима. Цену за него OpenAI не назвала, срок общего доступа тоже: на карточке модели тира Ultrafast нет, доступ пока открыт узкому кругу клиентов. Четырнадцатикратная цифра относится к скорости, а не к деньгам, и переносить её на прайс не надо.

Считаем деньги до запуска

Считают отдельно входные токены и выходные, каждые по своему тарифу.

Модель

Input / 1M

Cached input

Cache writes

Output / 1M

gpt-5.6-sol

$5,00

$0,50

$6,25

$30,00

gpt-5.6-terra

$2,00

$0,20

$2,50

$12,00

gpt-5.6-luna

$0,20

$0,02

$0,25

$1,20

30 июля OpenAI снизила цены Luna и Terra на 80% и 20%: Luna подешевела с доллара за миллион входных токенов до двадцати центов. В русскоязычных статьях, включая свежие августовские, до сих пор встречается старый прайс, так что бюджет по ним пересчитайте.

Токен — это единица, на которые модель режет текст. В английском на токен приходится примерно 4 символа, в русском 2–3, потому что кириллица разбивается мельче. Один и тот же смысл на русском стоит дороже, чем на английском.

Стоимость запроса считают так: входные токены умножают на входной тариф, выходные на выходной и складывают.

Порог в 272 тысячи токенов

Если во входе больше 272 000 токенов, тариф меняется для всего запроса целиком: входные дорожают вдвое, выходные в полтора раза.

Модель, длинный контекст

Input

Output

gpt-5.6-sol

$10,00

$45,00

gpt-5.6-terra

$4,00

$18,00

gpt-5.6-luna

$0,40

$1,80

Миллионное окно позволяет залить в запрос всю базу знаний, и модель её обработает. Счёт за такой запрос придёт по удвоенному тарифу.

Кеш стал платным в обе стороны

Раньше в прайсе была одна строка про кешированный вход, теперь их две: чтение из кеша и запись в кеш. Запись тарифицируется по коэффициенту 1,25 к обычному входному тарифу, чтение выходит в десять раз дешевле входа.

Кеш начинает экономить, когда один и тот же префикс уходит в модель много раз, и экономия пропорциональна доле этого префикса в запросе. С 29 мая 2026 у организаций без ZDR время жизни кеша по умолчанию 24 часа вместо прежнего хранения только в памяти, так что кешируемым оказывается заметно больший объём, чем год назад.

В батче всё вдвое дешевле

Всё, что можно обработать не сразу, в Batch API стоит вдвое дешевле. Окно выполнения одно, 24 часа, других значений параметр не принимает. До 50 000 запросов в пакете, файл до 200 МБ, до 2000 батчей в час, лимиты отдельные от синхронных. Terra в батче стоит доллар за миллион входных вместо двух.

Бот на тысячу диалогов в день

Телеграм-бот, 1000 диалогов в день, в среднем три обмена репликами. Системный промпт 500 токенов, история и вопрос дают около 4000 входных токенов на диалог, ответы около 600 выходных. В день это 4 млн входных и 0,6 млн выходных.

На Terra получается 4 × $2 плюс 0,6 × $12, то есть $15,2 в день и около $456 в месяц. На Luna — 4 × $0,20 плюс 0,6 × $1,20, то есть $1,52 в день и около $46 в месяц.

Если бот отвечает по базе знаний в рамках понятного сценария, Luna справится и обойдётся в десять раз дешевле: $46 против $456 в месяц. Если бот пишет код или разбирает договоры, берите Sol и закладывайте около $1140 в месяц.

Кеширование системного промпта на этих цифрах даёт немного: 500 токенов из 4000 входных — это восьмая часть входа, и на общем счёте выходит около шести процентов экономии. Кеш заметен там, где неизменяемый префикс занимает большую часть запроса, например при работе с длинной инструкцией или базой примеров.

Инструменты идут отдельной строкой

Инструменты тарифицируются отдельно от токенов, и про них часто забывают при расчёте. Веб-поиск стоит $10 за тысячу вызовов, файловое хранилище $0,10 за гигабайт в день, Code Interpreter от $0,03 до $1,92 за сессию, причём со 2 июня 2026 биллинг поминутный с минимумом в пять минут вместо прежних фиксированных двадцати. Региональные эндпоинты с хранением данных в конкретной юрисдикции добавляют 10% к цене для моделей, выпущенных с 5 марта 2026.

Предоплата и срок годности кредитов

Модель предоплатная: вы кладёте деньги на баланс организации, они списываются по мере запросов. Минимальная покупка $5, по умолчанию интерфейс предлагает $10.

В разделе биллинга покупаете кредиты и при желании включаете автопополнение. У него три параметра: порог срабатывания, сумма долива и месячный потолок, причём потолок на ручные покупки не распространяется.

Параллельно с предоплатой существует ежемесячное выставление счетов для организаций: инвойс уменьшается на сумму уже израсходованных кредитов.

Кредиты сгорают через год

В справке записано, что купленные кредиты истекают через год и не возвращаются. Бесплатные, если они вам достались, списываются раньше платных.

Поэтому годовой бюджет разом на баланс не заливайте. Кладите на квартал и включайте автопополнение с адекватным порогом.

С 22 июля лимит расходов блокирует запросы

22 июля 2026 в API добавили жёсткие лимиты расходов на организацию и на проект. Раньше при превышении бюджета приходило уведомление, дальше вы тратили сколько хотели. Теперь запросы начинают отбиваться, как только учтённые траты дошли до потолка.

Запишите, какой лимит поставили: без этого числа ошибку 429 придётся разбирать вслепую.

Что означает 429

У аккаунта два независимых ограничителя, которые часто путают. Rate limits задают частоту: сколько запросов и токенов в минуту вам разрешено. Spend limits задают потолок расходов. Упереться можно в любой, и в обоих случаях придёт 429.

Различить их можно по дашборду: если израсходованная за месяц сумма подошла к установленному потолку, дело в лимите расходов, а не в частоте запросов.

Тир повышается автоматически по мере того, как вы платите. Пороги не менялись с 2024 года:

Тир

Оплачено суммарно

Лимит расходов в месяц

Free

$100

Tier 1

$5

$100

Tier 2

$50

$500

Tier 3

$100

$1 000

Tier 4

$250

$5 000

Tier 5

$1 000

$200 000

Лимиты частоты для Sol и Terra:

Тир

Запросов в минуту

Токенов в минуту

Tier 1

500

500 000

Tier 2

5 000

1 000 000

Tier 3

5 000

2 000 000

Tier 4

10 000

4 000 000

Tier 5

15 000

40 000 000

Чтобы получить второй тир, надо суммарно оплатить пятьдесят долларов, и лимит запросов после этого вырастает в десять раз. Если вы упёрлись в потолок на Tier 1, дешевле пополнить баланс, чем переписывать архитектуру под очередь.

Коды ошибок

Код

Что означает

Что делать

401

Ключ неверный или отозван

Проверить переменную окружения

403

Модель недоступна организации

Проверить верификацию и регион

429

Rate limit или spend limit

Пауза с бэкоффом, проверить лимит расходов

500 / 503

Сбой на стороне OpenAI

Ретрай

insufficient_quota

Кончились деньги

Пополнить баланс

insufficient_quota формально приходит с кодом 429, и это сбивает с толку: код тот же, а бэкофф не поможет, потому что ждать нечего. Различайте их по телу ответа, иначе получите бесконечный цикл ретраев на пустом балансе.

Ретраи

import random

import time

from openai import OpenAI, RateLimitError, APIStatusError

client = OpenAI()

def ask(prompt, model="gpt-5.6-terra", attempts=5):

    for attempt in range(attempts):

        try:

            return client.responses.create(model=model, input=prompt).output_text

        except RateLimitError:

            if attempt == attempts - 1:

                raise

            delay = 2 ** attempt + random.uniform(0, 1)

            time.sleep(delay)

        except APIStatusError as e:

            if e.status_code >= 500 and attempt < attempts - 1:

                time.sleep(2 ** attempt)

                continue

            raise

Разброс в паузе нужен, чтобы клиенты не долбились в API синхронно после общего сбоя.

Россия не в списке

Россия отсутствует в списке стран, которые OpenAI поддерживает. Мы сверились со списком: между Romania и Rwanda строки Russia нет. Ukraine в списке присутствует с пометкой об исключениях, России нет.

Про доступ OpenAI пишет «may result», про оплату — «will result». За доступ из неподдерживаемой страны аккаунт могут заблокировать: «Accessing or offering access to our services outside of the countries and territories listed below may result in your account being blocked or suspended». За оплату картой из неподдерживаемой страны блокируют без всяких «могут»: «Using payment methods outside of our list of supported countries will result in you being blocked from using our services». Блокируют при этом аккаунт целиком, вместе с балансом на нём.

Про VPN

Ни на странице поддерживаемых стран, ни в справочной статье о неподдерживаемых территориях слово VPN не встречается ни разу. Опубликованной политики «за VPN блокируем» у OpenAI нет.

Обратного она тоже не обещает: формулировка построена вокруг факта доступа из неподдерживаемой страны, а не вокруг способа, которым вы туда попали.

Где хранятся данные

Региональные эндпоинты доступны в десяти юрисдикциях: США, ЕЭЗ со Швейцарией, Австралия, Канада, Япония, Индия, Сингапур, Южная Корея, Великобритания, ОАЭ. России среди них нет.

Аккаунт зарегистрировать технически можно, оплатить его так, чтобы не нарушить условия, нельзя. Российская карта в список поддерживаемых платёжных методов не входит, а это основание для блокировки с формулировкой «will».

Меняем провайдера двумя строками

Формат OpenAI стал отраслевым стандартом. Google отдаёт Gemini через OpenAI-совместимый эндпоинт, так же поступают Groq, Azure, Timeweb, Яндекс, локальные Ollama и vLLM. С 1 июня 2026 модели самой OpenAI появились в Amazon Bedrock, тоже через совместимый Responses-эндпоинт.

Базовый адрес оказывается параметром, а не константой:

from openai import OpenAI

client = OpenAI(

    base_url="https://api.example-provider.ru/v1",

    api_key="ваш-ключ",

)

response = client.responses.create(

    model="gpt-5.6-terra",

    input="Привет",

)

Остальной код, библиотеки поверх SDK и фреймворки вроде LangChain продолжают работать без изменений.

Что предлагают агрегаторы

Российские команды подключаются через посредников, которые держат договор с OpenAI со своей стороны и отдают наружу совместимый интерфейс. Напомню, что Польза.ai один из таких сервисов. Цифры в таблице взяты с публичных страниц каждого из сервисов.

AITunnel

Польза.ai

ProxyAPI

VseLLM

GPT-5.6 Sol, ₽ за 1M вход/выход

500 / 3 000

583 / 3 499

800 / 4 700

552 / 3 315

GPT-5.6 Terra

400 / 2 400

233 / 1 400

400 / 2 560

276 / 1 658

GPT-5.6 Luna

40 / 240

23 / 140

60 / 360

110 / 663

Моделей в каталоге

100–200

393

37 с ценами

100+

base_url

api.aitunnel.ru/v1

polza.ai/api/v1

api.proxyapi.ru/openai/v1

api.vsellm.ru/v1

Responses API

да

да, stateless

да

да

Оплата

карты, СБП, крипта, безнал

карты РФ, СБП, р/с

карты, СБП, крипта, безнал

карта, безнал

Закрывающие

акты, УПД, ЭДО

акты, счета-фактуры

акты, УПД, ЭДО

акты, УПД через Диадок

Минимум пополнения

500 ₽

100 ₽

не заявлен

1 000 ₽

Цены с сайтов сервисов на 20.08.2026. У Польза.ai в строке Sol указан тариф Sol Pro — именно он соответствует официальному $5/$30, отдельная позиция «Sol» в каталоге идёт по другому роуту и дешевле.

Наценка внутри одного каталога не одинаковая. AITunnel держит флагманский Sol дешевле остальных четырёх, но на Terra и Luna берёт заметно больше. ProxyAPI дороже по всем трём моделям, зато явно указывает НДС в цене и даёт нативный Anthropic-эндпоинт, на котором без переделок заводится Claude Code. Сравнение по одной модели ничего не покажет, считайте под свой профиль потребления.

Чем придётся заплатить

Посредник добавляет звено, а звено добавляет задержку к каждому запросу. Наценка есть у всех, иначе бизнес не работает. Данные проходят через ещё одну инфраструктуру, и для чувствительных задач это считается отдельно. Свежие модели появляются с лагом от релиза, потому что их надо подключить и протестировать.

У нас, например, Responses API работает без сохранения состояния: previous_response_id, conversation и store не поддерживаются, историю диалога надо передавать целиком каждый раз. То есть главное преимущество Responses над Chat Completions через агрегатор не работает, и заголовок этого раздела про две строчки для такого случая слишком оптимистичен. Если ваша логика построена на серверном хранении контекста, это ломающее ограничение.

Если компания может легально работать с OpenAI напрямую — юрлицо в поддерживаемой юрисдикции, местная карта, — прямой путь дешевле и без лишнего звена.

Готовимся к осенним отключениям

Семь дат впереди, одна уже прошла.

Дата

Что выключают

Чем заменять

12 мая 2026

DALL·E 2 и 3, Realtime API Beta

Уже произошло. gpt-image-2

26 августа 2026

Assistants API

Responses API плюс Conversations API

24 сентября 2026

Sora 2, Videos API

Замена не объявлена

23 октября 2026

gpt-3.5-turbo, GPT-4.x, o1

GPT-5.6

30 ноября 2026

Agent Builder, Evals platform, v1/prompts

Agents SDK

1 декабря 2026

gpt-image-1-mini

gpt-image-2

11 декабря 2026

Снапшоты gpt-5-2025-08-07, o3-2025-04-16

gpt-5.6-sol

20 января 2027

gpt-audio, gpt-4o-audio, gpt-audio-mini, legacy realtime

gpt-audio-1.5, gpt-realtime-2.1

Ближе всего 26 августа, когда выключат Assistants API. Переезд на Responses плюс Conversations не механический: Threads заменяются на Conversations, Runs исчезают как сущность, логика ожидания завершения переписывается.

Как проверить свой код

Дёрните /v1/models и сверьте список с таблицей, пометив всё, что попало в правую половину календаря.

Дальше найдите в коде хардкод имён моделей. Обычно они разбросаны по конфигам, переменным окружения и паре мест, где кто-то когда-то захардкодил строку прямо в вызове. Соберите их в одно место, и на следующей волне отключений имя модели поменяется в одной строке.

Между анонсом и отключением OpenAI держит примерно полгода. Assistants API объявили устаревшим 26 августа 2025 и выключают 26 августа 2026, ровно год. Sora анонсировали 24 марта, выключают 24 сентября, шесть месяцев. На такой горизонт можно закладываться.

Новый адрес документации

Раньше она открывалась по адресу platform.openai.com/docs, теперь по developers.openai.com/api/docs. Адрес сменился 5 июня 2026, когда платформа переделала навигацию. Старые ссылки редиректят, но срабатывает это не на всех страницах.

Ещё одно место, где легко ошибиться: страница openai.com/api/pricing показывает тарифы ChatGPT Business и Enterprise, а цены API опубликованы на developers.openai.com/api/docs/pricing. Часть неверных цифр в русскоязычных статьях объясняется именно этой путаницей — мы встретили несколько материалов, где приведены тарифы подписки под видом цен API.

Что из этого стоит унести

Начинайте с Terra. Флагман нужен там, где неверный ответ стоит дороже разницы в тарифе, и таких мест в типичном продукте меньше, чем кажется.

Прайс проверяйте в день, когда считаете бюджет. За полгода цены менялись дважды, и оба раза вместе с новыми механиками: порог в 272 000 токенов и платная запись в кеш появились одновременно с удешевлением. Считать по цифрам из статьи трёхмесячной давности — значит ошибиться, и наш текст через три месяца попадёт в ту же категорию.

Новый код пишите на Responses API, а имя модели держите в конфиге и не разбрасывайте по вызовам.

Календарь отключений повесьте в трекер и заглядывайте на страницу deprecations раз в квартал. Ближайшая дата — 26 августа, дальше до конца года ещё пять.

За 2026 год OpenAI выключила или назначила к выключению DALL·E, Sora, Assistants API, Agent Builder, всё поколение GPT-4 и часть GPT-5. Судя по темпу, в 2027-м история повторится, и разница будет только в том, сколько мест в коде придётся править.

С вопросами, которых нет в статье, пишите в наш чат — разбираем ежедневно.

Комментарии (0)