# Responses API OpenAI начал тормозить — митигация применена, мониторинг продолжается
Каноническая страница: https://plainews.ru/posts/openai-responses-api-elevated-latency-incident
Опубликовано: 2026-09-01T14:00:50.736Z

OpenAI подтвердила повышенную задержку в Responses API. Митигация применена, идёт мониторинг восстановления. Что делать разработчикам прямо сейчас.
OpenAI зафиксировала повышенную задержку в Responses API. Инцидент открыт 1 сентября 2026 года. Если ваши приложения работают через этот эндпоинт (endpoint — точка подключения к API) и запросы внезапно стали медленнее, это не ваш код.

## Что случилось

Статус-страница OpenAI сообщает: в Responses API выявлена проблема, вызывающая повышенную задержку для части запросов. Команда применила митигацию (временное исправление, стабилизирующее систему) и перешла в режим мониторинга восстановления. Компонент по-прежнему помечен как «Degraded performance» — деградированная производительность.

Технических деталей о причине сбоя в публичном статусе нет. OpenAI ограничилась формулировкой «identified an issue» без уточнений.

## Кого задело

Под ударом — все, кто использует Responses API напрямую. Это разработчики, которые перешли с Chat Completions на новый эндпоинт: он появился как более функциональная замена с поддержкой хранения истории диалога и встроенных инструментов.

Проблема не новая: сообщество OpenAI и GitHub-тред к библиотеке openai-python фиксировали повышенную задержку Responses API и до этого инцидента. Статистика из обсуждений показывает: средняя задержка Responses API при включённом хранении истории (store: true) составляла около 4,3 секунды против 1,4 секунды у Chat Completions. Сегодняшний инцидент — поверх этого фонового замедления.

## Что можно сделать прямо сейчас

Официальных обходных путей в статусе нет. Но исходя из того, что зафиксировано в источнике и публичных обсуждениях:

**Следить за статусом.** Актуальная страница инцидента: https://status.openai.com. Там же можно подписаться на обновления по email или через webhook.

**Временно переключиться на Chat Completions.** Если задержка критична для вашего сценария, Chat Completions эндпоинт исторически показывает более предсказуемое время ответа. Переход потребует небольшой правки кода, но API совместим по структуре.

**Если используете Azure OpenAI.** В обсуждениях Microsoft Q&A упоминается, что очереди запросов в Responses API можно укоротить через увеличение квоты, выделенный деплой или переход на Provisioned Throughput Units (PTU) — режим с предсказуемой пропускной способностью. Это не лечит текущий инцидент, но снижает чувствительность к пикам нагрузки в будущем.

## Чего мы не знаем

OpenAI не сообщила:

- что именно вызвало повышенную задержку;
- какой процент запросов затронут;
- когда ожидается полное восстановление.

Статус «Monitoring» означает, что инцидент не закрыт. Следите за обновлениями на странице статуса — они появляются там раньше, чем в официальных каналах.

## Источники

- OpenAI Status: Elevated latency in the Responses API
