Responses API OpenAI начал тормозить — митигация применена, мониторинг продолжается
OpenAI подтвердила повышенную задержку в Responses API. Митигация применена, идёт мониторинг восстановления. Что делать разработчикам прямо сейчас.
OpenAI зафиксировала повышенную задержку в Responses API. Инцидент открыт 1 сентября 2026 года. Если ваши приложения работают через этот эндпоинт (endpoint — точка подключения к API) и запросы внезапно стали медленнее, это не ваш код.
Что случилось
Статус-страница OpenAI сообщает: в Responses API выявлена проблема, вызывающая повышенную задержку для части запросов. Команда применила митигацию (временное исправление, стабилизирующее систему) и перешла в режим мониторинга восстановления. Компонент по-прежнему помечен как «Degraded performance» — деградированная производительность.
Технических деталей о причине сбоя в публичном статусе нет. OpenAI ограничилась формулировкой «identified an issue» без уточнений.
Кого задело
Под ударом — все, кто использует Responses API напрямую. Это разработчики, которые перешли с Chat Completions на новый эндпоинт: он появился как более функциональная замена с поддержкой хранения истории диалога и встроенных инструментов.
Проблема не новая: сообщество OpenAI и GitHub-тред к библиотеке openai-python фиксировали повышенную задержку Responses API и до этого инцидента. Статистика из обсуждений показывает: средняя задержка Responses API при включённом хранении истории (store: true) составляла около 4,3 секунды против 1,4 секунды у Chat Completions. Сегодняшний инцидент — поверх этого фонового замедления.
Что можно сделать прямо сейчас
Официальных обходных путей в статусе нет. Но исходя из того, что зафиксировано в источнике и публичных обсуждениях:
Следить за статусом. Актуальная страница инцидента: https://status.openai.com. Там же можно подписаться на обновления по email или через webhook.
Временно переключиться на Chat Completions. Если задержка критична для вашего сценария, Chat Completions эндпоинт исторически показывает более предсказуемое время ответа. Переход потребует небольшой правки кода, но API совместим по структуре.
Если используете Azure OpenAI. В обсуждениях Microsoft Q&A упоминается, что очереди запросов в Responses API можно укоротить через увеличение квоты, выделенный деплой или переход на Provisioned Throughput Units (PTU) — режим с предсказуемой пропускной способностью. Это не лечит текущий инцидент, но снижает чувствительность к пикам нагрузки в будущем.
Чего мы не знаем
OpenAI не сообщила:
- что именно вызвало повышенную задержку;
- какой процент запросов затронут;
- когда ожидается полное восстановление.
Статус «Monitoring» означает, что инцидент не закрыт. Следите за обновлениями на странице статуса — они появляются там раньше, чем в официальных каналах.
Источники
Читайте также
550 000 чиновников, одна база знаний: как Polimill сделала AI-инфраструктуру для японских муниципалитетов
01.09.2026
OpenAI готовит вечно работающего Codex — вот как подготовить свои проекты к автономным агентам
30.08.2026
1200 ИИ-агентов OpenAI две недели вели тайную переписку и сами взломали Hugging Face
27.08.2026
Комментарии
Пока никто не написал. Будьте первым.