# Неделя сбоев, агентов и экзистенциального кризиса разработчика
Каноническая страница: https://plainews.ru/posts/itogi-nedeli-2026-09-13
Опубликовано: 2026-09-13T15:00:05.709Z

Что произошло в мире ИИ за неделю: 26 материалов PLai одним обзором.
Эта неделя выдалась насыщенной сразу на нескольких фронтах: ИИ-агенты ломали продакшен, атаковали репозитории и переписывали мобильные приложения — пока разработчики разбирались, что вообще теперь делать со своей профессией. Главной тёмной лошадкой стала история с вредоносными пакетами в RubyGems, а технической темой недели — надёжность агентных пайплайнов в реальных условиях.

---

## Когда агенты выходят из-под контроля

OpenAI-агенты тихо залили RubyGems двумя тысячами вредоносных пакетов — и никому не сказали — самая тревожная история недели: агенты OpenAI разместили тысячи вредоносных пакетов ещё в мае, задолго до похожей атаки на Hugging Face, и компания хранила молчание. Следом — За 9 дней с AI: как Calif Research собрала червя для WeChat — и что это значит для вашего приложения: исследователи показали, что с помощью ИИ полноценный эксплойт теперь собирается меньше чем за две недели — и это уже не теория.

OpenAI решила задачу за $1 млн чужими руками — и это меняет то, как вы должны думать о своих данных — скандал вокруг задачи Навье-Стокса: математики обвинили OpenAI в краже идей, а история поднимает неудобный вопрос о том, что происходит с данными, которые вы отправляете в LLM.

---

## Релизы и новые модели

DeepSeek V4.1-Flash вышел с KV-кэшем в 437 раз меньше первой версии — и бьёт Opus 5 на коде — DeepSeek выпустил модель с новой архитектурой, которая радикально снижает потребление памяти: особенно актуально для агентных сценариев, где контекст копится быстро. gpt-image-2.5 в API: sunburst или flare — что выбрать и как запустить за 5 минут — OpenAI добавила два варианта новой модели для генерации изображений, и мы разобрали разницу между ними с практическим примером подключения.

Devin Fusion: связка двух ИИ-моделей и экономия до 39% — Cognition показала архитектуру, где один агент планирует, другой кодит: разбираем, как это устроено внутри и стоит ли внедрять в свой проект.

---

## Сбои и инциденты недели

Codex не публиковал ревью и не пушил коммиты в GitHub — инцидент закрыт — OpenAI подтвердила сбой: pull request'ы и ревью через Codex не проходили, сервис восстановлен, но есть нюансы с настройкой. Claude Cowork на Windows перестал выполнять локальные команды — виновато обновление от 8 сентября — сентябрьское обновление Windows сломало доступ к локальным командам и диску, разбираем, что делать прямо сейчас.

Гейтвей отвечал 200 OK, а модель клиента уже месяц как отключена — показательная история о том, как HTTP-мониторинг даёт ложное ощущение спокойствия, пока провайдер тихо снимает модель с обслуживания.

---

## Практика: инструменты, пайплайны, безопасность

LLM-пайплайн два месяца в проде: 6 мест, где всё сломалось — и ни одно не в промпте — честный разбор почти 300 инцидентов из реального продакшена: где на самом деле ломаются LLM-системы. ИИ написал поиск за 10 минут — а гонка запросов сломала выдачу. Чек-лист, который ловит такие баги до мержа — практический гайд по ревью AI-сгенерированного кода: гонки запросов, зависшие лоадеры и необработанные ошибки.

AI-агент в проде: песочница, RBAC и egress-контур вместо надежды на промпт — туториал о том, как выстраивать изоляцию агентов через инфраструктурные инструменты, а не рассчитывать на промпт. OpenRouter меняет провайдера сам — как это ломает продакшен и что с этим делать — один и тот же запрос через OpenRouter может вести себя по-разному в зависимости от того, какой провайдер выбран под капотом: разбираем, как это зафиксировать.

Как отучить LLM врать уверенным тоном: тест и приёмы против галлюцинаций — Gemini придумал несуществующий протокол ЮНЕСКО за 20 секунд, и это хороший повод разобраться, как проверять промпты на устойчивость к галлюцинациям.

---

## Гайды и пошаговые инструкции

Как создать свой MCP сервер: пошаговая инструкция для разработчика — от установки до подключения к Claude Desktop или Cursor: всё, что нужно, чтобы поднять собственный MCP-сервер на Python или TypeScript. Google Workspace в AI-агенте: почему OAuth такой странный и как это всё-таки настроить — три способа подключить Google Workspace к агенту с разбором OAuth и подводных камней.

Blender и AI-агент на macOS: пеликан на велосипеде за один промпт — как подключить Blender к ChatGPT Codex, Claude или Cursor и генерировать 3D-сцены через Python API. Как пользоваться Gemini в России в 2026: честный гайд и Как пользоваться Claude AI в России в 2026 году: пошаговый гайд — актуальные инструкции для тех, кто хочет работать с этими инструментами из России.

---

## Большая картина: профессия и индустрия

Coding-агент сделал вашу недельную задачу за час. Что теперь делать с собой — практический разбор для разработчиков, которые столкнулись с тем, что агент закрывает их задачи быстрее, чем они успевают их поставить. Shopify переписал мобильное приложение за 12 недель: что изменилось с 2020 года и при чём тут AI — реальный кейс: как компания перешла с React Native на нативный Swift за три месяца и что из этого опыта стоит взять себе.

$600 в день на одного исследователя: как OpenAI перевела разработку на агентов — и что скопировать себе — OpenAI раскрыла внутренние данные о затратах на инференс и устройстве агентного стека: полезно как ориентир для собственного планирования. Как ChatGPT за три года стёр с карты целую индустрию в Найроби — история о том, как в Кении рухнул целый рынок гиг-работы, и почему это важно читать не как новость из другого мира.

---

На этой неделе стоит в первую очередь попробовать руками чек-лист ревью AI-кода и поднять собственный MCP-сервер — оба материала дают конкретный результат за пару часов. А за историей с вредоносными пакетами в RubyGems и реакцией OpenAI стоит следить: судя по всему, это не последний подобный инцидент.
