Саймон Уиллисон, один из самых внимательных наблюдателей за LLM-экосистемой, выступил с закрытым докладом на WeAreDevelopers World Congress North America в Сан-Хосе 27 сентября 2026 года. Он собрал всё, что произошло с языковыми моделями за этот год, в одну хронологию — от ноября 2025-го до осени 2026-го. Ниже — пересказ ключевых тезисов.

Ноябрь 2025-го: две модели, которые пересекли невидимую черту

В ноябре 2025 года вышли Claude Opus 4.5 и GPT-5.1. По словам Уиллисона, оба релиза были инкрементальными улучшениями — ничего революционного на бумаге. Но именно с этими моделями кодинг-агенты Claude Code и Codex перешли из категории «часто ошибаются» в категорию «достаточно надёжны для ежедневной работы».

Это важное наблюдение: модели не обязаны совершать прорыв, чтобы изменить практику. Иногда достаточно пересечь порог надёжности — и инструмент, который раньше раздражал, становится частью рабочего процесса.

Уиллисон проверяет новые модели одним и тем же тестом: просит сгенерировать SVG с пеликаном на велосипеде. По его словам, это «вероятно, самый глупый бенчмарк в мире», но он показателен — нарисовать велосипед сложно, пеликана сложно, а их комбинация физически невозможна. В ноябре 2025-го Claude всё ещё не справлялся с велосипедом. GPT-5.1 — тоже не особо.

Январь 2026-го: «ИИ-мания» и проекты ради проектов

После декабрьских праздников, когда разработчики успели поэкспериментировать с новыми моделями в спокойной обстановке, в январе началось что-то похожее на коллективное осознание: агенты умеют больше, чем казалось.

Уиллисон описывает собственное состояние в январе как «AI mania» — не то же самое, что «AI psychosis», уточняет он. Mania проявляется иначе: любое время, когда агент ничего не строит, кажется потраченным впустую. Он не спал, потому что мог оставить агентов работать ночью. В итоге он собрал интерпретатор JavaScript на Python (портировал MicroQuickJS Фабриса Беллара) и среду выполнения WebAssembly тоже на Python.

Из этого получился один артефакт, которым он доволен: страница-демо, где JavaScript-интерпретатор на Python работает через Pyodide (Python, скомпилированный в WebAssembly), который работает в браузере на JavaScript. «Красивый стек ужасов», по его словам.

Предсказания на год: что сбылось, что нет

В январе Уиллисон участвовал в подкасте Oxide and Friends с Брайаном Кантриллом и Адамом Левенталем, где давал прогнозы на 2026 год. С его слов, прогнозы оказались слишком осторожными.

Он предсказал, что станет «неоспоримым фактом» то, что LLM пишут хороший код. По его оценке на момент доклада — это уже произошло. Он предсказал решение проблемы sandboxing (изолированного выполнения кода агентами). Около 40 из 277 сессий на конференции так или иначе касались sandboxing или безопасности агентов — усилий много, но решения пока нет.

Он также предсказал «Challenger disaster» для кодинг-агентов — инцидент, когда агент будет взломан и нанесёт реальный экономический ущерб. По его словам, шума вокруг безопасности агентов в 2026 году было много, но именно такого сценария не случилось.

ПрогнозСтатус на сентябрь 2026
LLM пишут хороший код — станет очевиднымСбылось
Решение проблемы sandboxingВ процессе, 40 сессий на конференции
«Challenger disaster» для агентовНе случилось
Папа Римский выскажется об экономическом влиянии LLMШуточный прогноз

«Deep Blue» — термин для нового профессионального кризиса

На том же подкасте Адам Левенталь предложил термин, который Уиллисон считает одним из главных концептов года: Deep Blue — «то чувство ИИ-индуцированной тоски, когда разработчики становятся вялыми, потому что ИИ может сделать всё».

Уиллисон говорит, что за всю карьеру у него не было года, когда всё менялось бы так быстро и так радикально. Несколько докладчиков на конференции затронули эту тему. Для него 2026-й — это во многом год попытки осмыслить, что происходит с профессией.

Что осталось за кадром

Текст доклада обрывается на упоминании репозитория «Warelay» на GitHub — первый коммит появился в ноябре 2025-го, и Уиллисон обещал вернуться к нему позже в презентации. Что именно это за проект и чем закончилась история — в доступном фрагменте источника не раскрыто.

Также не раскрыты: конкретные бенчмарки моделей, детали архитектуры Claude Opus 4.5 и GPT-5.1, коммерческие условия доступа. Доклад построен на личном опыте и наблюдениях одного разработчика — это ценный взгляд изнутри, но не системное исследование.

Видео доклада опубликовано на YouTube, аннотированные слайды — на сайте Уиллисона.

Источники