simon-willison
Новости и гайды про simon-willison. Не отдельная рубрика: фильтр по теме поверх ленты.
- 04.09.2026
Блог OpenAI упал после анонса GPT-6 Astra — читаем через зеркало
Официальная страница с деталями новой модели GPT-6 Astra выдаёт 500-ошибку. Саймон Уиллисон нашёл зеркало — делимся ссылкой и первыми фактами о релизе.
03.09.2026llm-gemini 0.34: подключаем Gemini 3.8 Flash с тремя уровнями «мышления» за 13 секунд
Вышел llm-gemini 0.34 с поддержкой Gemini 3.8 Flash и тремя уровнями thinking. Показываем, как установить, настроить и выбрать нужный уровень.
02.09.2026Инструмент для доступа к Claude не показывал ход рассуждений модели — баг нашли и починили
Инструмент для работы с Claude API не записывал следы рассуждений модели. Саймон Уиллисон нашёл и исправил проблему перед тестами Fable 5.1.
- 02.09.2026
ChatGPT десктоп втихую ставит LibreOffice на 1,7 ГБ — зачем и как это работает
Десктопное приложение ChatGPT (бывший Codex) прячет в кэше 1,7 ГБ: Python, Node.js, Git и полный LibreOffice. Разбираемся, зачем OpenAI это нужно и что там внутри.
02.09.2026Vibe coding 180 000 строк: как Claude пересобрал Direct2D для Paint.NET на Linux
Создатель Paint.NET доверил Claude переписать Direct2D для WINE — 180 000 строк без ревью. Разбираем, что сработало, а что пришлось контролировать вручную.
31.08.2026ChatGPT Work: разбираем режим OpenAI, который сложнее, чем кажется
Разбираемся, чем ChatGPT Work отличается от обычного чата: код с доступом в интернет, headless Chrome, персистентные файлы и модели Sol, Luna, Terra
- 30.08.2026
Hy4 от Tencent весит 1,56 ТБ на диске: разбираемся, как включать и выключать её «мышление»
Tencent выпустила open-weight модель Hy4 на 770 млрд параметров. Разбираем chat-шаблон, режимы reasoning_effort и как её протестировать через OpenRouter.
- 29.08.2026
От слуха о баге до эксплойта — 10 минут: как ИИ-агенты ломают старые правила disclosure
ИИ-агенты сканируют публичные репозитории и находят эксплойты за минуты после намёка на баг. Как мейнтейнерам пересобрать процесс disclosure в 2026 году.
- 27.08.2026
Qwen3.8-Flash-Next: превью архитектуры Qwen4 своими руками
Как запустить Qwen3.8-Flash-Next локально: MoE-архитектура с 125 млрд параметров, но 6 активных, квантованные веса от Unsloth и тест на DGX Spark.
- 25.08.2026
Anthropic обновил Python SDK до v1.0 и сломал совместимость — как обновиться за 10 минут через Claude Code
Anthropic выпустил Python SDK v1.0 с breaking change — httpx заменили на httpx2. Разбираем, как обновить llm-anthropic и провести миграцию через Claude Code.
24.08.2026Opus 5 не взлетел: как выбрать модель Claude по цене, а не по хайпу
Anthropic зарабатывает $65 млрд в год, но разработчики держатся за Opus 4.8. Разбираем данные Ramp AI Index и даём алгоритм выбора модели Claude под бюджет.
22.08.2026Никакого сбоя нет: разработчик Galactic Compass рассказал, как ChatGPT научил его кватернионам
Обновление: источник не описывает сбой сервиса. Разработчик Мэтт Уэбб рассказал, как ChatGPT помог ему разобраться в кватернионах для приложения Galactic Compass.
22.08.2026Bun 1.4 научился управлять браузером из коробки — тест показал 256 МБ на контейнер
Bun 1.4 переписали на Rust и добавили Bun.WebView для браузерной автоматизации. Разбираем, как собрать JSON API вроде shot-scraper и сколько памяти это съест.
21.08.2026ChatGPT тихо поменял логику поиска: доля запросов с site: выросла в 40 раз
Доля запросов с оператором site: в ChatGPT выросла в 40 раз после обновления GPT-5.6. Разбираем, что это значит для SEO и GEO-стратегии сайта.
19.08.2026Mojo🔥 стал open source: что изменилось для разработчиков после релиза 1.0
Modular открыла компилятор Mojo под Apache 2.0 после трёх лет обещаний. Разбираемся, что внутри релиза и как попробовать язык для GPU-кода.
17.08.2026Qwen 3.8 27B: как запустить локально и не утонуть в рассуждениях
Qwen 3.8 27B — мощная мультимодальная модель на 27 млрд параметров с Apache 2-лицензией. Как настроить inference, избежать перерасхода токенов и получить быстрый результат без 20-минутных размышлений
14.08.2026Gemini 3.7 Flash в терминале: запускаем ИИ-модели Google без браузера
Установите плагин llm-gemini 0.33, подключите новые модели Gemini 3.7 Flash и встраивания, запускайте задачи с трассировкой рассуждений и серверными инструментами — пошаговый гайд
13.08.2026$0,43 за миллион токенов и контекст в 1M: пошаговый гайд по DeepSeek V4 Pro 0813
Разбор модели DeepSeek V4 Pro 0813: цены, контекст 1M, режимы reasoning и пошаговый код подключения через Python и OpenRouter.
12.08.2026Как мы украли цепочки рассуждений у GPT-5 и Claude — и что нашли внутри
Исследователи взломали шифрование reasoning traces в API OpenAI, Anthropic и Google. Рассказываем, как работала атака, какие модели были уязвимы и как защититься от подобных утечек
11.08.2026Meta вернулась в open weights с Muse Glimmer: ставим локального агента на 30B параметрах
Meta выпустила Muse Glimmer — открытую 30B модель под Apache 2.0. Разбираем, как запустить её локально через LM Studio и проверить на агентных задачах.
10.08.2026Claude Opus 5 официально «признаётся» в собственной приостановке — вот как это устроено в системном промпте
Разбираем фрагмент системного промпта Claude Opus 5 про экспортные ограничения — и что этот приём даёт разработчикам, встраивающим Claude в продукты
08.08.2026Один и тот же промпт скормили двум ИИ-агентам — вот что получилось у GPT-5.6 Sol Ultra
Разработчик прогнал один и тот же промпт через Claude Code и Codex с GPT-5.6 Sol Ultra — и получил принципиально разные игры с одинаковым багом.
07.08.2026Claude Fable 5 построила 3D-игру про енотов-грабителей по одному промпту — вот как это устроено
Саймон Уиллисон доверил Claude Fable 5 старый твит с концептом игры про енотов-грабителей — и получил рабочую 3D-игру. Разбираем его метод и промпт.
06.08.2026Meta выпустила терминального coding-агента: платите в 12 раз меньше, если разрешите тренировать модель на своём коде
Meta выпустила терминального coding-агента Muse Code на модели Muse Spark 1.2. Разбираем архитектуру, два model ID с разной ценой и как выбрать между приватностью и скидкой 92%.
05.08.2026LLM 0.32: как консольный инструмент Саймона Уиллисона превратился в агентный фреймворк
Simon Willison выпустил LLM 0.32 с reasoning traces, server-side тулами OpenAI и Anthropic, новым Python API и content-addressable логами. Как обновиться и что попробовать.
04.08.2026Open source обещал свободу менять код. ИИ наконец сделал это реальным
Саймон Уиллисон показал: Claude Code и Codex убрали главный барьер open source — время на сборку и чтение чужого кода. Разбираем рабочий процесс.
03.08.2026OpenAI решила 10 математических задач за $2000 каждая: как проверить результат самому
OpenAI потратила меньше $2000 на модель Astra и решила 10 нерешаемых десять лет задач. Разбираем, что реально проверяемо, а что на словах.
02.08.2026Три письма об ИИ за одну неделю: как читать войну между открытыми и закрытыми моделями
Microsoft, Anthropic и 1324 сотрудника AI-компаний выпустили три письма за неделю. Разбираем, что это значит для тех, кто строит продукты на LLM.
01.08.2026MCP 2.0 стал stateless: как теперь подключать AI к базам данных
Протокол MCP 2.0 избавился от сессий — теперь один HTTP-запрос вместо двух. Разбираем спецификацию и три готовых инструмента для работы с данными.
31.07.2026LLM 0.32rc2: как запускать промпты на любом OpenAI-совместимом API без настройки модели
Саймон Виллисон добавил в свой CLI-инструмент команду для тестирования любых OpenAI-совместимых эндпоинтов без конфигов. Разбираем новую версию и смену дефолтной модели.
28.07.2026Kimi K3: 2,8 трлн параметров, 1,56 ТБ весов и лицензия с сюрпризом
Moonshot выложила веса Kimi K3 — первой открытой модели класса 3T. Разбираем архитектуру, лицензионные ограничения и где уже можно запустить.
25.07.2026Claude Opus 5 возглавил рейтинг Artificial Analysis и стоит вдвое дешевле Fable 5
Anthropic выпустила Claude Opus 5 — модель сама пишет компьютерное зрение, чтобы решить задачу. Разбираем цену, возможности и где она обходит конкурентов.
22.07.2026Команда Claude Code пишет 65% фичей через ИИ-агента в Slack — вот как изменилась их работа
Разработчики Anthropic отказались от ручного ревью, сократили промпт на 80% и доказали: рефакторинг больше не зло. Как они работают с Claude Code и что изменилось за год.
21.07.2026Qwen и Kimi K3 в вашем стеке: что нужно знать, прежде чем переключиться
Qwen 3.8 Max и Kimi K3 дешевле западных моделей — но стоит ли их использовать? Разбираем дистилляцию, риски и как встроить китайские LLM в свой стек.
20.07.2026OpenAI хотела выпустить open-source GPT-3 в 2022 году — что говорит письмо Альтмана
Внутреннее письмо Сэма Альтмана от октября 2022: OpenAI планировала выпустить локальную модель уровня GPT-3, чтобы обогнать Stability AI и закрыть рынок для конкурентов.
18.07.2026Mira Murati выпустила свою первую open-weights модель — вот что она умеет
Thinking Machines Lab выпустила Inkling — 975B параметров, Apache-2.0, мультимодальность из коробки. Разбираем архитектуру и первые тесты с API.
16.07.2026xAI открыла код Grok Build после скандала с утечкой данных
xAI выложила 844 тысячи строк Rust-кода агента Grok Build на GitHub после того, как инструмент загрузил SSH-ключи и пароли пользователей в облако
15.07.2026Как создать анимированного питомца в Codex Desktop за 10 минут
Разработчик Simon Willison показал, как GPT-5.6 Sol генерирует спрайты для кастомных питомцев в Codex. Разбираем промпты и воссоздаём процесс.
14.07.2026Запустил DOOM на SQLite через Python — вот как это работает
Питер Гостев собрал Doom-like шутер на чистом SQL с помощью GPT-5.6 Sol. Движок, рендер, коллизии — всё внутри SQLite. Показываю, как запустить и подключить визуализацию через Datasette.
13.07.2026Anthropic снова продлила Fable 5 — пока OpenAI держит GPT-5.6 без ограничений
Anthropic в третий раз продлевает доступ к Fable 5 в платных планах. OpenAI уверенно держит GPT-5.6 Sol без лимитов. Разбираем, что происходит с доступом к топовым моделям.
12.07.20264.1. Как заставить sqlite-utils писать и чинить базу данных, используя чистый Python-код
Обзор изменений в sqlite-utils 4.1. Научитесь вставлять данные через Python-код, контролировать типы и управлять режимом STRICT.
10.07.2026Meta AI API: Как подключить llm-meta-ai и заставить Meta-модели работать в вашем проекте
Интегрируйте Meta AI в рабочий процесс разработчика с помощью плагина llm-meta-ai. Пошаговый гайд по настройке и запуску модели muse-spark-1.1.
09.07.2026GPT-Live: Как использовать голосовой AI для сложных задач и мозгового штурма
GPT-Live от OpenAI — новый голосовой режим, который решает проблему прерываний и справляется с глубоким рассуждением. Гайд для разработчиков.
08.07.2026Как управлять схемой SQLite в Python: гайд по миграциям с sqlite-utils 4.0
Узнайте, как реализовать систему миграций схем SQLite в Python с помощью sqlite-utils 4.0. Пошаговый гайд для разработчиков.
07.07.2026Tencent выпустила Hy3: 295B параметров, контекст 256K — и бесплатный доступ до 21 июля
Tencent выпустила Hy3 — 295B MoE-модель с 21B активных параметров и контекстом 256K. Как попробовать бесплатно до 21 июля и что умеет модель.
06.07.2026$149 и 37 промптов: как Саймон Уиллисон отдал финальный релиз sqlite-utils на откуп Claude Fable
Саймон Уиллисон выпустил sqlite-utils 4.0rc2 с помощью Claude Fable — 37 промптов, 34 коммита, критический баг с потерей данных. Разбираем процесс по шагам.
05.07.2026421 open source AI-инструмент в одной карте — как читать и использовать Gap Map от Current AI
Current AI выпустила карту пробелов open source AI: 421 продукт, 85 моделей, 50 датасетов. Как читать карту и работать с сырыми данными на GitHub.
03.07.2026Саймон Уиллисон собрал coding agent за два промпта — и выложил его на PyPI
Саймон Уиллисон выпустил llm-coding-agent 0.1a0 — coding agent на Python поверх LLM-фреймворка. Как установить, запустить и что внутри инструмента.
01.07.2026Пусть агент сам снимет демо: shot-scraper video в деле
shot-scraper 1.10 добавил команду video — агент пишет storyboard.yml и записывает демо через Playwright. Пошаговый гайд с примером конфига.
30.06.2026Ornith-1.0 бесплатно и локально: агентная модель, которая сама вызывает инструменты
Ornith-1.0 от DeepReinforce — MIT-лицензия, 4 размера от 9B до 397B, топ на SWE-Bench. Как скачать GGUF и подключить к агентному харнессу за 20 минут.