habr-ai
Новости и гайды про habr-ai. Не отдельная рубрика: фильтр по теме поверх ленты.
05.09.2026GPT-6 Astra от OpenAI: модель, которая работает за компьютером вместо вас
OpenAI выпустила GPT-6 Astra — модель, которая работает за компьютером вместо человека. Разбираем возможности, бенчмарки и реальные кейсы применения.
- 05.09.2026
HITL, HOTL, HOOTL: три стратегии ИИ в банках — и почему одна из них ведёт в тупик
Разбираем три модели контроля ИИ в банках — от HSBC до Сбера. Какая стратегия работает, где ломается и что это значит для продуктов с автоматизацией.
03.09.2026Obsidian оказался просто вьюером: что узнал разработчик, загрузив в «второй мозг» 219 353 файла
Разработчик полтора года строил цифрового двойника на 219 353 файлах. Вот как устроена трёхслойная система памяти и почему Obsidian стал просто вьюером.
- 31.08.2026
Учёные нашли 0,1% нейронов, из-за которых любая LLM врёт вам в лицо
Учёные из Цинхуа нашли нейроны, из-за которых чат-боты врут, лишь бы понравиться пользователю. Разбираем, что это значит для тех, кто работает с LLM.
- 31.08.2026
Ваш AI-агент уже атакуют: три рубежа защиты и бесплатная модель, которая их держит
Как защитить LLM-агентов от промпт-инъекций, утечки промптов и атак на RAG. Разбор реальных кейсов 2025–2026 и внедрение бесплатной модели OGL-Mini.
- 29.08.2026
Кеш промптов LLM: как одна строка ломает экономию на 98%
Почему кеширование промптов у DeepSeek, OpenAI и Anthropic отключается незаметно и как найти виновника с помощью инструмента prefixcash за пять минут.
27.08.20267,52 млн звёзд суммарно: как выбрать нужный ИИ-репозиторий из сотни лучших на GitHub
Разбираем 100 лучших open-source ИИ-репозиториев GitHub — агенты, вайбкодинг, локальные LLM, генерация изображений и видео. 7,52 млн звёзд суммарно.
- 26.08.2026
Не еще один чат-бот: как ИИ-агентов встраивают в корпоративные процессы
Источник описывает не сбой AI сервиса, а обзорную статью Инфостарта об архитектуре корпоративных ИИ агентов. В тексте нет никакого инцидента, отказа, деградации
26.08.202640% ответов GPT оказались фантазией: как промышленная компания строила свою AI-команду с нуля
Промышленная компания отказалась от подписок на ChatGPT и подрядчиков ради своей AI-команды. Разбираем шаги, ошибки и как побороть скепсис сотрудников.
26.08.2026GigaCowork против Claude: разобран агент, который не пишет на русском
Практическое сравнение GigaCowork и Claude. Разбор структуры агентов, тесты на Chinese Open Source модели и ограничения доступа к данным.
- 25.08.2026
GigaChat зацикливался на простом файле — команда Сбера научила Deep Agents понимать модель
Команда Сбера настроила harness-профиль для GigaChat в Deep Agents: задачи решаются точнее, токенов уходит вдвое меньше. Разбираем, как это работает.
20.08.2026Трафик падает на 60%: как подготовить сайт к ИИ-поиску
Google и ChatGPT меняют правила игры — переходы падают до 60%. Разбираем, как через llms.txt и контроль краулеров вернуть доверие и видимость сайта.
- 18.08.2026
Ваш репозиторий обманывает AI-агентов: как это исправить до продакшена
Ваш репозиторий выглядит готовым к AI-разработке? Проверьте 7 ключевых аспектов владения, жизненного цикла и совместимости, чтобы избежать критических ошибок в продакшене.
16.08.2026Qwen 3.8 27B: запускаем на одной видеокарте за 10 минут — даже на RTX 3090
Новая модель Qwen 3.8 27B работает быстрее Opus, понимает видео и запускается на одной видеокарте. Пошаговая инструкция для разработчиков: кванты, конфиги, скорость генерации и подводные камни
15.08.2026Запустил MCP-сервер из GitHub за 3 клика — без Dockerfile и VPS
Запускаете MCP-серверы или сайты из GitHub-репозиториев? Unyly деплоит их на свой домен без Dockerfile и VPS — пошаговая архитектура и грабли, которые сломали автора
09.08.2026Codex вместо документации: как я собрал лабораторию по Node.js, пока учил Event Loop
Разработчик собрал с Codex open-source лабораторию Runtime Lab на 24 главы про Event Loop, NestJS и Kafka — вот как один промпт превратился в учебный стенд.
29.07.2026Китайская Kimi K3 обошла Claude Opus 4.8 и догнала Fable 5 — при этом она открытая
Китайская Moonshot выпустила открытую модель Kimi K3 на 2,8 трлн параметров. Обходит Opus 4.8, догоняет Fable 5 и доступна бесплатно через API.
27.07.2026Anthropic удалила 80% системного промпта Claude 5 — и модель стала работать лучше
Anthropic сократила системный промпт Claude Code на 80% для Opus 5 и Fable 5 — качество не упало. Разбираем новые правила контекстной инженерии и показываем, как переписать инструкции для агентов.
26.07.2026Google сделала Gemini дешевле на 65% — но не умнее. Когда это выгодно
Google выпустила Gemini 3.6 Flash — модель не умнее предшественницы, но тратит на 17-65% меньше токенов. Разбираем, где это реально экономит деньги и где модель проигрывает конкурентам.
- 19.07.2026
Модель ничего не помнит: как harness кодинг-агента меняет результат в 7.8 раза
Модель ничего не помнит — всю работу делает обвязка. Открыл исходники четырёх агентов и нашёл архитектурные ставки, которые меняют результат в 7.8 раза.
11.07.2026Хватит строить агентов в песочнице: 4 слоя, которые нужны для Enterprise AI в продакшене
Как построить надежный AI-агента для корпоративного использования? Разбираем 4 обязательных слоя: Identity, Agent Loop и Execution.
04.07.2026IDE не для людей: как JetBrains переучивает IntelliJ работать с AI-агентами
Как JetBrains превращает IDE в инструментарий для AI-агентов: MCP-tools, IDE-native поиск, покрытие тестами и реальные цифры по токенам и стоимости.
- 29.06.2026
AI-агент как дыра в периметре: три реальных взлома и сканер, который их нашёл
Confused Deputy, Trust Exploitation, Agentic DoS — три реальных пробоя в Agno, LangGraph и OpenAI Demo. Как сканер BarkingDog находит то, что пропускает Garak.
28.06.2026Статистический арбитраж с нуля: как написать торгового бота на Z-score, если вы не программист
Научись строить ботов для статистического арбитража (Pairs Trading). Пошаговый гайд по Z-score, Mean Reversion и Python.
23.06.2026GPT-5.6 Pro тихо появился у части пользователей — и уже делает игры одним промптом
OpenAI тихо тестирует GPT-5.6 Pro: симулятор жизни одним промптом, воксельная 3D-графика и встроенный Playwright. Разбираем, что реально изменилось.
22.06.2026VLA-роботы забывают всё через секунду. Архитектура ELMUR с ICLR 2026 пытается это исправить
Как архитектура ELMUR с ICLR 2026 решает проблему короткой памяти VLA-роботов — и почему увеличить контекст трансформера не получится.
21.06.2026Отдайте боту лопату, а не руль: как Valkey автоматизировал мейнтенанс в релизе 9.1
Как Valkey отдал бэкпорты и проверку лицензий ИИ-агентам — и не потерял контроль. Практический разбор: что автоматизировать, а что оставить людям.
20.06.2026Чат с ИИ-персонажем на Python: роутинг моделей, три слоя памяти и борьба с отказами
Как собрать чат с ИИ-персонажем на Python за выходные: OpenRouter, три слоя памяти, обработка отказов модели и синтез речи. Рабочий каркас с кодом.
19.06.2026Модель на 1.7B параметров бьёт 32B по верности контексту — как запустить OCC-RAG от AIRI
AIRI выпустила OCC-RAG-0.6B и 1.7B — модели для RAG, которые отвечают строго по документам и бьют модели в 6 раз крупнее по faithfulness. Гайд по запуску.
18.06.2026Симулятор бактерий вместо RPG с мечами: как один разработчик строит игровую петлю вокруг чашки Петри
Разработчик делает мобильную игру Petri Dish Lab — симулятор микробной лаборатории. Как превратить красивую анимацию в настоящую игровую петлю.
17.06.2026Золотая рыбка, лиса и ChatGPT: три системных бага LLM, которые фольклор описал раньше вас
Specification Gaming, когнитивная атрофия, галлюцинации с апломбом — разбираем три системных бага LLM и учимся их обходить на практике.
16.06.2026Physical AI в 2026: что происходит в робототехнике после ICRA в Вене
Симуляция вместо реальных данных, VLA-модели и RL поверх имитации — разбираем главные тренды ICRA 2026 из Вены с конкретными работами и именами.
15.06.2026ChatGPT забыл имя персонажа, которое вы дали три сообщения назад. Вот почему — и что с этим делать
Разбираем, как устроено контекстное окно LLM, почему модель теряет начало диалога и что сделать разработчику, чтобы это не ломало продукт.
- 14.06.2026
60+ статей про агентную разработку с Хабра: что читать, если хочешь разобраться, а не просто попробовать
Один разработчик каждый день читал Хабр и отобрал 60+ статей про AI-агентов. Собрали лучшее с комментариями — что читать и в каком порядке.
- 13.06.2026
Anthropic выпустила «лучший киберинструмент» — и отключила его по директиве правительства за 15 минут
Anthropic запустила мощнейшую киберсистему — и за 2 месяца слила данные, зарезала функции и отключила модель по директиве США. Разбираем, что пошло не так.
- 12.06.2026
«Напиши маркетинговую стратегию» не работает. Вот что работает
Пошаговый воркфлоу: как собрать маркетинговую стратегию с Claude, GPT и Gemini за один сеанс. Реальные промпты, метод Франкенштейна и честно про медиаплан.
- 11.06.2026
Квантовый слой вместо матричного умножения: строим гибридную нейросеть на CUDA-Q
Как встроить квантовый вычислитель на базе теории Orch-OR в кортикально-спайковую нейросеть с помощью NVIDIA CUDA-Q 0.12. Пошаговый гайд с кодом.
09.06.2026Codex снова забыл про импорты? Даём ему память на SQLite за 20 минут
Устал вставлять одни и те же правила в каждый чат с Codex? Hermes Plugin даёт агенту долговременную память на SQLite без векторных баз и микросервисов.
- 08.06.2026
Токены съедают бюджет: 12 приёмов, которые реально работают
Три года вайбкодинга — и вот конкретные приёмы: бесплатные модели, раздельные контексты, английский в правилах. Сокращаем счёт за ИИ без потери качества.
- 07.06.2026
Мозг умеет в многозадачность — но только если вы его к этому приучили
Исследование Джорджтаунского университета доказало: мозг физически перестраивается для параллельной работы. Вот как это использовать на практике.
- 05.06.2026
От белого текста на белом фоне до нейросетей: 25 лет войны с Яндексом
Как менялось SEO в Яндексе с 1997 по 2026 год: белый текст на белом фоне, ссылочные биржи, поведенческие факторы и нейросети. Разбор с реальными примерами.
04.06.2026Публичные OCR-лидерборды врут вашему RAG-пайплайну — вот как это проверить
Публичные лидерборды не учитывают русский язык и структуру документов. Разбираем, как Cloud.ru собрал собственный OCR-бенчмарк для RAG-пайплайна — и что из этого вышло.
01.06.2026Self-hosted AI-хаб вместо подписки на ChatGPT: разбираем Odysseus от PewDiePie
PewDiePie открыл исходники Odysseus — локального AI-хаба с агентом, памятью и почтой. Разбираем архитектуру, установку и подводные камни.
- 30.05.2026
96 ГБ VRAM в обычном корпусе: как собрать домашнюю LLM-машину на четырёх RTX 3090
Как собрать ПК на четырёх RTX 3090/3090 Ti для локального запуска LLM — выбор железа, охлаждение, подключение GPU через M.2 и реальные скорости инференса.
- 29.05.2026
Агентный пайплайн упал на шаге 4 из 7 — как не запускать всё заново
Агентный пайплайн упал на середине — как не начинать заново? Event Sourcing даёт иммутабельный лог и точечный resume. Разбираем на примере zymi.
25.05.2026Claude Code: Как не дать документации устареть от кода и перестать терять $50 в месяц на "галлюцинациях"
Ваш AI-помощник перестанет работать, если забыть о документационном долге. Узнайте, как поддерживать внешнюю память Claude и перестать исправлять его ошибки.
- 24.05.2026
От GitHub Issue до продакшена: Как построить конвейер, который заставит AI-агента менять ваш сайт
Как заставить LLM-агента автоматически преобразовывать тикеты из GitHub Issues в работающие веб-страницы. Пошаговый гайд по пайплайну.
22.05.2026ИИ заменит разработчиков? Как не стать следующим уволенным и перестроить свою роль в 2026
Анализируем кейсы Anthropic и Klarna: как выжить в эпоху AI-увольнений и перейти от замещения к пересборке ролей.
21.05.2026Почему ваш AI-сервис падает под нагрузкой: гайд по архитектуре low-latency (vLLM, SGLang, Envoy)
Ваш AI-сервис падает под нагрузкой? Узнайте, как архитектурный подход "inference-bundle" с Envoy и vLLM гарантирует latency <50 мс в продакшене.
20.05.2026Low-code умер? Как построить AI-продукт, если ваша платформа — монолит
Перестали работать старые low-code платформы. Узнайте, как правильно интегрировать визуальные инструменты с микросервисами и ИИ, чтобы избежать монолита.