habr-ml
Новости и гайды про habr-ml. Не отдельная рубрика: фильтр по теме поверх ленты.
- 09.09.2026
LLM-пайплайн два месяца в проде: 6 мест, где всё сломалось — и ни одно не в промпте
Два месяца в проде, 4 452 закупки, почти 300 инцидентов в журнале — где реально ломается LLM-пайплайн и как это чинить без переписывания промптов.
- 08.09.2026
Как отучить LLM врать уверенным тоном: тест и приёмы против галлюцинаций
Gemini придумал несуществующий протокол ЮНЕСКО за 20 секунд. Разбираем, почему LLM галлюцинирует под давлением, и даём рабочий чек-лист проверки промптов.
- 03.09.2026
Контент бесплатный, ИИ объясняет — так за что вообще платить в ML-образовании
Контент бесплатный, ИИ объясняет — тогда за что платить в Data Science? Разбираем, что реально дефицитно и как собрать траекторию без переплат.
- 28.08.2026
[Перевод] Конец программирования
Источник — это не сбой сервиса. Это колонка/мнение разработчика о будущем программирования (перевод статьи Paul Dix про Bun 1.4 и ИИ агентов). Здесь нет: упавше
28.08.2026180 млрд параметров на обычном SSD: как устроена архитектура Qwen 4
Alibaba раскрыла архитектуру Qwen 4 через модель Qwen3.8-Flash-Next: 180B параметров, 6B активных, офлоад в RAM и 8.6x ускорение prefill на 1M токенов.
23.08.2026Голая модель не умеет в security: как собрать харнесс, который реально тестирует ИИ на уязвимости
Почему голая языковая модель не годится для тестов безопасности ИИ и как собрать харнесс на Hermes и DeepSeek, который реально воспроизводит атаки.
30.07.2026Пожизненный бан на VC.ru за open-source статью про нейросети: разбор модерации и выбор площадок
Разработчик получил перманентный бан на VC.ru за open-source статью про нейросети на Node.js. Разбор модерации площадок и выбор платформ для технического контента.
24.07.2026Poolside выпустила Laguna S 2.1 — первую крупную открытую модель США за 11 месяцев
Poolside выпустила Laguna S 2.1 — открытую MoE-модель на 118 млрд параметров, которая обходит конкурентов в 10 раз крупнее. Разбираем архитектуру и где взять веса.
17.07.2026Moonshot выпустила Kimi K3 на 2,8 трлн параметров — как работать с крупнейшей открытой моделью
Moonshot AI выпустила крупнейшую открытую модель в истории. Разбираем архитектуру, цены, бенчмарки и как начать работать с K3 уже сегодня.
02.07.2026130М-трансформер находит пульт, полотенце и зарядку — как AIRI научила робота искать что угодно
Как 130М-трансформер OVSegDT решает open-vocabulary навигацию без глубины и одометрии — архитектура, обучение, метрики и подводные камни
- 26.06.2026
Пересадить алгоритм из маленькой модели в GPT-подобный LLM? Почему это почти невозможно
Разбираемся, можно ли "впрыснуть" логику из TinyML в GPT-подобные LLM без fine-tuning. Изучаем эксперименты с residual stream и почему это сложно.
10.06.2026PLC AI Studio без галлюцинаций: как провести ИИ через вентиляцию, ИТП и пожарку одного объекта
Как PLC AI Studio ведёт ИИ через десятки систем одного объекта: GVL, контракты интерфейсов, ко-симуляция и маршрутные окна пошагово.
03.06.2026Success rate упал с 85% до 72% — и что теперь с этим делать
Success rate упал — но почему? Разбираем 7 покомпонентных evals для AI-агента: retrieval, tool call, state drift, retry и другие. С методами и примерами.
02.06.2026Четыре LLM, один робот и пневматический пистолет: что случилось, когда ИИ вышел в физический мир
Разработчик подключил четыре LLM к настоящему роботу на Arduino и сравнил поведение. Grok зациклился, GPT скучал, Gemini молчал — вот что вышло.
26.05.2026Zero Bug Policy: Как мы сократили бэклог багов с 77 до 18 за 4 недели
Узнайте, как внедрить Zero Bug Policy в B2B финтех. Пошаговый гайд по триажированию и сокращению технического долга без срыва релизов.
- 18.05.2026
Связывание эмбеддингов: как это убивает производительность трансформеров?
<think Хорошо, мне нужно написать обзор статьи с Habr о связывании эмбеддингов и проблемах, которые это вызывает у трансформеров. Я должен начать с YAML блока S
- 10.05.2026
EICS: Новая метрика для поиска причинных ошибок в «мозгах» нейросетей
Узнайте, как новая метрика EICS позволяет находить причинные ошибки внутри нейросетей. Поймите, почему внешние методы неопределённости уже не работают.
- 10.05.2026
Как заставить LLM принимать взвешенные и обоснованные решения: универсальный фреймворк сравнения
В сфере применения больших языковых моделей (LLM) часто сталкиваются с одной фундаментальной проблемой: как заставить ИИ не просто генерировать текст, а выполнять сложные, многокритериальные вычисления и принимать взвеше…