deepseek
Новости и гайды про deepseek. Не отдельная рубрика: фильтр по теме поверх ленты.
11.09.2026DeepSeek V4.1-Flash вышел с KV-кэшем в 437 раз меньше первой версии — и бьёт Opus 5 на коде
DeepSeek выпустил V4.1-Flash — модель на 552 млрд параметров с новой архитектурой, которая режет память для ИИ-агентов в 4 раза. Разбираем, что внутри и кому это нужно.
01.09.2026DeepSeek-V4-Flash-Vision-Exp вышла с MIT-лицензией — первая мультимодальная модель в линейке V4
DeepSeek выпустил первую мультимодальную модель в линейке V4-Flash. Разбираем архитектуру, бенчмарки и команды запуска через vLLM и SGLang.
- 29.08.2026
Кеш промптов LLM: как одна строка ломает экономию на 98%
Почему кеширование промптов у DeepSeek, OpenAI и Anthropic отключается незаметно и как найти виновника с помощью инструмента prefixcash за пять минут.
23.08.2026Голая модель не умеет в security: как собрать харнесс, который реально тестирует ИИ на уязвимости
Почему голая языковая модель не годится для тестов безопасности ИИ и как собрать харнесс на Hermes и DeepSeek, который реально воспроизводит атаки.
13.08.2026DeepSeek-V4-Pro-0813: официальный релиз флагмана с DSpark-декодированием
Разбор релиза DeepSeek-V4-Pro-0813: DSpark-декодирование, бенчмарки, лицензия MIT и команды запуска на vLLM и SGLang.
13.08.2026$0,43 за миллион токенов и контекст в 1M: пошаговый гайд по DeepSeek V4 Pro 0813
Разбор модели DeepSeek V4 Pro 0813: цены, контекст 1M, режимы reasoning и пошаговый код подключения через Python и OpenRouter.
31.07.2026DeepSeek выпустил V4-Flash-0731 — агентная модель обошла собственный V4-Pro на бенчмарках
DeepSeek выпустил официальную версию V4-Flash с усиленными агентными способностями. Модель обгоняет V4-Pro на кодогенерации и работает с контекстом в 1 млн токенов.
24.07.2026Poolside выпустила Laguna S 2.1 — первую крупную открытую модель США за 11 месяцев
Poolside выпустила Laguna S 2.1 — открытую MoE-модель на 118 млрд параметров, которая обходит конкурентов в 10 раз крупнее. Разбираем архитектуру и где взять веса.
21.07.2026Каждый раз «сюрприз»: почему мир снова притворяется, что не ждал китайский ИИ
Moonshot и Alibaba выпустили модели, конкурирующие с GPT-5.6 и Claude Fable 5. Почему это никого не должно было удивить — и что это значит для индустрии.
19.07.2026Kimi K3 обвалил Nasdaq на 1%: почему новая китайская модель напугала Кремниевую долину
Moonshot AI выпустила открытую модель Kimi K3, сопоставимую с GPT-5 и Claude. Инвесторы распродают акции Nvidia, а чиновники Трампа требуют регуляций.
- 08.06.2026
Токены съедают бюджет: 12 приёмов, которые реально работают
Три года вайбкодинга — и вот конкретные приёмы: бесплатные модели, раздельные контексты, английский в правилах. Сокращаем счёт за ИИ без потери качества.