Qwen
Новости и гайды про модели Qwen.
- 27.08.2026
Qwen3.8-Flash-Next: превью архитектуры Qwen4 своими руками
Как запустить Qwen3.8-Flash-Next локально: MoE-архитектура с 125 млрд параметров, но 6 активных, квантованные веса от Unsloth и тест на DGX Spark.
26.08.2026Локальный русский чат на 8 ГБ: 27B проиграла модели вдвое меньше
На RTX 3060 Ti прогнали шесть локальных моделей: 10 простых реплик, 16 клубных сценариев, холодный старт и лог чата. Ternary-Bonsai 27B Q2 заняла всю карту и путала языки; T-lite-it-2.1 на 8B отвечала за 0.5 с и выиграла падежи.
20.08.2026Как запустить Qwen Code: установка CLI, /auth и первый дифф
Реальные команды с документации Qwen Code: standalone-скрипт, npm, вход через ModelStudio. Это не чат Qwen в браузере.
19.08.2026Как запустить Qwen локально: пошаговая инструкция
Рассказываем, как запустить Qwen локально на своём компьютере или сервере — через Ollama, vLLM или opencode, и каких ошибок избежать новичку.
17.08.2026Qwen 3.8 27B: как запустить локально и не утонуть в рассуждениях
Qwen 3.8 27B — мощная мультимодальная модель на 27 млрд параметров с Apache 2-лицензией. Как настроить inference, избежать перерасхода токенов и получить быстрый результат без 20-минутных размышлений
16.08.2026Qwen 3.8 27B: запускаем на одной видеокарте за 10 минут — даже на RTX 3090
Новая модель Qwen 3.8 27B работает быстрее Opus, понимает видео и запускается на одной видеокарте. Пошаговая инструкция для разработчиков: кванты, конфиги, скорость генерации и подводные камни
14.08.2026Qwen3.8-27B-FP8: мультимодальный монстр с FP8, который влезает на одну видеокарту
Qwen выпустила FP8-квантованную версию Qwen3.8-27B: 27 млрд параметров, понимание видео, 1M контекст и бенчмарки на уровне флагманов. Запускаем на одном GPU
03.08.2026Alibaba выпустила ИИ-модель на 2,4 триллиона параметров — и опять раздаёт веса бесплатно
Alibaba выпустила модель на 2,4 трлн параметров с открытыми весами и результатами на уровне Claude. Разбираем, что это значит для рынка ИИ
21.07.2026Каждый раз «сюрприз»: почему мир снова притворяется, что не ждал китайский ИИ
Moonshot и Alibaba выпустили модели, конкурирующие с GPT-5.6 и Claude Fable 5. Почему это никого не должно было удивить — и что это значит для индустрии.
21.07.2026Qwen и Kimi K3 в вашем стеке: что нужно знать, прежде чем переключиться
Qwen 3.8 Max и Kimi K3 дешевле западных моделей — но стоит ли их использовать? Разбираем дистилляцию, риски и как встроить китайские LLM в свой стек.
30.06.2026Ornith-1.0 бесплатно и локально: агентная модель, которая сама вызывает инструменты
Ornith-1.0 от DeepReinforce — MIT-лицензия, 4 размера от 9B до 397B, топ на SWE-Bench. Как скачать GGUF и подключить к агентному харнессу за 20 минут.
19.05.2026Qwen3.6 против Gemma4: Тестирование 6 моделей на реальных багах инфраструктуры
Сравнили 6 топовых моделей (Qwen, Gemma) на реальных багах FastAPI и Nginx. Узнайте, какой AI-агент выбрать для продакшена.