Опубликовать новость
MOEX 09:30–18:45 MSK
/главная / ИИ
ИИ · Сергей Перев · 16 апреля 2026 · 1 мин чтения · 97

Qwen3.6-35B-A3B: китайская модель с 35 млрд параметров, но всего 3 млрд активных — как это работает и почему это прорыв для ИИ

Китайская ИИ-модель Qwen3.6-35B-A3B от Alibaba бросает вызов традиционным подходам к масштабированию моделей. Вместо увеличения активных параметров разработчики сделали ставку на архитектуру Mixture of Experts (MoE), где из 35 млрд параметров задействованы всего около 3 млрд.

Это позволяет снизить вычислительные затраты в 10 раз без потери качества, что делает модель доступной даже для средних компаний. В задачах agentic coding — когда модель должна выполнять последовательные действия и планировать решения — Qwen3.6-35B-A3B демонстрирует результаты, сравнимые с моделями, у которых активных параметров в 10 раз больше. Например, она превосходит Qwen3.5-27B (dense) и предыдущую версию Qwen3.5-35B-A3B. Это особенно важно для автоматизации рабочих процессов, где требуется высокая точность и минимальные затраты на инфраструктуру.

Модель также нативно поддерживает мультимодальность: она одинаково эффективно работает с текстом и изображениями.

В бенчмарках для vision-language моделей (VLM) Qwen3.6-35B-A3B сопоставима с Claude Sonnet 4.5, а в отдельных задачах spatial reasoning превосходит его. Например, в тестах MMMU она набрала 81,7% против 79,6% у конкурентов, а в MathVista — 86,4% против 79,8%. Эти показатели делают её одной из самых универсальных моделей на рынке.

По теме: Клауд от Anthropic обходят китайские модели: как GLM 5.1 и 5.2 работают быстрее, дешевле и без…

Лицензия Apache 2.0 открывает широкие возможности для коммерческого использования без ограничений. Модель можно развернуть на собственных серверах или использовать через облачные сервисы, такие как Hugging Face или ModelScope.

Это особенно актуально для предприятий, которые хотят избежать зависимости от иностранных вендоров и сохранить контроль над данными. Эксперты отмечают, что Qwen3.6-35B-A3B — это шаг к новому поколению ИИ-моделей, где эффективность важнее размера. Архитектура MoE позволяет не только снизить затраты на вычисления, но и повысить скорость обработки запросов, что критично для реальных приложений. В условиях растущего спроса на ИИ-решения модель может стать одним из ключевых инструментов для автоматизации бизнеса и разработки новых продуктов.

Читайте также

ИИ Китайские ученые представили модель Moebius: как 220 млн параметров обходят 10 млрд ИИ Клауд от Anthropic обходят китайские модели: как GLM 5.1 и 5.2 работают быстрее, дешевле и без ограничений ИИ Anthropic призывает ужесточить экспортный контроль ИИ из-за угрозы китайского паритета к 2028 году ИИ Китайский учёный предложил революционный способ оценки параметров закрытых ИИ-моделей: бенчмарк на основе знаний выявил GPT-5.5 с 9,7 трлн параметров
Все материалы раздела «ИИ»
Поделиться Telegram VK X Facebook