Содержание
  1. Qwen3-Max: новый гигант среди языковых моделей
  2. Qwen3-VL: мультимодальный интеллект нового поколения
Подборки и сравнения

Две модели от Qwen: Qwen3-Max и Qwen3-VL

27 декабря 2025 · 2 минуты чтения

Компания Qwen представила сразу два масштабных обновления в своей линейке моделей — Qwen3-Max и Qwen3-VL.

Узнать больше про лучшие китайские нейросети можно на бесплатном онлайн-практикуме!

Qwen3-Max: новый гигант среди языковых моделей

Qwen3-Max — это крупнейшая и наиболее производительная модель в серии, насчитывающая более 1 трлн параметров и обученная на 36 трлн токенов. Благодаря архитектуре Mixture of Experts (MoE) и оптимизациям вроде PAI-FlashMoE и ChunkFlow, она обеспечивает стабильность и высокую эффективность обучения даже при обработке контекстов длиной в миллион токенов.

Модель уже заняла третье место в мировом рейтинге Text Arena, обогнав GPT-5-Chat. Особенно впечатляют её достижения в программировании и задачах для интеллектуальных агентов. На тестах SWE-Bench Verified и Tau2-Bench она показала рекордные результаты, превысив показатели Claude Opus 4 и DeepSeek V3.1.

Особое внимание привлекает версия Qwen3-Max-Thinking, способная решать сложнейшие задачи математического и логического характера. В испытаниях AIME 25 и HMMT она достигла 100% точности, что является прорывом для reasoning-моделей.

Qwen3-VL: мультимодальный интеллект нового поколения

Если Qwen3-Max делает ставку на масштаб и текст, то Qwen3-VL становится вершиной мультимодальных моделей. Она не только распознаёт изображения и видео, но и умеет понимать пространственные связи, анализировать действия и выполнять агентные задачи.

Флагман серии — Qwen3-VL-235B-A22B — доступен в версиях Instruct и Thinking. Первая показывает выдающиеся результаты в восприятии визуальной информации, а вторая уверенно лидирует в сложных задачах мультимодального рассуждения, соперничая с такими закрытыми моделями, как Gemini 2.5 Pro и GPT-5.

Среди ключевых возможностей: агентные функции для управления интерфейсами, генерация кода из изображений, пространственное понимание (2D/3D grounding), работа с часовыми видео и многоязычный OCR для 32 языков. Благодаря архитектуре с Interleaved-MRoPE, DeepStack и улучшенной временной разметке, модель значительно точнее в анализе мультимодальных данных.

Практическое применение

Qwen3-Max уже сейчас может стать основой для интеллектуальных ассистентов, работающих с огромными массивами данных. Например, в юридической или медицинской сфере она способна анализировать миллионы документов, предлагая точные и быстрые выводы.

Qwen3-VL, в свою очередь, идеально подойдёт для задач компьютерного зрения: от анализа видео с камер наблюдения и распознавания сложных движений до автоматической генерации интерфейсов по макетам дизайнеров. Для компаний это означает не просто ускорение процессов, но и снижение затрат на человеческий труд в рутинных задачах.

Итог

Qwen3-Max и Qwen3-VL показывают, что развитие ИИ выходит за рамки простого увеличения параметров. Теперь модели способны не только лучше понимать текст, но и полноценно работать с изображениями, видео и интерфейсами.

Обе модели доступны для тестирования: Qwen3-Max — через API на Alibaba Cloud и Qwen Chat, а Qwen3-VL — в открытом доступе в версиях Instruct и Thinking.

Читайте также

3 материала