Qwen3-Next-80B-A3B-Instruct
О Qwen3-Next-80B-A3B-Instruct
Qwen3-Next-80B-A3B-Instruct — это модель следующего поколения, выпущенная командой Qwen компании Alibaba. Она построена на новой архитектуре Qwen3-Next, предназначенной для максимальной эффективности обучения и Inference. Модель включает инновационные функции, такие как механизм гибридного внимания (Gated DeltaNet и Gated Attention), высокоразреженная структура с механизмом смеси экспертов (MoE) и различные оптимизации стабильности. Как разреженная модель с 80 миллиардами параметров, она активирует только около 3 миллиардов параметров на token во время Inference, что значительно снижает вычислительные затраты и обеспечивает более чем в 10 раз большую производительность по сравнению с моделью Qwen3-32B для задач с длинным контекстом, превышающих 32K tokens. Это версия с настройкой инструкций, оптимизированная для задач общего назначения, и не поддерживает режим 'мышления'. Что касается производительности, она сопоставима с флагманской моделью Qwen, Qwen3-235B, по некоторым критериям, демонстрируя значительные преимущества в сценах с ультрадлинным контекстом.
Доступный Serverless
Запускайте запросы немедленно, платите только за использование
$
0.14
/
$
1.4
За 1 миллион Tokens (Input/Output)
Метаданные
Спецификация
Государство
Available
Архитектура
Калибровка
Нет
Смешение экспертов
Да
Общее количество параметров
80B
Активированные параметры
3B
Мышление
Нет
Точность
ФП8
Контекст length
262K
Максимум Tokens
262K
поддерживается функциональность
Безсерверный
поддерживается
Безсерверный LoRA
Не поддерживается
Тонкая настройка
Не поддерживается
Embeddings
Не поддерживается
Rerankers
Не поддерживается
Поддержка Image Input
Не поддерживается
Режим JSON
поддерживается
Структурированные Outputs
Не поддерживается
Инструменты
поддерживается
Завершение погашения
Не поддерживается
Chat Префикс Заполнение
поддерживается
Сравнить с другими Model
Посмотрите, как эта Model сравнивается с другими.

Qwen
chat
Qwen3-VL-32B-Instruct
Выпуск: 21 окт. 2025 г.
Общий Контекст:
262K
Максимальный Output:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Выпуск: 21 окт. 2025 г.
Общий Контекст:
262K
Максимальный Output:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Выпуск: 15 окт. 2025 г.
Общий Контекст:
262K
Максимальный Output:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Выпуск: 15 окт. 2025 г.
Общий Контекст:
262K
Максимальный Output:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Выпуск: 4 окт. 2025 г.
Общий Контекст:
262K
Максимальный Output:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Выпуск: 4 окт. 2025 г.
Общий Контекст:
262K
Максимальный Output:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Выпуск: 5 окт. 2025 г.
Общий Контекст:
262K
Максимальный Output:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Выпуск: 11 окт. 2025 г.
Общий Контекст:
262K
Максимальный Output:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
Выпуск: 13 авг. 2025 г.
$
0.29
/ Video
