Модели

Продукты

Цены

Документация

Блог

О

Контакт

🎉 gemma-4-12B-it доступно на SiliconFlow. Попробуйте это СЕЙЧАС.

Модели

Qwen3-32B

Qwen3-32B

Qwen/Qwen3-32B

Справочник API

О Qwen3-32B

Qwen3-32B — это последняя большая языковая модель в серии Qwen с 32.8 миллиардами параметров. Эта модель уникально поддерживает плавное переключение между режимом мышления (для сложного логического рассуждения, математики и программирования) и режимом немышления (для эффективного, универсального диалога). Она демонстрирует значительно улучшенные способности к рассуждению, превосходя предыдущие instruct модели QwQ и Qwen2.5 в математике, генерации кода и логическом рассуждении на уровне здравого смысла. Модель превосходит в выравнивании человеческих предпочтений для творческого письма, ролевых игр и диалогов с множественными ходами. Кроме того, она поддерживает более 100 языков и диалектов с сильными возможностями следования многоязычным инструкциям и перевода.

Доступный Serverless

Запускайте запросы немедленно, платите только за использование

За 1 миллион Tokens (Input/Output)

0.14

/ M Tokens

За 1 миллион Tokens (Input/Output)

0.57

/ M Tokens

Playground

Использование API

Эталон

Случай использования

Метаданные

Создать на

30 апр. 2025 г.

Лицензия

APACHE-2.0

Поставщик

Qwen

HuggingFace

Qwen3-32B

Спецификация

Государство

Available

Архитектура

Causal Decoder-only

Калибровка

Нет

Смешение экспертов

Нет

Общее количество параметров

32B

Активированные параметры

32.8B

Мышление

Нет

Точность

ФП8

Контекст length

131K

Максимум Tokens

131K

поддерживается функциональность

Безсерверный

поддерживается

Безсерверный LoRA

Не поддерживается

Тонкая настройка

Не поддерживается

Embeddings

Не поддерживается

Rerankers

Не поддерживается

Поддержка Image Input

Не поддерживается

Режим JSON

поддерживается

Структурированные Outputs

Не поддерживается

Инструменты

поддерживается

Завершение погашения

Не поддерживается

Chat Префикс Заполнение

Не поддерживается

Сравнить с другими Model

Посмотрите, как эта Model сравнивается с другими.

Qwen

chat

Qwen3-VL-32B-Instruct

Выпуск: 21 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.2

/ M Tokens

Output:

0.6

/ M Tokens

Qwen

chat

Qwen3-VL-32B-Thinking

Выпуск: 21 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.2

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Instruct

Выпуск: 15 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.18

/ M Tokens

Output:

0.68

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Thinking

Выпуск: 15 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.18

/ M Tokens

Output:

2.0

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Instruct

Выпуск: 4 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.3

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Thinking

Выпуск: 4 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.45

/ M Tokens

Output:

3.5

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Instruct

Выпуск: 5 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.29

/ M Tokens

Output:

1.0

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Thinking

Выпуск: 11 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.29

/ M Tokens

Output:

1.0

/ M Tokens

Qwen

image-to-video

Wan2.2-I2V-A14B

Выпуск: 13 авг. 2025 г.

0.29

/ Video

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

Условия

Конфиденциальность