Модели

Продукты

Цены

Документация

Блог

О

Контакт

🎉 gemma-4-12B-it доступно на SiliconFlow. Попробуйте это СЕЙЧАС.

Модели

Qwen3.5-35B-A3B

Qwen3.5-35B-A3B

Qwen/Qwen3.5-35B-A3B

Справочник API

О Qwen3.5-35B-A3B

Qwen3.5-35B-A3B is a native multimodal large language model from the Qwen team, with 35B total parameters and only 3B activated. It features an efficient hybrid architecture combining Gated Delta Networks with sparse Mixture-of-Experts (MoE), natively supporting a 262K context length extensible up to ~1M tokens. The model achieves unified vision-language capabilities through early fusion training, supporting text, image, and video understanding with strong performance across reasoning, coding, agents, and visual understanding benchmarks. It defaults to thinking mode, supports tool calling, and covers 201 languages and dialects

Доступный Serverless

Запускайте запросы немедленно, платите только за использование

За 1 миллион Tokens (Input/Output)

0.24

/ M Tokens

За 1 миллион Tokens (Input/Output)

1.8

/ M Tokens

Playground

Использование API

Эталон

Случай использования

Метаданные

Создать на

9 мая 2026 г.

Лицензия

APACHE-2.0

Поставщик

Qwen

HuggingFace

Qwen3.5-35B-A3B

Спецификация

Государство

Available

Архитектура

Hybrid MoE

Калибровка

Да

Смешение экспертов

Да

Общее количество параметров

35B

Активированные параметры

Мышление

Нет

Точность

ФП8

Контекст length

262K

Максимум Tokens

262K

поддерживается функциональность

Безсерверный

поддерживается

Безсерверный LoRA

Не поддерживается

Тонкая настройка

Не поддерживается

Embeddings

Не поддерживается

Rerankers

Не поддерживается

Поддержка Image Input

поддерживается

Режим JSON

поддерживается

Структурированные Outputs

Не поддерживается

Инструменты

поддерживается

Завершение погашения

Не поддерживается

Chat Префикс Заполнение

Не поддерживается

Сравнить с другими Model

Посмотрите, как эта Model сравнивается с другими.

Qwen

chat

Qwen3-VL-32B-Instruct

Выпуск: 21 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.2

/ M Tokens

Output:

0.6

/ M Tokens

Qwen

chat

Qwen3-VL-32B-Thinking

Выпуск: 21 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.2

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Instruct

Выпуск: 15 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.18

/ M Tokens

Output:

0.68

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Thinking

Выпуск: 15 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.18

/ M Tokens

Output:

2.0

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Instruct

Выпуск: 4 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.3

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Thinking

Выпуск: 4 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.45

/ M Tokens

Output:

3.5

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Instruct

Выпуск: 5 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.29

/ M Tokens

Output:

1.0

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Thinking

Выпуск: 11 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.29

/ M Tokens

Output:

1.0

/ M Tokens

Qwen

image-to-video

Wan2.2-I2V-A14B

Выпуск: 13 авг. 2025 г.

0.29

/ Video

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

Условия

Конфиденциальность