Модели

Продукты

Цены

Документация

Блог

О

Контакт

🎉 gemma-4-12B-it доступно на SiliconFlow. Попробуйте это СЕЙЧАС.

Модели

Qwen3-Embedding-4B

Qwen3-Embedding-4B

Qwen/Qwen3-Embedding-4B

Справочник API

О Qwen3-Embedding-4B

Qwen3-Embedding-4B является последней проприетарной моделью в серии Qwen3 Embedding, специально разработанной для задач эмбеддинга текстов и ранжирования. Построенная на основе плотных основополагающих моделей серии Qwen3, эта модель с 4 миллиардами параметров поддерживает длины контекста до 32 тысяч и может генерировать эмбединги с размерностями до 2560. Модель наследует исключительные возможности мультиязычной поддержки, охватывающие более 100 языков, а также навыки понимания и анализа длинных текстов. Она достигает отличных результатов на многоязычном рейтинге MTEB (оценка 69.45) и демонстрирует выдающиеся результаты в различных задачах, включая поиск текста, поиск кода, классификацию текстов, кластеризацию и добычу двуязычных текстов. Модель предлагает гибкие размерности векторов (от 32 до 2560) и возможности с учетом инструкций для улучшенной производительности в конкретных задачах и сценариях, обеспечивая оптимальный баланс между эффективностью и эффективностью.

Доступный Serverless

Запускайте запросы немедленно, платите только за использование

За 1 миллион Tokens (Input/Output)

0.02

/ M Tokens

Playground

Использование API

Эталон

Случай использования

Метаданные

Создать на

6 июн. 2025 г.

Лицензия

APACHE-2.0

Поставщик

Qwen

HuggingFace

Qwen3-Embedding-4B

Спецификация

Государство

Available

Архитектура

Dense Transformer

Калибровка

Нет

Смешение экспертов

Нет

Общее количество параметров

Активированные параметры

Мышление

Нет

Точность

ФП8

Контекст length

33K

Максимум Tokens

поддерживается функциональность

Безсерверный

поддерживается

Безсерверный LoRA

Не поддерживается

Тонкая настройка

Не поддерживается

Embeddings

поддерживается

Rerankers

Не поддерживается

Поддержка Image Input

Не поддерживается

Режим JSON

Не поддерживается

Структурированные Outputs

Не поддерживается

Инструменты

Не поддерживается

Завершение погашения

Не поддерживается

Chat Префикс Заполнение

Не поддерживается

Сравнить с другими Model

Посмотрите, как эта Model сравнивается с другими.

Qwen

chat

Qwen3-VL-32B-Instruct

Выпуск: 21 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.2

/ M Tokens

Output:

0.6

/ M Tokens

Qwen

chat

Qwen3-VL-32B-Thinking

Выпуск: 21 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.2

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Instruct

Выпуск: 15 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.18

/ M Tokens

Output:

0.68

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Thinking

Выпуск: 15 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.18

/ M Tokens

Output:

2.0

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Instruct

Выпуск: 4 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.3

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Thinking

Выпуск: 4 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.45

/ M Tokens

Output:

3.5

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Instruct

Выпуск: 5 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.29

/ M Tokens

Output:

1.0

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Thinking

Выпуск: 11 окт. 2025 г.

Общий Контекст:

262K

Максимальный Output:

262K

Input:

0.29

/ M Tokens

Output:

1.0

/ M Tokens

Qwen

image-to-video

Wan2.2-I2V-A14B

Выпуск: 13 авг. 2025 г.

0.29

/ Video

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

СТРАНИЦЫ

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

Условия

Конфиденциальность