Модели

Продукты

Цены

Документация

Блог

О

Контакт

🎉 gemma-4-12B-it доступно на SiliconFlow. Попробуйте это СЕЙЧАС.

🎉 gemma-4-12B-it доступно на SiliconFlow. Попробуйте это СЕЙЧАС.

Модели

FunAudioLLM/CosyVoice2-0.5B

FunAudioLLM/CosyVoice2-0.5B

FunAudioLLM/CosyVoice2-0.5B

Справочник API

О FunAudioLLM/CosyVoice2-0.5B

CosyVoice 2 — это потоковая модель синтеза речи, основанная на крупной языковой модели, использующая унифицированный потоковый/непотоковый дизайн. Модель улучшает использование кодовой книги речевых token через конечное скалярное квантование (FSQ), упрощает архитектуру модели Text-to-speech и разрабатывает потоковую модель с учётом фрагментов, поддерживающую различные сценарии синтеза. В потоковом режиме модель достигает ультра-низкой задержки в 150 мс, при этом качество синтеза практически идентично качеству в непотоковом режиме. По сравнению с версией 1.0, уровень ошибок произношения был снижен на 30%-50%, показатель MOS улучшен с 5.4 до 5.53, и поддерживается тонкое управление эмоциями и диалектами. Модель поддерживает китайский (включая диалекты: кантонский, сычуаньский, шанхайский, тяньцзиньский и др.), английский, японский, корейский и поддерживает межъязыковые и многозыковые сценарии.

Доступный Serverless

Запускайте запросы немедленно, платите только за использование

За 1 миллион Tokens (Input/Output)

$

7.15

/ M UTF-8 bytes

Playground

Использование API

Эталон

Случай использования

Loading...

Метаданные

Создать на

16 дек. 2024 г.

Лицензия

Поставщик

FunAudioLLM

HuggingFace

FunAudioLLM/CosyVoice2-0.5B

Спецификация

Государство

Available

Архитектура

LLM-based TTS

Калибровка

Да

Смешение экспертов

Нет

Общее количество параметров

1B

Активированные параметры

0.5B

Мышление

Нет

Точность

ФП8

Контекст length

0K

Максимум Tokens

поддерживается функциональность

Безсерверный

поддерживается

Безсерверный LoRA

Не поддерживается

Тонкая настройка

Не поддерживается

Embeddings

Не поддерживается

Rerankers

Не поддерживается

Поддержка Image Input

Не поддерживается

Режим JSON

Не поддерживается

Структурированные Outputs

Не поддерживается

Инструменты

Не поддерживается

Завершение погашения

Не поддерживается

Chat Префикс Заполнение

Не поддерживается

Сравнить с другими Model

Посмотрите, как эта Model сравнивается с другими.

FunAudioLLM

text-to-speech

FunAudioLLM/CosyVoice2-0.5B

Выпуск: 16 дек. 2024 г.

Общий Контекст:

0K

Максимальный Output:

Input:

$

/ M UTF-8 bytes

Output:

$

/ M UTF-8 bytes

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

СТРАНИЦЫ

Продукты

Документация

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

© 2025 SiliconFlow

·

Конфиденциальность

СТРАНИЦЫ

Продукты

Документация

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

© 2025 SiliconFlow

·

Конфиденциальность

СТРАНИЦЫ

Продукты

Документация

МОДЕЛИ

ПРОДУКТЫ

Зарезервированные GPU

© 2025 SiliconFlow

·

Конфиденциальность