AI 모델 라이브러리

하나의 API로 200개 이상의 최첨단 AI Models에서 Inference를 실행하고 몇 초 만에 배포할 수 있습니다

AI 모델 라이브러리

하나의 API로 200개 이상의 최첨단 AI Models에서 Inference를 실행하고 몇 초 만에 배포할 수 있습니다

AI 모델 라이브러리

하나의 API로 200개 이상의 최첨단 AI Models에서 Inference를 실행하고 몇 초 만에 배포할 수 있습니다

All

Featured

LLM

Vision

Image

Video

Audio

Serverless

Fish Audio

Text-to-Speech

Fish-Speech-1.5

출시일: 2024. 11. 29.

Fish Speech V1.5는 선도적인 오픈 소스 Text-to-Speech (TTS) Model입니다. 이 Model은 혁신적인 DualAR 아키텍처를 사용하여 이중 자회귀 변환기 디자인을 특징으로 합니다. 여러 언어를 지원하며, 영어와 중국어에 대해 300,000시간 이상의 훈련 데이터를 제공하고, 일본어에 대해서는 100,000시간 이상의 데이터를 제공합니다. TTS Arena에서의 독립적인 평가에서 이 Model은 1339의 ELO 점수로 뛰어난 성과를 보였습니다. 이 Model은 영어에 대해 3.5%의 단어 오류율(WER)과 1.2%의 문자 오류율(CER)을 달성하였고, 중국어 문자에 대해서는 1.3%의 CER을 기록하였습니다....

15.0

/ M UTF-8 bytes

Input:

text

/ M UTF-8 bytes

AI 개발을 가속화할 준비가 되셨나요?