
프로덕션 요구사항에 맞는 모델
API는 하나. 헤더 하나로 모델을 전환하세요. 두 API 모델 모두 동일한 균일 요금이 적용됩니다.
S2.1 Pro
Fish가 선보이는 가장 표현력 있는 모델입니다.
- 단일 H200 없이도 첫 오디오까지 ~100ms
- 실시간 계수 0.195
- 80+ 개 언어, 즉시 코드 스위칭
- 오픈 도메인 감정 태그
- 한 번의 생성에서 네이티브 멀티스피커
가입부터 첫 오디오까지 5 분이면 충분합니다.
영업 통화 필요 없음. API 키를 발급받고, SDK를 설치하고, 바로 배포하세요.
curl https://api.fish.audio/v1/tts \-H "Authorization: Bearer YOUR_FISH_AUDIO_API_KEY" \-H "Content-Type: application/json" \-H "model: s2.1-pro" \-d '{"text": "[chuckle] When you are building something new, there is this [emphasis] mix of wonder and fear.","reference_id": "YOUR_VOICE_ID","format": "mp3"}' --output speech.mp3
from fishaudio import FishAudiofrom fishaudio.utils import saveclient = FishAudio(api_key="YOUR_FISH_AUDIO_API_KEY")audio = client.tts.convert(text="Hello from Fish Audio!",reference_id="YOUR_VOICE_ID",model="s2.1-pro",)save(audio, "output.mp3")
인라인 감정과 표현
텍스트 어디에서든 [tag] 구문으로 방향을 지정하세요. 무제한 자유 형식 태그, 별도의 감정 파라미터 없음.
수백만 개의 커뮤니티 음성
가장 큰 오픈 음성 라이브러리를 둘러보고 바로 배포하거나, 직접 음성을 복제해 그 위에 구축하세요.




멀티스피커 대화
한 번에 전체 대화를 생성하세요. S2.1 Pro에서 사용 가능합니다.
즉시 음성 복제
짧은 레퍼런스 클립에서 음색과 말투를 포착하세요. 추가 학습 없이 80+ 개 언어 전체에서 작동합니다.
복잡한 텍스트도 자연스럽게 읽기
숫자, 통화, 날짜, 단위를 정확하게 발음
스트리밍과 타임스탬프
단어 단위 타임스탬프와 함께 오디오를 스트리밍하세요.
Fish Audio로 모든 음성을<br></br>즉시 복제하세요
재사용 가능한 음성을 만들고 표현 방식을 조정한 뒤, 실시간 제품에 스트리밍하세요.
Fish Audio로 모든 음성을
즉시 복제하세요
Fish Audio AI 음성 복제 API는 짧은 레퍼런스 클립을 재사용 가능한 음성으로 만들어 줍니다. 복제된 음성은 음색과 말투를 그대로 담아내며, 추가 학습 없이 80+ 개 언어 전체에서 사용할 수 있습니다.
# Clone from reference audiovoice = session.create_model(title="My Voice",voices=[open("reference.wav", "rb").read()])# Synthesize with the cloned voicerequest = TTSRequest(text="This is my cloned voice.",reference_id=voice.id)with open("clone.mp3", "wb") as f:for chunk in session.tts(request, backend="s2-pro"):f.write(chunk)
Fish Audio TTS API벤치마크 및 사양
API는 하나. 헤더 하나로 모델을 전환하세요. 두 API 모델 모두 동일한 균일 요금이 적용됩니다.
POST https://api.fish.audio/v1/tts
실시간 계수
짧은 클립
음성 복제
네이티브
멀티스피커
REST + WebSocket
스트리밍
단어 단위
타임스탬프
샘플레이트
동시 요청
MP3 · WAV · Opus
오디오 형식

