1 주년.

$52M 시드 투자.

8M+ 크리에이터.

우리의 이야기

텍스트 음성 변환 API모든 앱에 음성을 탑재하세요

~100ms 지연 시간의 표현력 있고 방향 지정이 가능한 음성 — HeyGen, Retell, Plaud를 구동하는 바로 그 S2.1 Pro 모델입니다.

curl https://api.fish.audio/v1/tts \
  -H "Authorization: Bearer YOUR_FISH_AUDIO_API_KEY" \
  -H "Content-Type: application/json" \
  -H "model: s2.1-pro" \
  -d '{
    "text": "[chuckle] 새로운 걸 만들 때면 [audience laughing] 설렘과 두려움이 뒤섞인 묘한 기분이 들어요. [whisper] 하지만 그게 바로, 만들 가치가 있는 이유죠.",
    "reference_id": "933563129e564b19a115bedd57b7406a",
    "format": "mp3"
  }' --output speech.mp3
<100ms
첫 오디오 응답 시간
무제한
방향 태그
80+
언어
$15/1M UTF-8 bytes
종량제

프로덕션에서 실행 중

프로덕션 요구사항에 맞는 모델

API는 하나. 헤더 하나로 모델을 전환하세요. 두 API 모델 모두 동일한 균일 요금이 적용됩니다.

오리지널

S2 Pro

아주 짧은 발화에서도 정확합니다

  • 즉시 음성 복제
  • 전체 다국어 지원
  • 매우 짧은 프롬프트에도 안정적
  • S2.1 Pro와 동일한 균일 요금
문서 보기
추천

S2.1 Pro

Fish가 선보이는 가장 표현력 있는 모델입니다.

  • 단일 H200 없이도 첫 오디오까지 ~100ms
  • 실시간 계수 0.195
  • 80+ 개 언어, 즉시 코드 스위칭
  • 오픈 도메인 감정 태그
  • 한 번의 생성에서 네이티브 멀티스피커
문서 보기
엔터프라이즈 배포

온프레미스

자체 인프라에 직접 배포하세요.

  • VPC, 온프레미스, 소버린 클라우드, 에어갭
  • 데이터 반출 없음
  • 완전한 모델 제어권
  • 상업용 라이선스 제공
영업팀 문의

가입부터 첫 오디오까지 5 분이면 충분합니다.

영업 통화 필요 없음. API 키를 발급받고, SDK를 설치하고, 바로 배포하세요.

cURL · REST API
curl https://api.fish.audio/v1/tts \
-H "Authorization: Bearer YOUR_FISH_AUDIO_API_KEY" \
-H "Content-Type: application/json" \
-H "model: s2.1-pro" \
-d '{
"text": "[chuckle] When you are building something new, there is this [emphasis] mix of wonder and fear.",
"reference_id": "YOUR_VOICE_ID",
"format": "mp3"
}' --output speech.mp3
Python · Fish Audio SDK
from fishaudio import FishAudio
from fishaudio.utils import save
client = FishAudio(api_key="YOUR_FISH_AUDIO_API_KEY")
audio = client.tts.convert(
text="Hello from Fish Audio!",
reference_id="YOUR_VOICE_ID",
model="s2.1-pro",
)
save(audio, "output.mp3")

프로덕션급 음성을 배포하는 데필요한 모든 것

음성 제작부터 표현력 있는 생성, 실시간 전달까지 API 하나로 해결하세요.

인라인 감정과 표현

텍스트 어디에서든 [tag] 구문으로 방향을 지정하세요. 무제한 자유 형식 태그, 별도의 감정 파라미터 없음.

Aber
Hey there.Add TagsI’m so excited to share this news!Can you hear me?
[Sad]
[Excited]
[satisfied]
[angry]

수백만 개의 커뮤니티 음성

가장 큰 오픈 음성 라이브러리를 둘러보고 바로 배포하거나, 직접 음성을 복제해 그 위에 구축하세요.

멀티스피커 대화

한 번에 전체 대화를 생성하세요. S2.1 Pro에서 사용 가능합니다.

Aber
Sarah
Ethan

즉시 음성 복제

짧은 레퍼런스 클립에서 음색과 말투를 포착하세요. 추가 학습 없이 80+ 개 언어 전체에서 작동합니다.

Recorded Voice
My Cloned Voice
EnglishFemaleYoung

복잡한 텍스트도 자연스럽게 읽기

숫자, 통화, 날짜, 단위를 정확하게 발음

$9.99
01/24
1,999

스트리밍과 타임스탬프

단어 단위 타임스탬프와 함께 오디오를 스트리밍하세요.

Thefutureiscoming
0.02s0.05s0.01s0.04svoice0.01s0.03s

Fish Audio로 모든 음성을<br></br>즉시 복제하세요

재사용 가능한 음성을 만들고 표현 방식을 조정한 뒤, 실시간 제품에 스트리밍하세요.

Fish Audio로 모든 음성을
즉시 복제하세요

Fish Audio AI 음성 복제 API는 짧은 레퍼런스 클립을 재사용 가능한 음성으로 만들어 줍니다. 복제된 음성은 음색과 말투를 그대로 담아내며, 추가 학습 없이 80+ 개 언어 전체에서 사용할 수 있습니다.

PYTHON SDK
# Clone from reference audio
voice = session.create_model(
title="My Voice",
voices=[open("reference.wav", "rb").read()]
)
# Synthesize with the cloned voice
request = TTSRequest(
text="This is my cloned voice.",
reference_id=voice.id
)
with open("clone.mp3", "wb") as f:
for chunk in session.tts(request, backend="s2-pro"):
f.write(chunk)

Fish Audio TTS API벤치마크 및 사양

API는 하나. 헤더 하나로 모델을 전환하세요. 두 API 모델 모두 동일한 균일 요금이 적용됩니다.

POST https://api.fish.audio/v1/tts

벤치마크
0.195

실시간 계수

짧은 클립

음성 복제

네이티브

멀티스피커

REST + WebSocket

스트리밍

단어 단위

타임스탬프

48kHz

샘플레이트

5시작

동시 요청

MP3 · WAV · Opus

오디오 형식

필요에 맞는 유연한 요금제

어떤 구독이든 종량제로 이용 가능자세히 보기

S2.1 Pro

텍스트 음성 변환

$0.015/ K UTF-8 bytes
시작하기
70ms 초저지연
80+ 언어 지원
단어 단위 타임스탬프

S2 Pro

텍스트 음성 변환

$0.015/ K UTF-8 bytes
시작하기
실시간 지연
전체 다국어 지원
즉시 음성 복제

Transcribe-1

자동 음성 인식

$0.006/ 오디오 분
시작하기
업계 최고 수준의 ASR 정확도
다국어 지원, 언어 힌트 선택 가능
긴 입력 전사 지원

동시 요청 제한

 
지출 기준동시성
스타터
$100 미만 결제5건
상위
$100 이상 결제15건
대용량
$1,000 이상 결제50건
엔터프라이즈
맞춤맞춤 제한

자주 묻는 질문

Fish Audio

이번 주말에 프로덕션까지

API 키를 발급받고, SDK를 설치하고, 배포하세요. 카드 불필요.