عام واحد.

$52M تمويل تأسيسي.

8M+ مبدع.

اقرأ قصتنا

API تحويل النص إلى كلامادمج الصوت في أي تطبيق

كلام معبّر وقابل للتوجيه بزمن استجابة ~100ms، بنفس نموذج S2.1 Pro الذي يشغّل HeyGen وRetell وPlaud.

curl https://api.fish.audio/v1/tts \
  -H "Authorization: Bearer YOUR_FISH_AUDIO_API_KEY" \
  -H "Content-Type: application/json" \
  -H "model: s2.1-pro" \
  -d '{
    "text": "[chuckle] عندما تبني شيئًا جديدًا، تشعر بهذا [audience laughing] المزيج من الدهشة والخوف. [whisper] لكن هذا ما يجعله يستحق البناء.",
    "reference_id": "933563129e564b19a115bedd57b7406a",
    "format": "mp3"
  }' --output speech.mp3
<100ms
الوقت حتى أول صوت
غير محدود
وسوم التوجيه
80+
اللغات
$15/1M UTF-8 bytes
ادفع حسب الاستخدام

يعمل في الإنتاج لدى

نماذج مصممة لاحتياجات إنتاج مختلفة

واجهة API واحدة. بدّل بين النماذج بترويسة واحدة فقط. يُحتسب سعر كلا نموذجي API بنفس السعر الثابت.

الإصدار الأصلي

S2 Pro

دقيق حتى مع أقصر العبارات

  • استنساخ صوتي فوري
  • دعم كامل متعدد اللغات
  • موثوق مع النصوص القصيرة جدًا
  • بنفس السعر الثابت لـ S2.1 Pro
عرض التوثيق
موصى به

S2.1 Pro

النموذج الأكثر تعبيرًا من إنتاج Fish Audio.

  • زمن الوصول لأول صوت ~100ms (على H200 واحد)
  • معامل الزمن الفعلي 0.195
  • 80+ لغة، وتبديل فوري بين اللغات
  • وسوم مشاعر مفتوحة المجال
  • دعم أصلي لمتعدد المتحدثين في توليد واحد
عرض التوثيق
نشر على مستوى Enterprise

في الموقع

انشره في بنيتك التحتية الخاصة.

  • VPC، في الموقع، سحابة سيادية، بيئة معزولة
  • صفر تسرّب للبيانات
  • تحكم كامل في النموذج
  • تتوفر رخصة تجارية
تحدث مع المبيعات

من التسجيل إلى أول صوت في 5 دقائق.

لا تحتاج إلى مكالمة مبيعات. احصل على مفتاح API، ثبّت SDK، وانطلق.

cURL · REST API
curl https://api.fish.audio/v1/tts \
-H "Authorization: Bearer YOUR_FISH_AUDIO_API_KEY" \
-H "Content-Type: application/json" \
-H "model: s2.1-pro" \
-d '{
"text": "[chuckle] When you are building something new, there is this [emphasis] mix of wonder and fear.",
"reference_id": "YOUR_VOICE_ID",
"format": "mp3"
}' --output speech.mp3
Python · Fish Audio SDK
from fishaudio import FishAudio
from fishaudio.utils import save
client = FishAudio(api_key="YOUR_FISH_AUDIO_API_KEY")
audio = client.tts.convert(
text="Hello from Fish Audio!",
reference_id="YOUR_VOICE_ID",
model="s2.1-pro",
)
save(audio, "output.mp3")

كل ما تحتاجهلإطلاق كلام جاهز للإنتاج

واجهة API واحدة لإنشاء الأصوات، والتوليد المعبّر، والتسليم في الوقت الحقيقي.

مشاعر وإلقاء مضمّنان في النص

التوجيه يُكتب بصياغة [tag] في أي موضع من النص. وسوم حرة غير محدودة، بلا معامل عاطفة منفصل.

Aber
Hey there.Add TagsI’m so excited to share this news!Can you hear me?
[Sad]
[Excited]
[satisfied]
[angry]

ملايين الأصوات من المجتمع

تصفّح وابدأ من أكبر مكتبة أصوات مفتوحة، أو استنسخ صوتك الخاص وابنِ عليه.

حوار متعدد المتحدثين

أنشئ محادثة كاملة في مرة واحدة. متاح على S2.1 Pro.

Aber
Sarah
Ethan

استنساخ صوتي فوري

التقط جرس الصوت وأسلوب الكلام من مقطع مرجعي قصير. يعمل عبر 80+ لغة بلا أي تدريب إضافي.

Recorded Voice
My Cloned Voice
EnglishFemaleYoung

قراءة النصوص المعقّدة بشكل طبيعي

نطق صحيح للأرقام والعملات والتواريخ والوحدات

$9.99
01/24
1,999

البث والطوابع الزمنية

بثّ الصوت مع طوابع زمنية على مستوى الكلمة.

Thefutureiscoming
0.02s0.05s0.01s0.04svoice0.01s0.03s

ابنِ تجربة الصوت التي يحتاجها منتجك

أنشئ صوتًا قابلاً لإعادة الاستخدام، وجّه أداءه، وابثّه في منتجات تعمل في الوقت الحقيقي.

استنسخ أي صوت فورًا
مع Fish Audio

واجهة Fish Audio لاستنساخ الصوت بالذكاء الاصطناعي تحوّل مقطعًا مرجعيًا قصيرًا إلى صوت قابل لإعادة الاستخدام. يلتقط الاستنساخ جرس الصوت وأسلوب الكلام وينتقل عبر 80+ لغة بلا أي تدريب إضافي.

PYTHON SDK
# Clone from reference audio
voice = session.create_model(
title="My Voice",
voices=[open("reference.wav", "rb").read()]
)
# Synthesize with the cloned voice
request = TTSRequest(
text="This is my cloned voice.",
reference_id=voice.id
)
with open("clone.mp3", "wb") as f:
for chunk in session.tts(request, backend="s2-pro"):
f.write(chunk)

Fish Audio TTS APIالمعايير والمواصفات

واجهة API واحدة. بدّل بين النماذج بترويسة واحدة فقط. يُحتسب سعر كلا نموذجي API بنفس السعر الثابت.

POST https://api.fish.audio/v1/tts

المعايير
0.195

معامل الزمن الفعلي

مقطع قصير

استنساخ الصوت

أصلي

متعدد المتحدثين

REST + WebSocket

البث

على مستوى الكلمة

الطوابع الزمنية

48kHz

معدل أخذ العينات

5ابتدائيًا

الطلبات المتزامنة

MP3 · WAV · Opus

صيغ الصوت

تسعير مرن يناسب احتياجاتك

ادفع حسب الاستخدام مع أي اشتراكاعرف المزيد

S2.1 Pro

تحويل النص إلى كلام

$0.015/ K UTF-8 bytes
ابدأ الآن
زمن استجابة فائق الانخفاض 70ms
80+ لغة مدعومة
طوابع زمنية على مستوى الكلمة

S2 Pro

تحويل النص إلى كلام

$0.015/ K UTF-8 bytes
ابدأ الآن
زمن استجابة في الوقت الحقيقي
دعم كامل متعدد اللغات
استنساخ صوتي فوري

Transcribe-1

التعرّف الآلي على الكلام

$0.006/ دقيقة صوت
ابدأ الآن
دقة ASR الرائدة في القطاع
متعدد اللغات مع تلميحات لغة اختيارية
تفريغ المدخلات الطويلة

حدود الطلبات المتزامنة

 
حد الإنفاقالتزامن
الأساسي
< $100 مدفوعة5 طلبات
المرتفع
≥ $100 مدفوعة15 طلبًا
الحجم الكبير
≥ $1,000 مدفوعة50 طلبًا
Enterprise
مخصصحدود مخصصة

الأسئلة الشائعة

Fish Audio

انطلق إلى الإنتاج في نهاية هذا الأسبوع

احصل على مفتاح API، ثبّت SDK، وانطلق. لا تحتاج إلى بطاقة ائتمانية.