API تحويل النص إلى كلامادمج الصوت في أي تطبيق
كلام معبّر وقابل للتوجيه بزمن استجابة ~100ms، بنفس نموذج S2.1 Pro الذي يشغّل HeyGen وRetell وPlaud.

نماذج مصممة لاحتياجات إنتاج مختلفة
واجهة API واحدة. بدّل بين النماذج بترويسة واحدة فقط. يُحتسب سعر كلا نموذجي API بنفس السعر الثابت.
S2 Pro
دقيق حتى مع أقصر العبارات
- استنساخ صوتي فوري
- دعم كامل متعدد اللغات
- موثوق مع النصوص القصيرة جدًا
- بنفس السعر الثابت لـ S2.1 Pro
S2.1 Pro
النموذج الأكثر تعبيرًا من إنتاج Fish Audio.
- زمن الوصول لأول صوت ~100ms (على H200 واحد)
- معامل الزمن الفعلي 0.195
- 80+ لغة، وتبديل فوري بين اللغات
- وسوم مشاعر مفتوحة المجال
- دعم أصلي لمتعدد المتحدثين في توليد واحد
في الموقع
انشره في بنيتك التحتية الخاصة.
- VPC، في الموقع، سحابة سيادية، بيئة معزولة
- صفر تسرّب للبيانات
- تحكم كامل في النموذج
- تتوفر رخصة تجارية
من التسجيل إلى أول صوت في 5 دقائق.
لا تحتاج إلى مكالمة مبيعات. احصل على مفتاح API، ثبّت SDK، وانطلق.
curl https://api.fish.audio/v1/tts \-H "Authorization: Bearer YOUR_FISH_AUDIO_API_KEY" \-H "Content-Type: application/json" \-H "model: s2.1-pro" \-d '{"text": "[chuckle] When you are building something new, there is this [emphasis] mix of wonder and fear.","reference_id": "YOUR_VOICE_ID","format": "mp3"}' --output speech.mp3
from fishaudio import FishAudiofrom fishaudio.utils import saveclient = FishAudio(api_key="YOUR_FISH_AUDIO_API_KEY")audio = client.tts.convert(text="Hello from Fish Audio!",reference_id="YOUR_VOICE_ID",model="s2.1-pro",)save(audio, "output.mp3")
كل ما تحتاجهلإطلاق كلام جاهز للإنتاج
واجهة API واحدة لإنشاء الأصوات، والتوليد المعبّر، والتسليم في الوقت الحقيقي.
مشاعر وإلقاء مضمّنان في النص
التوجيه يُكتب بصياغة [tag] في أي موضع من النص. وسوم حرة غير محدودة، بلا معامل عاطفة منفصل.
ملايين الأصوات من المجتمع
تصفّح وابدأ من أكبر مكتبة أصوات مفتوحة، أو استنسخ صوتك الخاص وابنِ عليه.




حوار متعدد المتحدثين
أنشئ محادثة كاملة في مرة واحدة. متاح على S2.1 Pro.
استنساخ صوتي فوري
التقط جرس الصوت وأسلوب الكلام من مقطع مرجعي قصير. يعمل عبر 80+ لغة بلا أي تدريب إضافي.
قراءة النصوص المعقّدة بشكل طبيعي
نطق صحيح للأرقام والعملات والتواريخ والوحدات
البث والطوابع الزمنية
بثّ الصوت مع طوابع زمنية على مستوى الكلمة.
ابنِ تجربة الصوت التي يحتاجها منتجك
أنشئ صوتًا قابلاً لإعادة الاستخدام، وجّه أداءه، وابثّه في منتجات تعمل في الوقت الحقيقي.
استنسخ أي صوت فورًا
مع Fish Audio
واجهة Fish Audio لاستنساخ الصوت بالذكاء الاصطناعي تحوّل مقطعًا مرجعيًا قصيرًا إلى صوت قابل لإعادة الاستخدام. يلتقط الاستنساخ جرس الصوت وأسلوب الكلام وينتقل عبر 80+ لغة بلا أي تدريب إضافي.
# Clone from reference audiovoice = session.create_model(title="My Voice",voices=[open("reference.wav", "rb").read()])# Synthesize with the cloned voicerequest = TTSRequest(text="This is my cloned voice.",reference_id=voice.id)with open("clone.mp3", "wb") as f:for chunk in session.tts(request, backend="s2-pro"):f.write(chunk)
Fish Audio TTS APIالمعايير والمواصفات
واجهة API واحدة. بدّل بين النماذج بترويسة واحدة فقط. يُحتسب سعر كلا نموذجي API بنفس السعر الثابت.
POST https://api.fish.audio/v1/tts
معامل الزمن الفعلي
مقطع قصير
استنساخ الصوت
أصلي
متعدد المتحدثين
REST + WebSocket
البث
على مستوى الكلمة
الطوابع الزمنية
معدل أخذ العينات
الطلبات المتزامنة
MP3 · WAV · Opus
صيغ الصوت
تسعير مرن يناسب احتياجاتك
حدود الطلبات المتزامنة
الأسئلة الشائعة
انطلق إلى الإنتاج في نهاية هذا الأسبوع
احصل على مفتاح API، ثبّت SDK، وانطلق. لا تحتاج إلى بطاقة ائتمانية.

