Fish Audio

Fish Audio is an AI voice platform for generating expressive speech, cloning voices, transforming recordings, transcribing audio, and integrating real-time voice technology into applications.

التسعير: Freemium Video & Audio

مولد صوت الذكاء الاصطناعيتحويل النص إلى كلاماستنساخ الصوتفي الوقت الحقيقي صوت منظمة العفو الدوليةالكلام إلى النصواجهة برمجة التطبيقات الصوتيةصوت متعدد السماعات

Fish Audio هي منصة لتوليد الكلام مدعومة بالذكاء الاصطناعي، مصممة لمنشئي المحتوى، والمطورين، ومقدمي البودكاست، ومنتجي الكتب الصوتية، واستوديوهات الألعاب، والمسوقين، والشركات.

يقوم نظام تحويل النص إلى كلام الأساسي الخاص بها بتحويل النصوص المكتوبة إلى صوت طبيعي ومعبّر، باستخدام أصوات جاهزة، أو نماذج أنشأها المجتمع، أو استنساخ صوتي مخصص، أو تسجيلات مرجعية يتم تقديمها مباشرة أثناء عملية التوليد.

يمكن للمستخدمين إنشاء الصوت من خلال playground يعمل عبر المتصفح، أو دمج التقنية داخل التطبيقات من خلال API الخاصة بها وSDKs الرسمية لـ Python وJavaScript.

يمكن لتقنية استنساخ الصوت S2 الخاصة بالمنصة إنشاء صوت اصطناعي قابل للاستخدام من حوالي 10 ثوانٍ من صوت مرجعي نظيف.

يمكن للصوت المستنسخ إعادة إنتاج خصائص مثل نبرة الصوت، والإيقاع، والعاطفة، والتردد، وأسلوب التحدث.

تسمح قدراته متعددة اللغات لصوت مستنسخ بلغة واحدة بالتحدث بلغات أخرى مدعومة دون الحاجة إلى إعادة التدريب.

يجب أن يتم استنساخ الصوت فقط بتصريح من المتحدث، وبما يتوافق مع القوانين المعمول بها المتعلقة بالهوية، والشبه، والإفصاح، والوسائط الاصطناعية.

يدعم Fish Audio السرد بصوت واحد وكذلك الحوارات متعددة المتحدثين.

باستخدام نموذج S2-Pro، يمكن للمطورين تعيين أصوات منفصلة لعلامات متحدثين مختلفة، مما يجعل المنصة مفيدة للبودكاست، والمحادثات الخيالية، والكتب الصوتية، والألعاب، وسيناريوهات التدريب، والسرد الصوتي.

تتوفر عناصر تحكم لضبط سرعة الكلام، ومستوى الصوت، والتعبير، والتنوع، وجودة المخرجات، وصيغة الصوت.

يدعم البث في الوقت الحقيقي توليد صوت بزمن استجابة منخفض للوكلاء الحواريين، والشخصيات التفاعلية، وتطبيقات خدمة العملاء، والألعاب، وغيرها من المنتجات التي تحتاج إلى إخراج الكلام قبل معالجة السكريبت بالكامل.

تتوفر المخرجات بصيغ مثل MP3، وWAV، وPCM، وOpus، مع عدة خيارات لمعدل العينة ومعدل البت.

يوفر Fish Audio أيضًا إمكانية تحويل الكلام إلى نص من خلال API الخاصة به، مع إرجاع النصوص، والطوابع الزمنية، والنتائج المجزأة من الصوت الذي يتم تحميله.

تستخدم API الخاصة بالمطورين تسعير الدفع حسب الاستخدام دون حد أدنى شهري، بينما يتم تضمين الحقوق التجارية للأصوات المستنسخة مع الوصول المدفوع المؤهل.

كما يتم الترويج لنموذج Fish Audio S2 باعتباره مفتوح المصدر ومناسبًا للنشر المستضاف ذاتيًا.