الاثنين، 3 أغسطس 2026

الشركات الناشئة

Fish Audio تجمع 52 مليون دولار لتمويل نماذج صوت بالذكاء الاصطناعي

جمعت شركة Fish Audio الناشئة ومقرها بالو ألتو 52 مليون دولار في جولة تمويل أولية (seed) لتوسيع نماذج الصوت التي تعمل بالذكاء الاصطناعي والموجهة للمبدعين والشركات.

Fish Audio co-founders Shijia Liao and Rissa Cao sitting in chairs in front of a window.
صورة: Fish Audio

أعلنت Fish Audio، الشركة الناشئة التي تتخذ من بالو ألتو مقراً لها والمتخصصة في نماذج الصوت بالذكاء الاصطناعي، يوم الثلاثاء أنها جمعت 52 مليون دولار في جولة تمويل أولية بقيادة Coreline Ventures وCapital Today، بمشاركة 359 Capital وParable وPlay Time وAlphalist Partners وBayhouse Ventures وCarya Venture Partners وHF0. وذكرت الشركة أن أكثر من 8 ملايين شخص يستخدمون حالياً النسخ مفتوحة المصدر أو المستضافة من نماذجها، ما يحقق إيرادات متكررة سنوية تبلغ 21 مليون دولار.

أسّس Fish Audio الباحث السابق في Nvidia، Shijia Liao، الذي دفعه إحباطه من الأصوات الاصطناعية غير المعبّرة المتوفرة في السوق إلى تدريب نموذج لتوليد الصوت على وحدة معالجة رسومات (GPU) واحدة، ثم أتاحه كمصدر مفتوح. وأصبح مستودع Fish Speech الناتج على GitHub يضم الآن أكثر من 31,000 نجمة، ويستخدمه مطورون مستقلون ومصممو ألعاب فيديو ومبدعون. وأطلقت الشركة الناشئة خمسة نماذج خلال العام الماضي — أربعة لتوليد الصوت ونموذج واحد لتحويل الصوت إلى نص — وأتاحت ثلاثة من نماذج توليد الصوت كمصدر مفتوح، بينما أبقت أحدث نماذجها، S2.1 Pro، متاحاً فقط عبر واجهة برمجة تطبيقات (API) مدفوعة. وتضم مكتبتها الآن أكثر من 15,000 أداة تحكم باللغة الطبيعية. وتستخدم شركات مثل HeyGen وSanas بالفعل واجهات برمجة التطبيقات والمنصة الخاصة بها، إلى جانب خطط شهرية مدفوعة للمبدعين والفرق تشمل ميزات استنساخ الصوت.

وقالت Rissa Cao، الرئيسة التنفيذية والمؤسسة المشاركة لشركة Fish Audio: “لكل شركة حالات استخدام وتفضيلات مختلفة”، مشيرة إلى أن HeyGen تحتاج إلى واقعية في الصور الرمزية التي تعمل بالذكاء الاصطناعي، وأن استوديوهات الألعاب تحتاج إلى أصوات معبّرة لشخصياتها، وأن شركات وكلاء الصوت تحتاج إلى أصوات طبيعية منخفضة الكمون للمكالمات.

وبنت Fish Audio جزءاً من مكتبة أصواتها من خلال دعوة المستخدمين لتقديم أصواتهم الخاصة لتدريب النماذج، مع تعويضهم عند استخدامها. وقبل بضعة أشهر، ادّعى بعض المبدعين أن أصواتهم رُفعت دون موافقتهم؛ وكان لدى الشركة إجراء لإزالة المحتوى بموجب قانون DMCA، لكن عمليات الإزالة كانت تستغرق وقتاً طويلاً. وقالت Cao لموقع TechCrunch إن الشركة أتمتت منذ ذلك الحين هذه العملية — إذ يمكن الآن للمبدعين الذين يقدمون عينة صوتية أو عقداً يثبت الملكية أن تتم إزالة الصوت المرفوع في أقل من ثلاث دقائق. لكن ذلك لا يمنع أي شخص من رفع صوت دون علم صاحبه في المقام الأول؛ إذ يبقى الصوت متاحاً حتى يكتشف صاحبه ذلك ويطلب إزالته.

وقالت Cao إن أموال الجولة الأولية ستدعم نموذجاً مخططاً لفهم الصوت ونموذجاً لتحويل الصوت إلى صوت، من المقرر إطلاق كليهما هذا العام، في وقت تنافس فيه Fish Audio مع ElevenLabs وWellSaid وCartesia وSpeechify وAsync وKrisp على ميزانيات المبدعين والشركات.

لماذا يهم

رهان Fish Audio هو أن أدوات الموافقة الآلية، وليس جودة النماذج وحدها، هي ما سيحدد أي منصة صوت تعمل بالذكاء الاصطناعي يثق بها المبدعون والشركات لاستخدام هويتهم الصوتية.