
Fish Audio sichert sich $50M Seed-Runde für KI-Sprachmodelle
Fish Audio wurde von Shijia Liao gegründet, einem ehemaligen Nvidia-Forscher, der aus Frustration über nicht-expressive Sprachsynthese ein Sprachgenerierungsmodell auf einer einzigen GPU trainierte und es anschließend open-sourcedte. Das GitHub-Repository Fish Speech verzeichnet inzwischen über 31.000 Sterne und wird von Indie-Entwicklern, Videospieldesignern und Content-Creatorn genutzt. Das Unternehmen hat in den vergangenen Monaten fünf Modelle veröffentlicht – vier zur Sprachgenerierung und eines zur Spracherkennung (Speech-to-Text); drei der Sprachgenerierungsmodelle sind Open Source, während das neueste Modell S2.1 Pro ausschließlich über eine kostenpflichtige API verfügbar ist. Zu den Enterprise-Kunden zählen bereits HeyGen, das Fish Audio für KI-Avatare einsetzt, sowie Sanas; LiveKit ist ein weiteres Beispiel für Voice-Agent-Anwendungsfälle mit Anforderungen an niedrige Latenz. Zuletzt geriet das Unternehmen in die Kritik, weil Stimmen von Creatorn ohne deren Zustimmung auf die Plattform hochgeladen worden waren – ein strukturelles Problem, da Uploads ohne Vorprüfung möglich bleiben und Betroffene aktiv einen Takedown beantragen müssen. CEO Rissa Cao betonte gegenüber TechCrunch, dass der Takedown-Prozess inzwischen vollständig automatisiert wurde und betroffene Stimmen innerhalb von unter drei Minuten entfernt werden. Mit dem frischen Kapital plant Fish Audio die Entwicklung eines Audio-Understanding-Modells sowie eines Speech-to-Speech-Modells, die noch dieses Jahr erscheinen sollen.
- Fish Audio wurde ursprünglich als Einzelprojekt von Ex-Nvidia-Forscher Shijia Liao auf einer einzigen GPU gestartet und erst später zum Startup ausgebaut.
- Das neueste Modell S2.1 Pro ist ausschließlich über die kostenpflichtige API verfügbar – die drei älteren Sprachgenerierungsmodelle bleiben Open Source.
- Zu den bekannten Enterprise-Kunden zählen HeyGen (KI-Avatare), Sanas und LiveKit (Voice Agents mit Low-Latency-Anforderung).
- An der Seed-Runde beteiligten sich neben Lead-Investoren Coreline Ventures und Capital Today auch 359 Capital, Parable, Play Time, Alphalist Partners, Bayhouse Ventures, Carya Venture Partners und HF0.
- Fish Audio plant noch dieses Jahr die Veröffentlichung eines Audio-Understanding-Modells sowie eines Speech-to-Speech-Modells.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FUNDINGtechcrunch.com5d
Listen Labs bricht $125M-Finanzierungsrunde ab – Salesforce-Übernahme für ~$2 Mrd. im Gespräch
- FUNDINGtechcrunch.com1w
AIR sichert $50 Mio. für Sicherheitsplattform für KI-Agenten-Toolchains
- FUNDINGtechcrunch.com2w
KI-Mediensuch-Startup Clipto mit 250 Mio. Dollar bewertet nach 15-Mio.-Runde
- FUNDINGtechcrunch.com2w
Legato sammelt 12 Mio. USD für KI-Hörbrille gegen Hörverlust

Fish Audio sichert sich $50M Seed-Runde für KI-Sprachmodelle
Fish Audio wurde von Shijia Liao gegründet, einem ehemaligen Nvidia-Forscher, der aus Frustration über nicht-expressive Sprachsynthese ein Sprachgenerierungsmodell auf einer einzigen GPU trainierte und es anschließend open-sourcedte. Das GitHub-Repository Fish Speech verzeichnet inzwischen über 31.000 Sterne und wird von Indie-Entwicklern, Videospieldesignern und Content-Creatorn genutzt. Das Unternehmen hat in den vergangenen Monaten fünf Modelle veröffentlicht – vier zur Sprachgenerierung und eines zur Spracherkennung (Speech-to-Text); drei der Sprachgenerierungsmodelle sind Open Source, während das neueste Modell S2.1 Pro ausschließlich über eine kostenpflichtige API verfügbar ist. Zu den Enterprise-Kunden zählen bereits HeyGen, das Fish Audio für KI-Avatare einsetzt, sowie Sanas; LiveKit ist ein weiteres Beispiel für Voice-Agent-Anwendungsfälle mit Anforderungen an niedrige Latenz. Zuletzt geriet das Unternehmen in die Kritik, weil Stimmen von Creatorn ohne deren Zustimmung auf die Plattform hochgeladen worden waren – ein strukturelles Problem, da Uploads ohne Vorprüfung möglich bleiben und Betroffene aktiv einen Takedown beantragen müssen. CEO Rissa Cao betonte gegenüber TechCrunch, dass der Takedown-Prozess inzwischen vollständig automatisiert wurde und betroffene Stimmen innerhalb von unter drei Minuten entfernt werden. Mit dem frischen Kapital plant Fish Audio die Entwicklung eines Audio-Understanding-Modells sowie eines Speech-to-Speech-Modells, die noch dieses Jahr erscheinen sollen.
- Fish Audio wurde ursprünglich als Einzelprojekt von Ex-Nvidia-Forscher Shijia Liao auf einer einzigen GPU gestartet und erst später zum Startup ausgebaut.
- Das neueste Modell S2.1 Pro ist ausschließlich über die kostenpflichtige API verfügbar – die drei älteren Sprachgenerierungsmodelle bleiben Open Source.
- Zu den bekannten Enterprise-Kunden zählen HeyGen (KI-Avatare), Sanas und LiveKit (Voice Agents mit Low-Latency-Anforderung).
- An der Seed-Runde beteiligten sich neben Lead-Investoren Coreline Ventures und Capital Today auch 359 Capital, Parable, Play Time, Alphalist Partners, Bayhouse Ventures, Carya Venture Partners und HF0.
- Fish Audio plant noch dieses Jahr die Veröffentlichung eines Audio-Understanding-Modells sowie eines Speech-to-Speech-Modells.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.
Verwandte Beiträge
- FUNDINGtechcrunch.com5d
Listen Labs bricht $125M-Finanzierungsrunde ab – Salesforce-Übernahme für ~$2 Mrd. im Gespräch
- FUNDINGtechcrunch.com1w
AIR sichert $50 Mio. für Sicherheitsplattform für KI-Agenten-Toolchains
- FUNDINGtechcrunch.com2w
KI-Mediensuch-Startup Clipto mit 250 Mio. Dollar bewertet nach 15-Mio.-Runde
- FUNDINGtechcrunch.com2w
Legato sammelt 12 Mio. USD für KI-Hörbrille gegen Hörverlust