TechCrunch AI ★ 50 2 min

Fish Audio raises $52M seed to build AI voice models for creators and enterprises

Fundraisingvoice AItext to speech

🔗 https://techcrunch.com/2026/07/28/fish-audio-raises-50m-seed-to-build-ai-voice-models-for-creators-and-enterprises/

📌 【Fish Audio 融資新聞】募資 5200 萬美元,打造兼具表現力與可控性的 AI 語音模型

TL;DR:Fish Audio 憑藉開源專案 Fish Speech 獲得 5200 萬美元種子輪融資,目標進軍創作者與企業市場。

面對龐大的 AI 生成語音市場,創作者追求的是「表現力」,而企業在自動化客戶服務與銷售流程時,則更需要「可控性」。

🚀 從單顆 GPU 的開源專案,成長為年營收 2100 萬美元的企業

Fish Audio 的起點極具傳奇色彩。由前 NVIDIA 研究員 Shijia Liao 發起,最初僅是在單顆 GPU 上訓練語音生成模型,並將其開源。這項專案後來發展為 GitHub 上擁有超過 31,000 顆星(stars)的 Fish Speech 專案,廣受獨立開發者、遊戲設計師與創作者青睞。

📊 產品規模與市場表現

  • 使用者規模:目前已有超過 800 萬人使用其開源或託管版本的模型。
  • 財務數據:年度經常性收入 (ARR) 已達 2100 萬美元。
  • 產品線:過去一年共推出 5 款模型,包含 4 款語音生成模型與 1 款語音轉文字 (speech-to-text) 模型。

🧩 技術架構與產品策略

Fish Audio 提供超過 15,000 種自然語言控制參數,試圖解決現有合成語音缺乏表現力的痛點。

  • 開源與商業模式並行:公司已將三款語音生成模型開源;而最新的 S2.1 Pro 模型則僅透過付費 API 提供。
  • 分層服務
    • 創作者/團隊:提供月費方案,解鎖特定分鐘數的生成量與語音複製 (voice-cloning) 功能。
    • 企業端:提供專屬 API 與平臺,目前已有 HeyGen 與 Sanas 等組織在使用其技術。

💡 針對不同場景的應用差異

Fish Audio 指出,不同產業對語音的需求完全不同:例如 HeyGen 需要極高的真實感來驅動 AI 數位人,而遊戲工作室則需要更具表現力的語音來賦予角色生命力。

🔗 來源

#AI #VoiceAI #FishAudio #FishSpeech #MachineLearning #GenerativeAI #Startup #NVIDIA #VoiceCloning #TechNews

tencent/hy3:free 自動生成