CosyVoice-windows-GUI 1.2


ChatTTS 對話場景設計的文本轉語音模型

chatTTS语音合成,效果真实如人类,开源免费!Windows、MacOS本地使用教程,附Windows整合包,Colab一键运行脚本。
Youtube 教學

RVC-Boss/GPT-SoVITS 語音合成模型

功能:

  1. 零樣本文本到語音(TTS): 輸入5秒的聲音樣本,即刻體驗文本到語音轉換。
  2. 少樣本TTS: 僅需1分鐘的訓練數據即可微調模型,提升聲音相似度和真實感。
  3. 跨語言支持: 支持與訓練數據集不同語言的推理,目前支持英語、日語和中文。
  4. WebUI工具: 集成工具包括聲音伴奏分離、自動訓練集分割、中文自動語音識別(ASR)和文本標注,協助初學者創建訓練數據集和GPT/SoVITS模型。

如果你是 Windows用戶(已在 win>=10上測試),可以直接通過預打包文件安裝。只需下載預打包文件,解壓後雙擊 go-webui.bat 即可啓動 GPT-SoVITS-WebUI。預訓練模型

GPT-SoVITS语音克隆AI,只需一分钟素材训练模型,效果堪比商用。一键安装,附Colab脚本 | TTS | RVC|GPT-SoVITS Colab

從 GPT-SoVITS Models 下載預訓練模型,並將它們放置在 GPT_SoVITS\pretrained_models 中。

對於中文自動語音識別(另外),從 Damo ASR ModelDamo VAD Model, 和 Damo Punc Model 下載模型,並將它們放置在 tools/damo_asr/models 中。

對於UVR5(人聲/伴奏分離和混響移除,另外),從 UVR5 Weights 下載模型,並將它們放置在 tools/uvr5/uvr5_weights 中。

數據集格式

文本到語音(TTS)注釋 .list 文件格式:

vocal_path|speaker_name|language|text

語言字典:

  • ‘zh’: Chinese
  • ‘ja’: Japanese
  • ‘en’: English

示例:

D:\GPT-SoVITS\xxx/xxx.wav|xxx|en|I like playing Genshin.


SeamlessM4T v2- 即時語音翻譯模型

無縫 M4T

Meta 三個月前公佈的 SeamlessM4T (Massively Multilingual and Multimodal Machine Translation model) ,目前已更新到 v2,於 GitHub 開放下載最新的源碼。SeamlessM4T v2 採用 UnitY2 架構的更新版本。與 SeamlessM4T v1 相比,此新模型在品質以及語音生成任務中的推理延遲方面有所改進。

M4T 是一體式大規模多語言和多模式的機器翻譯模型可為近 100 種語言的語音和文字提供高品質翻譯。

SeamlessM4T 模型支援以下任務:

  • 語音轉語音翻譯 (S2ST)
  • 語音轉文字翻譯 (S2TT)
  • 文字轉語音翻譯 (T2ST)
  • 文本到文本翻譯 (T2TT)
  • 自動語音辨識 (ASR)
(more…)

Narakeet 支持 4 種廣東話語音合成器

手機亦可正常操作

原文:警方新界北總區刑事部警司(行政及支援)林慶璋稱,警方發現去年第四季不少街頭暴力罪案的源頭均來自黑社會經營及操控的非法場所,例如有人在無牌酒吧「飲大咗」而碰撞;賭檔利益問題起爭拗,最後事件發酵,有人訴諸武力,釀成街頭血案等。


A.I. 視頻製作工具 Neiro Studio

Neiro Studio 是個 AI 視頻製作工具,可以將文本轉換為引人入勝的視頻。您可以在該網站上免費使用它來生成AI視頻。


Ondoku 免費使用的文字轉語音服務

80種語言可供選擇,文字轉語音軟件Ondoku。這是無需安裝,並且任何人都可免費使用的文字轉語音服務。 您還可以使用允許您免費與 ChatGPT 交談的擴展程序 ( Ondoku3-ChatGPT )。


廣東話<>輸出書面語字幕! youtuber.ai