Omost 可控 Text2Image
Instance Diffusion: AI 驅動的可控視訊動畫
Google AI Studio – Gemini Flash/Pro 開發平台

Google AI Studio 是一個由 Google AI 開發的雲端平台,可讓您使用 Gemini 多模態生成式 AI 模型來創建各種內容。Gemini 是一個強大的 AI 模型,可以生成文字、程式碼、圖像、音樂等。Google AI Studio 使您可以輕鬆使用 Gemini,而無需任何編碼或機器學習知識。
Google AI Studio 仍處於早期開發階段,但它已經可以用於許多目的,例如:
- 創建創意文字格式,如詩歌、程式碼、腳本、音樂作品、電子郵件、信件等。
- 以不同的風格回答您的問題,以一種信息豐富的方式。
- 生成圖像和創意文字格式的組合。
Google AI Studio 的一些功能包括:
- **結構化提示:**您可以使用結構化提示來指示 Gemini 生成您想要的內容類型。例如,您可以要求 Gemini 寫一首關於愛情的詩,或者生成一隻貓的圖像。
- **示例:**您可以向 Gemini 提供示例,以幫助它了解您想要的內容。例如,如果您想寫一首詩,可以向 Gemini 提供一些您喜歡的詩的示例。
- **微調:**您可以微調 Gemini 的響應以獲得更好的結果。例如,您可以調整創意文字格式的風格或圖像的真實度。
如果您有興趣嘗試使用 AI 來激發您的創意,那麼 Google AI Studio 值得一試。
- **語言支持:**Google AI Studio 目前支持英語、中文、法語、德語、西班牙語和日語。
- **定價:**Google AI Studio 是免費的。
Synthflow AI 第一個人工智慧語音代理平台
PromeAI – 令草圖轉為逼真的照片或高質影片

PromeAI – 使用終極 AI 藝術生成器釋放您的創意潛力。將草圖轉換為逼真的照片和高品質影片。從草圖、照片或文字生成令人驚嘆的 AI 藝術、3D 渲染、插圖、繪畫、標誌、動漫、逼真照片和影片。

MVSEP – 自制 Karaoke 必備
app.artflow.ai 生成外觀一致圖片
FMA-Net 即將推出最強模糊影片修正
RVC-Boss/GPT-SoVITS 語音合成模型
功能:
- 零樣本文本到語音(TTS): 輸入5秒的聲音樣本,即刻體驗文本到語音轉換。
- 少樣本TTS: 僅需1分鐘的訓練數據即可微調模型,提升聲音相似度和真實感。
- 跨語言支持: 支持與訓練數據集不同語言的推理,目前支持英語、日語和中文。
- WebUI工具: 集成工具包括聲音伴奏分離、自動訓練集分割、中文自動語音識別(ASR)和文本標注,協助初學者創建訓練數據集和GPT/SoVITS模型。
如果你是 Windows用戶(已在 win>=10上測試),可以直接通過預打包文件安裝。只需下載預打包文件,解壓後雙擊 go-webui.bat 即可啓動 GPT-SoVITS-WebUI。預訓練模型
從 GPT-SoVITS Models 下載預訓練模型,並將它們放置在 GPT_SoVITS\pretrained_models 中。
對於中文自動語音識別(另外),從 Damo ASR Model, Damo VAD Model, 和 Damo Punc Model 下載模型,並將它們放置在 tools/damo_asr/models 中。
對於UVR5(人聲/伴奏分離和混響移除,另外),從 UVR5 Weights 下載模型,並將它們放置在 tools/uvr5/uvr5_weights 中。
數據集格式
文本到語音(TTS)注釋 .list 文件格式:
vocal_path|speaker_name|language|text
語言字典:
- ‘zh’: Chinese
- ‘ja’: Japanese
- ‘en’: English
示例:
D:\GPT-SoVITS\xxx/xxx.wav|xxx|en|I like playing Genshin.


