Hello2 – 高清 LipSync 工具

GitHub - fudan-generative-vision/hallo2: Hallo2: Long-Duration and High-Resolution Audio-driven Portrait Image Animation Hallo2: Long-Duration and High-Resolution Audio-driven Portrait Image Animation - fudan-generative-vision/hallo2

Categories: 模型, Video, Audio

RF-Inversion – 無需 ControlNet 的圖片編輯

GitHub - LituRout/RF-Inversion: Rectified Flow Inversion (RF-Inversion) (附 ComfyUI Node)Rectified Flow Inversion (RF-Inversion). Contribute to LituRout/RF-Inversion development by creating an account on GitHub.

Categories: 模型, Image, 影像處理


diffusers-image-outpaint 零度解說

超強AI擴圖!完全免費開源,diffusers-image-outpaint,附詳細本地安裝教程!- Diffusers Image Outpaint 是一種基於擴散模型的圖像生成方法。它根據現有圖像內容,生成圖像以外區域,使圖像看起來更自然和完整。

Categories: 模型, Image, 影像處理, 軟件, 工具

DiffSynth-Studio 擴散模型的魔力

DiffSynth Studio 是個擴散引擎 重構了文字編碼器、UNet、VAE等架構,保持與開源社群模型的相容性,同時增強運算效能。

Categories: 模型, Video, Image

Open-LLM-VTuber

透過免持語音互動、語音中斷、Live2D 臉部辨識和跨平臺本地運行的長期記憶與任何 LLM 交談 LLM 推理後端、語音辨識和語音合成器均設計為可交換。此專案可以配置為在 macOS、Linux 和 Windows 上離線運行。也支援線上 LLM/ASR/TTS 選項。

Categories: 模型

CogVideo 文字 > 影片產生

GitHub - THUDM/CogVideo: Text-to-video generation: CogVideoX (2024) and CogVideo (ICLR 2023) Text-to-video generation: CogVideoX (2024) and CogVideo (ICLR 2023) - THUDM/CogVideo

Categories: 模型, Video



Page 36 of 37
1 34 35 36 37