高效能語言模型推論引擎
它以 Rust 編寫,支援多種模型、量化方法 (GGML, GPTQ, HQQ 等) 和加速器 (CUDA, Metal, CPU),並提供 便捷的 Python API 和 OpenAI 相容的 HTTP 伺服器。 核心功能包括 快速推論、多種量化技術 以提升效能,以及對 LoRA、X-LoRA 等模型調整技術的支援。 附詳細說明安裝、建置、模型取得和使用方法,並提供豐富的範例程式碼與效能基准測試結果。(支援 Mac M 系列)


![]()
高效能語言模型推論引擎 它以 Rust 編寫,支援多種模型、量化方法 (GGML, GPTQ, HQQ 等) 和加速器 (CUDA, Metal, CPU),並提供 便捷的 Python API 和 OpenAI 相容的 HTTP 伺服器。 核心功能包括 快速推論、多種量化技術 以提升效能,以及對 LoRA、X-LoRA 等模型調整技術的支援。 附詳細說明安裝、建置、模型取得和使用方法,並提供豐富的範例程式碼與效能基准測試結果。(支援 Mac M 系列)
Google Gemini AI 打造英語發音矯正 提供即時語音辨識、AI 驅動的發音評估、語法修正和情境對話練習等功能,旨在幫助使用者提升英語口語能力。使用者需要取得Gemini 的 API Key 才能運行。
輸出的 3D 型以 Mixamo 加入 Rigging 教學

輸出的 3D 型以 Mixamo 加入 Rigging 教學
MV-Adapter: Multi-view Consistent Image Generation Made Easy MV-Adapter 是一款多功能的即插即用適配器,可將現有的預先訓練的文本到圖像 (T2I) 擴散模型轉變為多視圖生成器。不同於以往需要完整微調的繁複方法,MV-Adapter 透過更新較少參數,有效降低計算成本並避免過擬合。 它利用創新的雙重自我注意力層和平行注意力架構,高效建模 3D 幾何知識,並整合了條件編碼器以處理不同輸入,例如文字、圖片或幾何資訊。實驗結果顯示,MV-Adapter 在不同基礎 T2I 模型和控制條件下,都能生成高保真、多視角一致的影像,展現其適應性和多功能性,為多視角影像生成設定了新的品質標準。

示範範例: https://SWivid.github.io/F5-TTS