Audiobox 是 Meta 的新音訊生成基礎研究模型。 集 TTS、聲效、音樂於一身。它結合使用語音輸入和自然語言文字提示來產生語音和聲音效果,從而可以輕鬆地為創建任何音訊。 Audiobox 模型系列亦包括專業模型 Audiobox Speech 和 Audiobox Sound,所有 Audiobox 型號都基於共享的自我監督模型 Audiobox SSL 構建。
Genmo 致力於建立跨模式創作和分享生成藝術的工具。 我們正在推動生成模型能力的前沿。 如今的免費平台只需單擊即可社交創作無限量的影片。 Genmo 目前處於測試階段,將來會添加更多內容。
免費版可生成最長 6 秒 2304 x 1280 的高清影片。

亦可控制鏡頭的運鏡方式

Replay v0.2 announcement: image-to-video, longer length, high resolution
除此,Genmo 亦提供生成圖片,文字對話等。

無縫 M4T
Meta 三個月前公佈的 SeamlessM4T (Massively Multilingual and Multimodal Machine Translation model) ,目前已更新到 v2,於 GitHub 開放下載最新的源碼。SeamlessM4T v2 採用 UnitY2 架構的更新版本。與 SeamlessM4T v1 相比,此新模型在品質以及語音生成任務中的推理延遲方面有所改進。
M4T 是一體式大規模多語言和多模式的機器翻譯模型,可為近 100 種語言的語音和文字提供高品質翻譯。
SeamlessM4T 模型支援以下任務:
- 語音轉語音翻譯 (S2ST)
- 語音轉文字翻譯 (S2TT)
- 文字轉語音翻譯 (T2ST)
- 文本到文本翻譯 (T2TT)
- 自動語音辨識 (ASR)

互動式工作流程,其中人工智慧生成僅用作繪畫時的一種協同工具。
- Inpaint:使用 Krita 的選擇工具標記區域並刪除或取代影像中的現有內容。簡單的文字提示可用於指導生成。
- Outpaint:擴展畫布,選擇空白區域並自動填入與現有影像無縫融合的內容。
- 生成:透過用文字或現有圖像描述它們,從頭開始創建新圖像。支援SD1.5和SDXL。
- 優化:使用強度滑桿優化現有影像內容,而不是完全取代它。這也非常適合透過繪製(粗略)近似值並以高強度進行細化來為影像添加新內容!
- 即時繪畫:讓人工智慧即時解讀您的畫布以獲得即時回饋。看影片
- 控制:直接使用草圖或線條藝術指導圖像創建。使用現有影像或 3D 場景的深度或法線貼圖。從快照傳送角色姿勢。使用分割圖控制構圖。
- 決議:在任何決議下都能有效率地工作。該插件將自動使用適合 AI 模型的分辨率,並縮放它們以適合您的圖像區域。
- 升級:將影像升級並豐富至 4k、8k 以上,而不會耗盡記憶體。
- 作業佇列:根據硬體的不同,影像產生可能需要一些時間。該插件允許您在處理圖像時排隊和取消作業。
- 歷史:並非每張圖像都會成為傑作。隨時預覽結果並瀏覽前幾代和提示。
- 強大的預設設定:多功能的預設樣式預設允許簡單的 UI 覆蓋許多場景。
- 自訂:建立您自己的預設 – 選擇穩定擴散檢查點、新增 LoRA、調整取樣器等。
[英文] 詳細教學:
This One Simple Plugin Adds Realtime AI Assistance to Krita
Seaart.ai | Free AI drawing software for Android, Apple and PC!
SeaArt AI – an art creation platform for all people, discover creativity, capture inspiration, and create instantlySeaArt AI 藝術創作平台,發現創造力,捕捉靈感,即時創作

適合
- Create Art – 創作藝術
- Train or upload models – 訓練或上傳模型
- Discussion with partners – 與合作夥伴討論
- (I am a model creator) – 我是模型創作者
- Want to see beautiful creations – 想看美麗的作品
- Chat with Character AI – 與角色 AI 聊天
網站暫時只能夠提供生成 8 個 Frames 嘅 GIF 動畫。
如果你有興趣想產生更長嘅動畫,你可以去呢度下載完整套件:
如果想安裝 Web 介面版本,可以去呢度下載:
我只花了一分鍾,便成功做了一個 “中文 Python 學習工具“。如過想知如何製作,可參考這 Documentation.





