Fooocus 使用 SDXL – Stable-diffusion XL 版作為產生圖片的核心。SDXL 是一款開源免費的 Clipdrop 技術,通過使用擴展現有的圖像處理算法,可以快速而準確地在不同設備上生成圖片


Fooocus 使用 SDXL – Stable-diffusion XL 版作為產生圖片的核心。SDXL 是一款開源免費的 Clipdrop 技術,通過使用擴展現有的圖像處理算法,可以快速而準確地在不同設備上生成圖片


Bard 迄今功能最強大的模型
使用新版「使用 Google 搜尋」功能,檢查 Bard 的回覆
接續他人分享的對話
更多功能將於所有支援的語言中推出
ALL-E X 是一個強大而創新的多語言文本轉語音(TTS)模型,最初由微軟發佈。雖然微軟最初在他們的研究論文中提出了該概念,但並未發佈任何代碼或預訓練模型。我們認識到了這項技術的潛力和價值,復現並訓練了一個開源可用的VALL-E X模型。我們很樂意與社區分享我們的預訓練模型,讓每個人都能體驗到次世代TTS的威力。 🎧更多細節請查看 model card.
Updated!
[embedyt] https://www.youtube.com/watch?v=td21Xa7fpmQ[/embedyt]Clubhouse Keith 今日在他的輕鬆講科技專題房介紹了這個十分好用的聲音轉文字工具。
audiopen.ai/
FullJourney 是一套強大的人工智能創作平台,它能夠根據簡單的提示詞生成令人難以置信的視頻、圖像、音樂和語音。無論您是想要創建精彩的電影、製作絢麗的圖像,還是生成獨特的音樂和聲音效果,FullJourney 都能夠滿足您的需求。
FullJourney 需要透過 Discord 生成多種獨特而生動的視頻和圖像,這有點與 MidJourney 相似,不過你只要透過 FullJourney 網站進入 Discord,無需付費便可即時使用。
(more…)
Stability AI開發團隊表示,這次推出的SDXL 1.0是Stable Diffusion AI圖像生成所使用的文字到圖像模型的一大革新,並自豪地宣稱它是世界上最佳的開源圖像生成模型。
SDXL由 35 億參數的基礎模型與 66 億參數的細化器組成,針對寫實風格的圖像進行優化,當然亦能處理各種風格的高品質圖像。舊版在手部與複雜構圖上的缺陷已被改善,增強色彩表現,能夠產生更突出的對比、光影效果,而默認輸出 1024 x 1024 的高解析度圖像。
Mac M1 用家如果想用 Stable Diffusion Automatic 1111 1.6 運行 SDXL Checkpoint, 可以作以下調整:
Delete webui-maco-env.sh
Remove export PYTORCH_MPS_HIGH_WATERMARK_RATIO="0.0" in webui-user.sh if exist
Add this env export COMMANDLINE_ARGS="--skip-torch-cuda-test --no-half --use-cpu all"
Stable Diffusion 1.5 Vs SDXL 效果對比 https://imgsli.com/MjA3OTgx
根據官方提供的規格內容,總結 SDXL 1.0 主要改進:
SDXL 1.0 是一個具有多項重要改進的新型圖像生成模型。根據官方提供的規格內容,以下是我的總結:
教程
| 繁體中文 | 简体中文 | English |
| Stable Diffision最新模型SDXL 1.0使用全教程 | How to run SDXL 1.0 model | |
BARK INFINITY 係一個功能強大嘅聲音合成器 A.I. TTS(人工智能文本轉語音)嘅開放源碼項目。由 Suno 團隊開發,基於 GPT 類模型產生語音,與其他的語音生成不同的是它含有創意部分,能夠生成真人語氣、混合語言朗讀,還包括音樂、背景雜音、和簡單的音響效果,亦可以在語音中夾雜笑聲、嘆氣和哭泣等表達。
佢可以將文字轉換成自然流暢嘅語音,俾人聽起嚟實在好似真人咁。佢有好高嘅音質同埋唔同嘅語音風格可供選擇,用家可以根據自己嘅需要同喜好進行設定。
如果你唔想自行安裝,可以去 Suno Discord 試玩,Suno 甚至可以用 txt2song 方式幫你生成歌曲。
我用咗 Tate McRae 嘅 What would you do 第一段歌詞,用 /chirp 指令生成下面的歌: