開源 Archives - Page 41 of 43

BFS-Prover 自動定理證明

2025 年 2 月 26 日

最佳優先搜尋 (BFS Best-First Tree Search) 是一種樹狀搜尋演算法，它透過優先從機率最高的節點來運作，屬於簡單和效率演算法，但普遍認為對於證明定理並不是最理想的方法。 BFS-Prover 挑戰了傳統觀點，
提出一種可擴展的專家疊代框架，主要包含了三個創新點：一是策略性數據過濾，二是利用編譯回饋進行直接偏好優化 (DPO) Direct Preference Optimization，三是長度正規化。

Categories: 開源, 推理引擎, 模型

PaliGemma 2 mix 視覺模型

2025 年 2 月 21 日

Google PaliGemma 2 mix 是 Gemma 系列中的一個升級版視覺語言模型，能夠處理多種任務。PaliGemma 2 mix 能夠直接用於大部份常見的場景，提供了不同大小的模型，分別為（3B、10B 和 28B 參數），解析度亦有兩種模式，分別是（224 和 448 像數）。模型擅長處理短文和長文的生成、光學字符識別、影像問答、物件偵測和影像分割等任務，並且可以搭配 Hugging Face Transformers、Keras、PyTorch、JAX 和Gemma.cpp 等工具使用。

🚀本地部署谷歌PaliGemma 2 mix视觉大模型！轻松识别图像！支持标记物体位置！支持ORC提取文字内容！支持自然语言问答、文档理解、视觉问答！5分钟带你掌握本地部署全流程！附全部代码与注释说明

Watch this video on YouTube

Categories: 開源, 視覺模型

DeepSeek & Crawl4AI 爬蟲！

2025 年 2 月 13 日

這影片教你如何使用 DeepSeek AI 和 Crawl4AI 驅動網頁爬蟲，甚至無需編寫任何程式，就能輕鬆地從任何網站收集結構化數據。影片同時亦展示了一個實際案例，講解點樣為公司尋找潛在客戶，包括地址、企業名稱和聯絡方式等資訊，然後將數據匯入試算表進行整理和分析。

Scrape Any Website for FREE & NO CODE Using DeepSeek & Crawl4AI! (Opensource)

Watch this video on YouTube

Categories: 開源, 軟件, 工具

Transformer Lab 桌面 LLM 工作台

2025 年 2 月 12 日

Transformer Lab 是個免費的開源 LLM 工作平台，方便進行微調、評估、匯出和測試，並支援唔同的推理引擎和平台。Transformer Lab 適用於擁有 GPU 或 TPU 的電腦，亦支援 MLX 的 M 系列的蘋果電腦。主要功能包括下載開源模型、智能聊天、計算嵌入、創建和下載訓練數據集、微調和訓練 LLM、以及使用 R A G 與文件互動。

MAC Image

Categories: 開源, 軟件, 工具, RAG

ComfyUI Sonic 音訊對應到嘴型(Lipsync)

2025 年 2 月 12 日

Sonic 不單將音訊對應到嘴型，而是更全面理解音訊的內容和情感，進而產生更自然、更加生動的人像動畫。可以配合 ComfyUI_Sonic 使用。項目亦包括 Realtalk 即時同逼真的音訊驅動人臉生成技術。新增 frame number 選項，可以控制輸出影片的長度。亦可基於音頻長度。

Categories: 開源, ComfyUI, 影像處理, 數字人

YuE 支持粵語的開源音樂模型

2025 年 2 月 9 日

YuE 是一套開源的音樂基礎模型，專為歌詞生成完整歌曲而設計。這個名為 “lyrics2song” 的任務極具挑戰性，因為它需要處理音樂的長時序特性、音樂的複雜性、歌詞的語意，並運用語意增強的音訊雙符記技術、歌詞鏈式思考以及三階段訓練等創新方法，成功生成長達五分鐘的歌曲，並在多種音樂風格和語言中展現了令人印象深刻的結果。（支持生成塑料粵語歌）

GitHub – alisson-anjos/YuE-exllamav2-UI

Contribute to alisson-anjos/YuE-exllamav2-UI development by creating an account on GitHub.

YuE - Local Music Generation with Audio Prompts - FOSS - 6GB VRAM!

Watch this video on YouTube

Categories: 開源, 模型, 音樂

Page Assist 瀏覽器擴充功能

2025 年 2 月 9 日

Page Assist 是一個瀏覽器外掛，透過 Ollama 於本機運行 AI 模型，Page Assist 提供了一個十分完善的 Ollama介面。Page Assist 強調不會收集個人資料，十分注重隱私。專案是由 MIT 授權。

Categories: 開源, Embedding, Ollama, 模型

OpenHealth 開源 AI 健康助理

2025 年 2 月 8 日

OpenHealth 專案是一個開源的 AI 健康助理，作者描述自己五年來花費超過十萬美元、看過三十多位醫生，卻無法確診自體免疫疾病的痛苦過程。受到這個經歷的啟發，他開發了一個開源 AI 工具，可以幫助人們分析自己的醫療記錄，從不同的醫院提取並整理數據，並藉由 AI 模型進行分析，找出潛在的疾病。這個工具的目的是解決醫療資訊分散的問題，讓患者能夠更全面地了解自己的健康狀況，並提供給醫生參考，但作者也強調，此工具僅為輔助診斷，不能取代專業醫療人員的判斷。

Categories: 開源, 工具, Medical醫學

DeepSeek-VL2-small 視覺模型

2025 年 2 月 6 日

DeepSeek-VL2-small 是 DeepSeek-VL2 的小型版本，混合專家 (MoE) 視覺語言模型，旨在提升 DeepSeek-VL 的視覺效能。此模型在視覺問答、光學字元辨識和文件理解等多種任務上展現了卓越的能力。DeepSeek-VL2-small 擁有 28 億(2.8b)個參數，在效能上可與現有的其它開源模型競爭，甚至超越它們。模型的程式碼採用 MIT 許可證，模型本身的使用則受到 DeepSeek 模型許可證的約束，允許商業用途。

Categories: 開源, DeepSeek, 影像處理

DeepRAG 思考式檢索增強生成

2025 年 2 月 6 日

DeepRAG 的框架旨在解決大型語言模型（LLMs）在事實性知識上的不足，特別是它們容易產生幻覺的問題。DeepRAG 的核心思想是將檢索增強生成（RAG）視為一個馬可夫決策過程（MDP），使其能夠更策略性地進行檢索。透過分解式查詢，DeepRAG 可以動態決定是否要檢索外部知識或依賴模型自身的參數化推理，最終提升檢索效率和答案準確性。文中包含相關研究推薦、引用模型/數據集/Spaces 的情況以及論文收藏數量等資訊。

Categories: 開源, RAG

Page 41 of 43

« Previous 1 … 39 40 41 42 43 Next »