Speech-to-speech 語音到語音開源模組

GitHub - huggingface/speech-to-speech: Speech To Speech: an effort for an open-sourced and modular GPT4-o Speech To Speech: an effort for an open-sourced and modular GPT4-o - huggingface/speech-to-speech

Categories: 新聞

kotaemon 一個基於 RAG 的開源工具

GitHub - Cinnamon/kotaemon: An open-source RAG-based tool for chatting with your documents. An open-source RAG-based tool for chatting with your documents. - Cinnamon/kotaemon

Categories: 新聞


MoA : 合拼多模型

(英)MoA 允許您將多個小型模型(稱為「代理人」)组合成一個更強大的模型。 透過採用每層包含多個 LLM 代理程式的分層架構,MoA 僅使用開源模型,在 AlpacaEval 2.0 上的得分為 65.1%,顯著優於 GPT-4 Omni 的 57.5%!

Categories: 工具, 新聞


Hugging Face Spaces 平臺被駭

Hugging Face Spaces平臺被駭,緊急呼籲用戶重設憑證 Hugging Face於5月31日發布資安公告,他們偵測到ML應用代管平臺Spaces有未經授權的存取活動,緊急註銷多筆包含其中的HF令牌,並以電子郵件通知受影響用戶

Categories: 新聞

[2405.15556] RobustRAG 針對檢索攻擊的第一個防禦框架

RobustRAG 採用隔離然後聚合策略 檢索增強生成(RAG)已被證明容易受到檢索損壞攻擊:攻擊者可以將惡意段落注入檢索結果以引發不準確的回應。對於某些查詢,RobustRAG 始終可以返回準確的回應,即使攻擊者完全了解我們的防禦並可以任意注入少量惡意段落。我們在開放域 QA 和長格式文字產生資料集上評估 RobustRAG,並證明其在各種任務和資料集上的有效性和通用性。檢索增強生成(RAG)已被證明容易受到檢索損壞攻擊:攻擊者可以將惡意段落注入檢索結果以引發不準確的回應。

Categories: 工具, 新聞

ComfyUI – Stable Diffusion 用於生產

展示如何在 Stable Diffusion Modal 上開發 ComfyUI 工作流程以及如何將該工作流程轉換到可擴展的 API 端點。 作者於 2024 年 5 月 16 日 更新,以反映 ComfyUI 範例的最新更新。

展示如何在 Stable Diffusion Modal 上開發 ComfyUI 工作流程以及如何將該工作流程轉換到可擴展的 API 端點。

作者於 2024 年 5 月 16 日 更新,以反映 ComfyUI 範例的最新更新。

Categories: 新聞

用 Ollama 與 AnythingLLM 於本地運行無限 AI 代理 – YouTube

最近 AnythingLLM Desktop 中容許我哋合併 AI Agents。這部影片是了解 Anything LLM 以及如何使用 Olama 在您的設備上本地運行 AI 代理的絕佳介紹。 當 Anything LLM 用於代理,可以指示它去執行抓取網站或概括文檔。影片展示瞭如何使用 Anything LLM 與代理一起抓取網站和概括文檔。

最近 AnythingLLM Desktop 中容許我哋合併 AI Agents。這部影片是了解 Anything LLM 以及如何使用 Olama 在您的設備上本地運行 AI 代理的絕佳介紹。

Unlimited AI Agents running locally with Ollama & AnythingLLM

當 Anything LLM 用於代理,可以指示它去執行抓取網站或概括文檔。影片展示瞭如何使用 Anything LLM 與代理一起抓取網站和概括文檔。

Categories: 新聞

GPT-4o vs Google I/O — A.I. 大戰

此影片介紹了 Google I/O 上公布的最新人工智能 (AI) 進展以及 OpenAI 的驚喜更新。

此影片介紹了 Google I/O 上公布的最新人工智能 (AI) 進展以及 OpenAI 的驚喜更新。

Another glorious battle for AI dominance… GPT-4o vs Google I/O
  • OpenAI 發布了他們的新旗艦模型 GPT-40,它速度更快、更便宜,並將文字、視覺和音頻組合成一個模型。它還可以以多種語氣進行對話,從戲劇性到冷靜。
  • Google 宣布了 Gemini 1.5 Pro,它現在可以處理 200 萬個令牌上下文窗口。為了解決令牌的成本問題,他們發布了一項名為上下文緩存的新功能,並舉辦了一項開發人員比賽,以構建最好的 Gemini 支持的應用程序。
  • Google 的另一個有趣公告是 Firebase data connect,它正式將 Postgress 引入 Firebase。
  • Google 還宣布了新硬件,例如 Trillium tpus 和 Axion 其新的面向數據中心的 ARM 基 CPU,以及 vo,一個生成視頻模型以與 OpenAI Sora 競爭。
  • 視頻以作者對奇點進度的失望結束,因為即使這些模型變得越來越快、越來越便宜,它們也並沒有變得更加智能。
Categories: 新聞

Page 6 of 16
1 4 5 6 7 8 16