回首頁 / 精選存檔 / 2026-05-30

AI 開源日報 · 精選存檔 · 2026-05-30

每天約 09:00 自動更新,當日精選直接推播到你的 Telegram——免費、無廣告、隨時退訂。

  1. Sulphur-2(文字生成影片模型) 🎬 影音製作
    輸入文字提示,直接生成影片片段的擴散模型(pipeline: text-to-video)。
  2. Supertonic-3(語音合成 TTS) 🎬 影音製作
    文字轉語音模型,附 ONNX 版本利於部署(pipeline: text-to-speech)。
  3. MOSS-TTS v1.5(開源語音合成) 🎬 影音製作
    復旦 MOSS 團隊的開源 TTS 模型(pipeline: text-to-speech)。
  4. nvidia/PiD 🎬 影音製作
    NVIDIA 的圖像轉圖像生成模型(diffusers)。
  5. Stable Audio 3 Medium(文字生成音樂/音效) 🎬 影音製作
    Stability AI 的文字生成音訊模型(pipeline: text-to-audio)。
  6. Microsoft Lens(文字生成圖像) 🎬 影音製作
    微軟釋出的文生圖擴散模型,另有 Lens-Turbo 加速版(pipeline: text-to-image)。
  7. MiniCPM5-1B(端側小鋼炮) 🧱 AI 基礎堆疊
    面壁智能 MiniCPM 系列 1B 小模型,主打端側高效能。
  8. HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive 🧱 AI 基礎堆疊
    Qwen3.6-35B 的去審查(uncensored) GGUF 量化版。
  9. prism-ml/bonsai-image-ternary-4B-gemlite-2bit 🎬 影音製作
    三元權重 2-bit 量化的文生圖模型,主打極致輕量、可在低階硬體跑。
  10. Liquid LFM2.5-8B-A1B(MoE 模型) 🧱 AI 基礎堆疊
    Liquid AI 的 LFM 系列 MoE 模型(8B 參數、A1B 啟用)。
  11. LongCat 數位人影片(美團) 🧱 AI 基礎堆疊
    美團 LongCat 的數位人/虛擬主播影片生成模型(diffusers+onnx)。
  12. bytedance-research/Lance 🧱 AI 基礎堆疊
    字節 3B 啟用參數的原生統一多模態模型(理解+生成)。

每天追最新 AI 開源情報

加入 Telegram 頻道,每天早上自動收到當日精選——免費、無廣告、一鍵退訂。掃碼或點按鈕,30 秒搞定。

掃碼加入 Telegram 頻道
✈️ 掃碼加入 Telegram 頻道