AI 開源日報 · 精選存檔 · 2026-05-30
每天約 09:00 自動更新,當日精選直接推播到你的 Telegram——免費、無廣告、隨時退訂。
-
Sulphur-2(文字生成影片模型)
🎬 影音製作
輸入文字提示,直接生成影片片段的擴散模型(pipeline: text-to-video)。
-
Supertonic-3(語音合成 TTS)
🎬 影音製作
文字轉語音模型,附 ONNX 版本利於部署(pipeline: text-to-speech)。
-
MOSS-TTS v1.5(開源語音合成)
🎬 影音製作
復旦 MOSS 團隊的開源 TTS 模型(pipeline: text-to-speech)。
-
nvidia/PiD
🎬 影音製作
NVIDIA 的圖像轉圖像生成模型(diffusers)。
-
Stable Audio 3 Medium(文字生成音樂/音效)
🎬 影音製作
Stability AI 的文字生成音訊模型(pipeline: text-to-audio)。
-
Microsoft Lens(文字生成圖像)
🎬 影音製作
微軟釋出的文生圖擴散模型,另有 Lens-Turbo 加速版(pipeline: text-to-image)。
-
MiniCPM5-1B(端側小鋼炮)
🧱 AI 基礎堆疊
面壁智能 MiniCPM 系列 1B 小模型,主打端側高效能。
-
HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive
🧱 AI 基礎堆疊
Qwen3.6-35B 的去審查(uncensored) GGUF 量化版。
-
prism-ml/bonsai-image-ternary-4B-gemlite-2bit
🎬 影音製作
三元權重 2-bit 量化的文生圖模型,主打極致輕量、可在低階硬體跑。
-
Liquid LFM2.5-8B-A1B(MoE 模型)
🧱 AI 基礎堆疊
Liquid AI 的 LFM 系列 MoE 模型(8B 參數、A1B 啟用)。
-
LongCat 數位人影片(美團)
🧱 AI 基礎堆疊
美團 LongCat 的數位人/虛擬主播影片生成模型(diffusers+onnx)。
-
bytedance-research/Lance
🧱 AI 基礎堆疊
字節 3B 啟用參數的原生統一多模態模型(理解+生成)。
每天追最新 AI 開源情報
加入 Telegram 頻道,每天早上自動收到當日精選——免費、無廣告、一鍵退訂。掃碼或點按鈕,30 秒搞定。