AI 開源日報 · 精選存檔 · 2026-06-10
每天約 09:00 自動更新,當日精選直接推播到你的 Telegram——免費、無廣告、隨時退訂。
-
ideogram-ai/ideogram-4-fp8
🎬 影音製作
文字轉影像模型,使用擴散和流匹配技術生成影像。
-
bosonai/higgs-audio-v3-tts-4b
🎬 影音製作
將文本轉換為語音的合成器。
-
google/magenta-realtime-2
🎬 影音製作
文字轉語音模型,適用於即時應用。
-
nvidia/nemotron-3.5-asr-streaming-0.6b
🎬 影音製作
即時語音識別系統,支援多語言。
-
Sulphur-2(文字生成影片模型)
🎬 影音製作
輸入文字提示,直接生成影片片段的擴散模型(pipeline: text-to-video)。
-
unsloth/gemma-4-12b-it-GGUF
🧱 AI 基礎堆疊
將影像和文本轉換為文本的模型。
-
jdopensource/JoyAI-Echo
🎬 影音製作
文字轉影片生成工具,適用於長片。
-
MisoLabs/MisoTTS
🎬 影音製作
將文本轉換成自然語音的合成器。
-
Stable Audio 3 Medium(文字生成音樂/音效)
🎬 影音製作
Stability AI 的文字生成音訊模型(pipeline: text-to-audio)。
-
MOSS-TTS v1.5(開源語音合成)
🎬 影音製作
復旦 MOSS 團隊的開源 TTS 模型(pipeline: text-to-speech)。
-
Supertonic-3(語音合成 TTS)
🎬 影音製作
文字轉語音模型,附 ONNX 版本利於部署(pipeline: text-to-speech)。
-
nvidia/Cosmos3-Super-Image2Video
🎬 影音製作
NVIDIA Cosmos3 圖生影片模型(世界模型系列,授權受限)。
每天追最新 AI 開源情報
加入 Telegram 頻道,每天早上自動收到當日精選——免費、無廣告、一鍵退訂。掃碼或點按鈕,30 秒搞定。