jdopensource/JoyAI-Echo
文字轉影片生成工具,適用於長片。
▸ HF trending 81 · 130 likes · 5,457 下載
回首頁 / 🎬 影音製作
60 看全部 · 每天精選 AI / LLM 開源情報,附繁中說明、為何上榜與商用授權判讀。
文字轉影片生成工具,適用於長片。
▸ HF trending 81 · 130 likes · 5,457 下載
Stability AI 的文字生成音訊模型(pipeline: text-to-audio)。
▸ HF trending 64 · 137 likes · 18,828 下載
復旦 MOSS 團隊的開源 TTS 模型(pipeline: text-to-speech)。
▸ HF trending 75 · 159 likes · 37,852 下載
一款基於轉換器的文本轉語音模型,適用於生成自然語言。
▸ HF trending 82 · 101 likes · 5,872 下載
基於Krea-2-Turbo的風格參考模型,用於文字轉影像。
▸ HF trending 64 · 77 likes · 2,464 下載
使用 Krea2 的文字轉影像模型,支援 FP8 和 ComfyUI。
▸ HF trending 73 · 75 likes · 26,600 下載
將影像轉換為動畫的模型,支援音樂生成舞蹈動作。
▸ HF trending 109 · 145 likes · 2,408 下載
文字轉語音模型,附 ONNX 版本利於部署(pipeline: text-to-speech)。
▸ HF trending 73 · 783 likes · 60,276 下載
文字轉語音模型,適用於即時應用。
▸ HF trending 77 · 187 likes · 7,331 下載
NVIDIA Cosmos3 圖生影片模型(世界模型系列,授權受限)。
▸ HF trending 113 · 114 likes · 4,515 下載
用於影像轉換的控制網路,支援深度、LoRA和Flow Matching。
▸ HF trending 70 · 89 likes
自動語音辨識模型,支援阿拉伯語轉錄。
▸ HF trending 63 · 106 likes · 14,140 下載
將影像轉換為影片的模型,支援 LoRA 和 LTX 技術。
▸ HF trending 60 · 161 likes
用 Flux2Klein 模型調整影像中的光照方向。
▸ HF trending 67 · 126 likes
將文本轉換為語音的合成器。
▸ HF trending 60 · 512 likes · 78,686 下載
NVIDIA Cosmos3 文生圖模型(世界模型系列,授權受限/非商用)。
▸ HF trending 70 · 126 likes · 8,019 下載
將影像轉換為影片的模型,支援多種音影片處理。
▸ HF trending 71 · 101 likes
基於LORA技術的文字轉影像模型,用於生成影像。
▸ HF trending 69 · 112 likes · 5,120 下載
將文字轉換為保留身份的影片,適用於Lora和ComfyUI。
▸ HF trending 85 · 213 likes
微軟釋出的文生圖擴散模型,另有 Lens-Turbo 加速版(pipeline: text-to-image)。
▸ HF trending 67 · 152 likes · 2,306 下載
一款使用 diffusers 技術的文字轉影像模型,支援 LoRA 微調。
▸ HF trending 71 · 170 likes · 4,652 下載
文字轉影像模型,使用擴散和流匹配技術生成影像。
▸ HF trending 64 · 578 likes · 23,488 下載
一個超小型的文本轉語音模型,適用於本地端使用。
▸ HF trending 61 · 206 likes
將影像轉換為動畫影片的AI模型,適用於角色動畫和影片生成。
▸ HF trending 68 · 248 likes
將文本轉換成自然語音的合成器。
▸ HF trending 65 · 198 likes
三元權重 2-bit 量化的文生圖模型,主打極致輕量、可在低階硬體跑。
▸ HF trending 63 · 104 likes · 254 下載
百度 NAVA 文字/圖像生成影片模型(TI2V)。
▸ HF trending 56 · 56 likes · 159 下載
輸入文字提示,直接生成影片片段的擴散模型(pipeline: text-to-video)。
▸ HF trending 59 · 1,757 likes · 933,588 下載
ZONOS2 是一個文字轉語音的工具。
▸ HF trending 61 · 118 likes · 763 下載
NVIDIA 的圖像轉圖像生成模型(diffusers)。
▸ HF trending 80 · 321 likes · 1,092 下載
即時語音識別系統,支援多語言。
▸ HF trending 65 · 890 likes · 541,157 下載
業界最常用的開源「誰在何時說話」語者分離工具(近千萬下載)。
▸ HF trending 56 · 2,536 likes · 8,159,278 下載
將文字轉換成影像的工具,適用於創意設計和藝術創作。
▸ HF trending 60 · 13,187 likes · 592,187 下載
Qwen3-TTS 自訂音色語音合成(1.7B,可克隆指定音色做配音)。
▸ HF trending 54 · 1,565 likes · 1,913,801 下載
從文字提示生成 AI 圖片的桌面應用程式,整合多個繪畫 API。
▸ 近期新建立,已獲 70★
專業的色彩校正、影片編輯和視覺效果軟體,具備高動態範圍工具和即時AI跟蹤。
▸ 近期新建立,已獲 61★
智慧影片編輯技能,提供素材管理、雙語字幕和品牌包裝功能。
▸ 近一日新增 42★(現 172★)
本地化對話式AI影片編輯器,具備多軌時間線和MCP整合。
▸ 近期新建立,已獲 100★
生成半調紙拼貼 B-roll 的技能,使用 Gemini Omni Flash 技術。
▸ 近一日新增 65★(現 473★)
SD WebUI 可攜整合包(含模型/ControlNet/LoRA)— 來源不明,謹慎下載。
▸ 近期新建立,已獲 44★
Sony Vegas Pro 21免費版的影片編輯和後製工具。
▸ 近一日新增 38★(現 130★)
自動化生成類似 Vox 風格的紙拼貼解說影片。
▸ 近一日新增 57★(現 282★)
免費本地執行的穩定擴散模型,適用於AI影像生成。
▸ 近期新建立,已獲 22★
從少量語音片段克隆聲音並生成語音,適用於Qwen3-TTS微調流程。
▸ 近一日新增 19★(現 106★)
一種基於混合專家的影片預訓練方法,適用於具身智慧。
▸ 近一日新增 3★(現 838★)
免費的 Stable Diffusion Web UI,支援影像生成和控制網。
▸ 近一日新增 18★(現 99★)
使用穩定擴散模型的AI工具包,從文字提示生成影像。
▸ 近期新建立,已獲 41★
自動化AI影片工廠,根據簡短描述生成帶字幕的影片。
▸ 近期新建立,已獲 57★
無依賴的瀏覽器影片編輯器,支援AI代理操作。
▸ 近一日新增 5★(現 486★)
統一世界模型推理與評估基礎設施。
▸ 近一日新增 14★(現 238★)
開源的在地端語音與視覺層AI代理框架,支援本地語音迴圈處理。
▸ 近一日新增 19★(現 172★)
純 C++ 音訊模型推理引擎,提供語音識別、文字轉語音等多項功能。
▸ 近一日新增 3★(現 189★)
Pinnacle Studio 相關的音訊編輯指南與顯示設定。
▸ 近期新建立,已獲 32★
未提供描述。
▸ 近期新建立,已獲 36★
DaVinci Resolve Studio的工作流程指南,包括色彩校正和交付設定。
▸ 近期新建立,已獲 76★
將YouTube影片轉換為短影片的開源工具,具備高亮檢測、字幕和翻譯功能。
▸ 近期新建立,已獲 324★
用於Adobe After Effects的動畫自動化框架,支援程式關鍵影格生成和批次渲染。
▸ 近期新建立,已獲 107★
研究支援的代理技能和工具,用於跨平臺的 AI 媒體生產。
▸ 近期新建立,已獲 86★
將程式碼代理轉換為影片工作室,描述文字生成影片。
▸ 近期新建立,已獲 261★
克隆任何人聲音和個性進行即時對話的AI系統。
▸ 近一日新增 8★(現 358★)