pyannote/speaker-diarization-3.1
automatic-speech-recognition · pyannote-audio, pyannote, pyannote-audio-pipeline
Home / AI Build Ideas / P004
上傳音檔,自動產出標好發言人的逐字稿、多語翻譯與重新配音、社群封面。
①SaaS 訂閱(按時數) ②單次付費 ③免費額度導流。網頁端可放 Adsterra,下載/工具站避開 AdSense。
pyannote 分離說話者 + (Whisper)轉錄 → Qwen3.6 摘要/翻譯 → supertonic 產多語配音 → Lens 生封面 → 打包成可分享成品。
automatic-speech-recognition · pyannote-audio, pyannote, pyannote-audio-pipeline
text-to-speech · supertonic, onnx, text-to-speech
text-to-image · diffusers, safetensors, text-to-image