https://github.com/ufal/SimulStreaming SimulStreaming implements Whisper model for translation and transcription in simultaneous mode (which is known as streaming in the ASR community)
https://www.latentsync.org/de Latent Sync nutzt die Leistung von Stable Diffusion und TREPA, um präzise, hochauflösende Lippensynchronisation für dynamische und realistische Videogenerierung zu liefern.
https://www.wav2lip.org/de Erstellen Sie lippen-synchronisierte Videos aus beliebigem Audio mit Wav2Lip. Probieren Sie unser kostenloses Online-Tool aus, um sofort präzise, hochqualitative Sprechgesicht-Animationen zu erzeugen.