I am an AI Researcher at Descript, working on generative models that power audio and video editing in production. My current focus spans audio codecs, diffusion models and audio-text forced alignment.

Applied Research

  • Audio Regenerate — Seamless word-level audio editing via latent inpainting.
    [project page]

  • Video Regenerate and Translation — Audio-driven lip-sync for editing and translation.
    [project page]

Publications & Submissions

Other Research