About this role
Research Engineer, Voice at Inflection AI. Location: Palo Alto, California, United States. Role: research models, train pipelines, evaluate experiments Requirements: 2-5 years in audio/speech or multimodal ML; PyTorch; large-scale neural models; audio fundamentals; production-ready training and CUDA; diffusion models; strong communication; BS in CS/EE/linguistics; MS/PhD preferred. Category: Research and Development (R&D) Seniority: Mid Level Tools: PyTorch, CUDA, GPU clusters, diffusion models, text-to-speech, speech recognition, audio codecs Commitment: Full Time Workplace: Onsite Languages: English