Senior Applied Scientist, Real-Time Conversational AI , AGI
Core
Drive research and development of real-time multimodal conversational AI, focusing on foundation models for speech/audio and post-training systems for natural conversational behavior.
Role type
Senior Applied Scientist (Real-Time Conversational AI)
Builds
Large-scale multimodal foundation models and post-training pipelines for real-time speech and audio generation
Domain
AI/ML, Speech & Audio, Conversational AI
Deliverable
production ML models
Required skills
training large-scale foundation models, multimodal model architectures, transformer architectures for speech/audio, Java/C++/Python programming, research ownership, publication record at top-tier venues
Preferred skills
real-time AI systems, post-training methods (RL, reward modeling), real-time interactive systems, speech-to-speech/audio-to-audio generation, distributed training at scale, hardware-informed model design, speech recognition/synthesis, shipping research to production
Technologies
Java, C++, Python, transformers, reinforcement learning, reward modeling, SFT, RLHF/RLAIF
Responsibilities
Design and train large-scale multimodal foundation models for real-time speech and audio; develop reward models and reinforcement learning methods for conversational behavior; advance real-time perception capabilities for concurrent input/output; design evaluation frameworks for real-time conversation quality
Seniority
Senior, hands-on IC