豆包大模型多模态算法工程师-Data AML
Core
Research and optimize frontier multi-modal large model capabilities for real-world complex tasks, focusing on visual reasoning, streaming video interaction, and multi-modal agents.
Role type
Senior IC multi-modal algorithm engineer (large models)
Builds
Multi-modal large models optimized for cost and efficiency
Domain
Artificial Intelligence / Computer Vision / Reinforcement Learning
Deliverable
production ML models
Required skills
C/C++ or Python, Computer Vision, Machine Learning, Reinforcement Learning, Large Language Models, Visual Reasoning, Video Compression, Model Distillation
Preferred skills
ACM/ICPC or Kaggle awards, Top-tier conference publications (CVPR, NeurIPS, etc.), Leading high-impact projects in LLM or RL
Responsibilities
Explore and research multi-modal understanding and reinforcement learning; Evaluate and optimize multi-modal model capabilities; Drive cost/efficiency optimization via distillation and efficient reasoning.
