多模态算法工程师(Agent方向)-智能创作
Core
Building multi-modal AI Agents for intelligent content creation, focusing on visual content production, smart editing, and digital humans.
Role type
Senior IC multi-modal algorithm engineer (AI Agent)
Builds
Multi-modal AI Agents, generative models, and intelligent creation tools for Douyin, Jianying, and other business lines.
Domain
AI / AIGC / Computer Vision / Generative Models
Deliverable
production ML models
Required skills
Multi-modal large models (VLM), Large Language Models (LLM), Reinforcement Learning (RL), Prompt/Context Engineering, Data construction, Post-Training algorithms
Preferred skills
Multi-Agent technology, Visual Chain-of-Thought (COT), World models, AIGC practical experience
Technologies
GRPO, PPO, DPO, Discriminative and Generative Reward Models (RM), RAG
Responsibilities
Explore and research frontier technologies in multi-modal understanding, generative models, and machine learning; Optimize models via data construction, instruction tuning, and preference alignment; Build multi-modal AI Agents and advanced capabilities like multi-modal RAG and visual COT.