企业微信-高级研发工程师-大模型推理框架(成都/北京)
Core
Develop and optimize large model inference engines and PD-separated inference scheduling systems to enhance efficiency in large-scale distributed inference.
Role type
Senior IC machine-learning engineer (inference framework)
Builds
High-performance, cost-efficient large model inference systems
Domain
AI infrastructure / Large Language Models
Deliverable
production ML models
Required skills
C/C++, Python, large model inference frameworks (vLLM, SGLang, TensorRT-LLM), parallel strategies (data parallelism, pipeline parallelism), deep learning operator implementation, GPU/AI chip architecture knowledge
Preferred skills
NVLink and GPU RDMA communication experience, system performance analysis and tuning, open-source model architecture analysis
Sourced via tencent · Listed on CareerPlan, which tracks 846,000+ jobs from 20+ sources.