Sr. Lead AI Engineer (Inference Optimization, FM hosting, AI Platform)
Core
Design, develop, test, deploy, and support AI software components including foundation model training, large language model inference, similarity search, guardrails, model evaluation, experimentation, governance, and observability to improve performance, scalability, cost, and latency of large-scale production AI systems.
Role type
Senior Lead AI Engineer (Inference Optimization, FM hosting, AI Platform)
Builds
Proprietary AI solutions and foundational AI systems for Capital One's banking products and internal associate tools.
Domain
Banking / Financial Services / Large Language Models / Inference Optimization
Deliverable
production ML models
Required skills
LLM inference optimization, foundation model training, similarity search, vector databases, model guardrails, system observability, Python, Go, Scala, Java, C++, C#, hardware utilization optimization, latency reduction, throughput improvement, cost optimization, cross-functional leadership, technical roadmap planning
Preferred skills
Cloud platform deployment (AWS, Google Cloud, Azure), complex AI system integration, team mentorship, novel research application, hardware/software/AI expertise
Technologies
AWS Ultraclusters, Huggingface, VectorDBs, Nemo Guardrails, PyTorch, Python, Go, Scala, Java, C++, C#
Responsibilities
Partner with cross-functional teams to deliver AI-powered products; design and deploy AI components; invent state-of-the-art LLM optimization techniques; contribute to technical vision and long-term roadmap of foundational AI systems.
Seniority
Senior, hands-on IC with leadership responsibilities