Research Engineer / Scientist, Post-training - London
Required skills
Strong programming skills (Python, Git), Expertise in deep learning frameworks (PyTorch, JAX, TensorFlow), Experience with large-scale distributed training of LLMs and VLMs, Hands-on experience with LLM training, alignment, and reinforcement learning, Knowledge of multimodal architectures and applications
Preferred skills
Industry experience, Experience in LLM training with RL, Experience with data processing techniques
Technologies
Python, Git, PyTorch, JAX, TensorFlow, Large Language Models (LLMs), Vision-Language Models (VLMs), multimodal architectures
Responsibilities
Develop and train advanced LLMs and VLMs, including multimodal architectures, Research and implement training methods for enhanced capabilities like instruction following and tool use, Design and optimize data pipelines and training systems for large-scale distributed training, Collaborate with cross-functional teams to integrate models into agentic AI systems, Evaluate model performance and communicate findings to stakeholders, Stay current with advancements in LLMs, VLMs, and related fields
Seniority
Not specified
Domain
AI, Machine Learning, Deep Learning, Natural Language Processing, Computer Vision