CareerPlanSign in

DNN Model optimization Expert Engineer

Phoenix Building, Bangalore, India💼 Full-time🗓 2026-09-11 → 2026-09-25

Core

Design and implement a neural acceleration platform for on-device execution of GenAI LLM/LVM models, optimizing inference and training on mobile SoCs.

Role type

Senior IC DNN Model optimization Expert Engineer

Builds

Accelerated on-device ML inference & training platform for mobile devices

Domain

Mobile AI, Deep Learning, System-on-Chip (SoC) optimization

Deliverable

production ML models

Required skills

Model optimization (compression, quantization), Neural architecture search, LLM/LVM on-device expertise, Python, C++, Linux, PyTorch/TensorFlow/AI-Edge, Multi-threading/Multicore programming, ARM processor architecture knowledge

Preferred skills

Distributed computing, Compiler development, Low-level optimizations, Research publications & patents

Responsibilities

Design and develop machine learning algorithms for mobile use cases, Lead design of neural acceleration platform, Ensure high-quality code delivery, Refine work backlog with product owners and managers, Identify opportunities to leverage existing platform capabilities

Seniority

Senior, hands-on IC

Sourced via workday · Listed on CareerPlan, which tracks 70,000+ jobs from 20+ sources.