New opportunity

Senior Engineer – Multimodal ML R&D (Audio, Vision & Language)

Qualcomm India Private Limited · Hyderabad, India

About this role

Design and develop multimodal AI models across audio, vision, and language using transformers, diffusion models, and multimodal fusion techniques. Optimize models for deployment on Snapdragon platforms (CPU, DSP, NPU) and collaborate across hardware, systems, and software teams to transition research into production-ready solutions.

Skills for this role

Multimodal AIGenerative AIVision-Language ModelsAudio AIEdge AIVision TransformersTransformersCNNsDiffusion ModelsPyTorchTensorFlowMultimodal Fusion TechniquesOn-device AI OptimizationModel Optimization for SnapdragonCPUDSPNPUSystems EngineeringCross-functional CollaborationProductization
Senior Engineer – Multimodal ML R&D (Audio, Vision & Language) at Qualcomm India Private Limited – Hyderabad, India | AIJobFever