Inference & model-serving jobs
Serving roles — GPU, Triton, TensorRT, quantization, latency and throughput.
311 open roles · showing 301–311
-
Member of Technical Staff (Software Engineer)Cerebras · Headquarters/Sunnyvale Office -
Sr. Member of Technical StaffCerebras · Headquarters/Sunnyvale Office -
Senior / Staff ML Training Optimization EngineerWaabi · Remote US & Canada - Kubernetes Platform Engineer - AI Infrastructure ( Golang/Python) - (8+ Years)Cisco · Bangalore, India
-
Machine Learning and AI Specialist-Associate Principal ScientistAstraZeneca · Beijing Yizhuang - Research Engineer, Training & InferenceHarmonic AI · Palo Alto$200k–450k/yr
- Staff Machine Learning Research ScientistSmarterDx · Remote (United States)$220k–260k/yr
-
Forward Deployed Engineer, EcosystemNebius · Remote - United States -
Senior Staff Machine Learning Engineer, Post TrainingAirbnb · Remote - USA$248k–310k/yr -
Principal Model Optimization EngineerRoblox · San Mateo, CA, United States$295k–345k/yr -
Senior Machine Learning Engineer, GenAI SecurityReddit · Remote - United States