Inference & model-serving jobs
Serving roles — GPU, Triton, TensorRT, quantization, latency and throughput.
272 open roles · showing 251–272
-
AI Engineer, Model Quality and PerformanceCerebras · Headquarters/Sunnyvale Office -
AI Researcher (Multimodal Audio/Video Generation)Tavus · San Francisco -
AI Systems Engineer, Codex AgentsOpenAI · San Francisco$230k–385k/yr -
Staff ML Performance Engineer (Inference Optimisation)Wayve · London -
Research Scientist - Frontier AI/ML & Quantum AlgorithmsSygaldry Technologies · San Francisco$200k–300k/yr -
Machine Learning Infra EngineerReducto · San Francisco Office$150k–300k/yr -
Research Engineer, VoiceInflection AI · Palo Alto, California, United States$225k–325k/yr -
ML Infrastructure EngineerNebius · Amsterdam, Netherlands; Remote - Europe; Remote - United States -
Founding Forward Deployed EngineerTamarind Bio · San Francisco - AI Senior Staff Systems EngineerCadence Design Systems · SAN JOSE$137k–254k/yr
-
Software Engineer, Productivity - Inference RuntimeOpenAI · San Francisco$230k–385k/yr -
Engineering Manager, Forward Deployed Engineering (LLM)Baseten · San Francisco$260k–380k/yr -
Member of Technical Staff (Software Engineer)Cerebras · Headquarters/Sunnyvale Office -
Sr. Member of Technical StaffCerebras · Headquarters/Sunnyvale Office -
Senior / Staff ML Training Optimization EngineerWaabi · Remote US & Canada - Kubernetes Platform Engineer - AI Infrastructure ( Golang/Python) - (8+ Years)Cisco · Bangalore, India
-
Machine Learning and AI Specialist-Associate Principal ScientistAstraZeneca · Beijing Yizhuang -
Forward Deployed Engineer, EcosystemNebius · Remote - United States -
Senior Staff Machine Learning Engineer, Post TrainingAirbnb · Remote - USA$248k–310k/yr -
Principal Model Optimization EngineerRoblox · San Mateo, CA, United States$295k–345k/yr -
Senior Machine Learning Engineer, GenAI SecurityReddit · Remote - United States -
Senior Software Engineer II - Applied AI (Remote Eligible)Smartsheet · -REMOTE, USA-$193k–245k/yr