Inference & model-serving jobs
Serving roles — GPU, Triton, TensorRT, quantization, latency and throughput.
352 open roles · showing 351–352
Work
-
Principal Machine Learning Engineer- LLM Fine-tuning and OptimizationAirbnb · United States - AI Platform Support Engineer (US)Lightning AI · New York, New York, United States; San Francisco, California, United States; Seattle, Washington, United States$115k–140k/yr
No roles match those filters.