AI infrastructure roles, filterable by the stack you actually work on.
Distributed training · inference serving · GPU fleets · network fabric — aggregated straight from company boards, never a copy of a copy.
1297 open roles · 85 companies · last verified today
294 roles
Inferactinference provider
Singapore · onsite · $200K–$400K/year · unknown
gpu-kernelscudaperformance-engineercpp-langinference
posted 12w ago · verified today
Inferactinference provider
Singapore · onsite · 200K–400K SGD/year · unknown
vllm-engineinferenceinference-engineskv-cache-systemspython-lang
posted 12w ago · verified today
Inferactinference provider
Singapore · onsite · 200K–400K SGD/year · unknown
cluster-datacentergo-langgpu-genericinferencekubernetes-ops
posted 12w ago · verified today
Inferactinference provider
San Francisco · onsite · $200K–$400K/year · unknown
inferenceinference-enginespython-langvllm-enginesoftware-engineer
posted 3mo ago · verified today
Inferactinference provider
San Francisco · onsite · $200K–$400K/year · unknown
tpuinference-enginesjax-pallasperformance-engineerxla-compiler
posted 3mo ago · verified today
Inferactinference provider
Remote · remote · unknown
gpu-kernelsinferenceinference-enginesvllm-enginedistributed-inference
posted 7mo ago · verified today
Inferactinference provider
San Francisco · onsite · $200K–$400K/year · unknown
distributed-inferenceinference-enginesvllm-enginecpp-langgo-lang
posted 7mo ago · verified today
FriendliAIinference provider
Seoul · onsite · mid
amdcpp-langcudacutlass-cutegpu-kernels
posted 4mo ago · verified today
FriendliAIinference provider
Seoul · onsite · senior
gpu-kernelsinferencecpp-langinference-enginespython-lang
posted 4mo ago · verified today
FriendliAIinference provider
San Francisco · hybrid · mid
amdcpp-langcudagpu-genericgpu-kernels
posted 6mo ago · verified today
FriendliAIinference provider
San Francisco · hybrid · mid
solutions-architectgpu-kernelsinference-engineskubernetes-opsobservability
posted 6mo ago · verified today
FriendliAIinference provider
San Francisco · hybrid · senior
cpp-langgpu-kernelsinferenceinference-enginespython-lang
posted 6mo ago · verified today
NexGen Cloudneocloud
London · London, England, United Kingdom, UK - Remote +1 more · remote · unknown
solutions-architectcudacudnn-libdeepspeed-libgpu-generic
posted 8w ago · verified today
Prime Intellectneocloud
San Francisco · onsite · unknown
kubernetes-opsml-platformfine-tuninggpu-genericnvidia
posted 10w ago · verified today
Prime Intellectneocloud
San Francisco · unknown
post-trainingreinforcement-learningresearch-engineerevaluationml-platform
posted 10w ago · verified today
Prime Intellectneocloud
New York City, USA · hybrid · unknown
evaluationpost-trainingdistributed-inferenceray-distributedreinforcement-learning
posted 10w ago · verified today
Prime Intellectneocloud
Remote · San Francisco · unknown
inference-enginesreinforcement-learningresearch-engineersglang-enginevllm-engine
posted 10w ago · verified today
Liquid AIfrontier lab
Boston · hybrid · unknown
cpp-langinferenceinference-enginespython-langevaluation
posted 3w ago · verified today
Liquid AIfrontier lab
Boston · Remote +1 more · hybrid · unknown
cudagpu-genericgpu-kernelsperformance-engineercpp-lang
posted 13mo ago · verified today
Rekafrontier lab
US, UK, Singapore, Remote · remote · unknown
cpp-langcudafine-tuninggpu-genericgpu-kernels
posted 8mo ago · verified today
Poolsidefrontier lab
Remote (EMEA) · remote · unknown
gpu-genericinferencescheduling-orchestrationgo-langinference-engines
posted 9w ago · verified today
Periodic Labsfrontier lab
Menlo Park, CA · onsite · unknown
collectivescudacutlass-cutefsdpgpu-generic
posted 4mo ago · verified today
Thinking Machines Labfrontier lab
San Francisco · hybrid · unknown
reinforcement-learningresearch-engineerdistributed-inferenceinferenceinference-engines
posted 3w ago · verified today
Thinking Machines Labfrontier lab
San Francisco · hybrid · unknown
distributed-inferenceinference-enginesresearch-engineergpu-genericinference
posted 6w ago · verified today
Amazon (AWS)hyperscaler
Palo Alto, California, USA · Seattle, Washington, USA · onsite · mid
ml-platformsoftware-engineerinference-enginesscheduling-orchestrationinference
posted 14d ago · verified today
Amazon (AWS)hyperscaler
Seattle, Washington, USA · onsite · mid
software-engineerml-platformscheduling-orchestrationgpu-genericinference
posted 14d ago · verified today
Nscaleneocloud
London · UK · senior
evaluationfine-tuninggpu-genericinferenceinference-engines
posted 5mo ago · verified today
Amazon (AWS)hyperscaler
Austin, Texas, USA · onsite · mid
custom-asicrtl-designtrainiumdatacenter-engineerinference-engines
posted 16d ago · verified today
Amazon (AWS)hyperscaler
Cupertino, California, USA · onsite · senior
gpu-kernelstrainiumperformance-engineersoftware-engineerinference-engines
posted 16d ago · verified today
Anthropicfrontier lab
New York City, NY · San Francisco, CA +1 more · $405K–$625K · manager
eng-managerinferencescheduling-orchestrationinference-enginescluster-datacenter
posted 15d ago · verified today