AI infrastructure roles, filterable by the stack you actually work on.
Distributed training · inference serving · GPU fleets · network fabric — aggregated straight from company boards, never a copy of a copy.
1294 open roles · 85 companies · last verified today
614 roles
FluidStackneocloud
Austin, TX · New York, NY +2 more · onsite · $208K–$269K/year · unknown
observabilityreliability-sresoftware-engineercluster-datacenterkubernetes-ops
posted 8w ago · verified today
FluidStackneocloud
Austin, TX · New York, NY +2 more · onsite · $208K–$269K/year · mid
reliability-srecluster-datacentergpu-genericobservabilitysre
posted 8w ago · verified today
FluidStackneocloud
Austin, TX · New York, NY +2 more · onsite · $208K–$269K/year · unknown
reliability-sresrecluster-datacentergpu-genericobservability
posted 3mo ago · verified today
Fireworks AIinference provider
New York · San Mateo · hybrid · $200K–$290K/year · senior
reliability-sresreobservabilitycpp-langgo-lang
posted 4w ago · verified today
Perplexityai startup
London · manager
eng-managerkubernetes-opsterraform-iacgpu-genericml-platform
posted 5w ago · verified today
Perplexityai startup
Palo Alto · San Francisco · $220K–$405K/year · unknown
cluster-datacentercpp-langgpu-genericinferencekubernetes-ops
posted 5mo ago · verified today
Perplexityai startup
New York City · Palo Alto +1 more · $220K–$485K/year · mid
cudagpu-kernelsinferenceinference-enginescutlass-cute
posted 5mo ago · verified today
Cerebraschip vendor
Sunnyvale, CA · Toronto, CAN · hybrid · staff plus
amdinference-enginespython-langsoftware-engineervllm-engine
posted 7w ago · verified today
Cerebraschip vendor
Sunnyvale, CA · Toronto, CAN · hybrid · senior
inferenceinference-engineskubernetes-opsml-platformpython-lang
posted 9w ago · verified today
Cerebraschip vendor
Sunnyvale, CA · hybrid · staff plus
inferencereliability-sresreobservabilitycluster-datacenter
posted 10w ago · verified today
Cerebraschip vendor
Canada · United States · senior
amdcpp-langinferenceinference-enginespython-lang
posted 9mo ago · verified today
Baseteninference provider
San Francisco · hybrid · $165K–$330K/year · manager
eng-managercpp-langgo-langgpu-genericinference
posted 3mo ago · verified today
Baseteninference provider
Montreal · New York +2 more · hybrid · $180K–$360K/year · unknown
inference-enginessoftware-engineerdistributed-inferenceinferencekubernetes-ops
posted 3mo ago · verified today
Baseteninference provider
San Francisco · hybrid · $200K–$275K/year · unknown
post-traininggpu-genericmodel-parallelismpytorch-distresearch-engineer
posted 5mo ago · verified today
Baseteninference provider
Montreal · New York +2 more · hybrid · $165K–$330K/year · unknown
cpp-langnetwork-fabricnvidiasoftware-engineercollectives
posted 6mo ago · verified today
Baseteninference provider
Montreal · New York +3 more · hybrid · $165K–$330K/year · unknown
solutions-architectinferenceinference-enginessglang-enginetensorrt-stack
posted 6mo ago · verified today
Baseteninference provider
Montreal · New York +2 more · hybrid · $165K–$330K/year · senior
evaluationgpu-genericperformance-engineerpython-langinference
posted 8mo ago · verified today
Baseteninference provider
New York · San Francisco · hybrid · $165K–$330K/year · senior
fine-tuningml-platformpost-trainingsoftware-engineerkubernetes-ops
posted 7mo ago · verified today
Baseteninference provider
Montreal · New York +2 more · hybrid · $260K–$380K/year · manager
eng-managerinferenceinference-enginespython-langdistributed-inference
posted 4mo ago · verified today
Baseteninference provider
Montreal · New York +2 more · hybrid · $180K–$360K/year · mid
cudainferenceinference-enginestensorrt-stackgpu-generic
posted 11mo ago · verified today
Baseteninference provider
Montreal · New York +2 more · hybrid · $180K–$360K/year · unknown
cpp-langcudagpu-genericgpu-kernelssoftware-engineer
posted 14mo ago · verified today
Baseteninference provider
Montreal · New York +3 more · hybrid · $165K–$330K/year · unknown
inferencekubernetes-opsml-platformpython-langsoftware-engineer
posted 18mo ago · verified today
Baseteninference provider
Montreal · New York +3 more · hybrid · $165K–$330K/year · unknown
kubernetes-opsobservabilityreliability-sresreterraform-iac
posted 4mo ago · verified today
Baseteninference provider
Montreal · New York +2 more · hybrid · $180K–$360K/year · unknown
inferenceinference-engineskv-cache-systemsperformance-engineerquantization
posted 30mo ago · verified today
Anyscaleai startup
San Francisco · hybrid · $200K–$240K/year · mid
reliability-sresrego-langkubernetes-opspython-lang
posted 3w ago · verified today
Anyscaleai startup
Bengaluru, Karnataka · unknown
go-langkubernetes-opspython-langsoftware-engineerml-platform
posted 6w ago · verified today
Anyscaleai startup
San Francisco · hybrid · $200K–$240K/year · mid
kubernetes-opsray-distributedsoftware-engineergo-langml-platform
posted 4w ago · verified today
Anyscaleai startup
Palo Alto · San Francisco · hybrid · $170K–$245K/year · unknown
distributed-inferenceinferenceinference-enginessoftware-engineervllm-engine
posted 3mo ago · verified today
Anyscaleai startup
Bengaluru, Karnataka · unknown
ray-distributedsoftware-engineercpp-langscheduling-orchestrationml-platform
posted 7w ago · verified today
Modalinference provider
Stockholm · mid
inferencesolutions-architectdistributed-inferencefine-tuninggpu-generic
posted 6mo ago · verified today