AI infrastructure roles, filterable by the stack you actually work on.
Distributed training · inference serving · GPU fleets · network fabric — aggregated straight from company boards, never a copy of a copy.
1296 open roles · 85 companies · last verified today
84 roles
Prime Intellectneocloud
San Francisco · unknown
post-trainingreinforcement-learningresearch-engineerevaluationml-platform
posted 10w ago · verified today
Prime Intellectneocloud
New York City, USA · hybrid · unknown
evaluationpost-trainingdistributed-inferenceray-distributedreinforcement-learning
posted 10w ago · verified today
Prime Intellectneocloud
Remote · San Francisco · unknown
inference-enginesreinforcement-learningresearch-engineersglang-enginevllm-engine
posted 10w ago · verified today
Prime Intellectneocloud
Remote · San Francisco · unknown
cudadeepspeed-libfsdpgpu-kernelsmodel-parallelism
posted 10w ago · verified today
Amazon (AWS)hyperscaler
Cupertino, California, USA · Seattle, Washington, USA · onsite · unknown
python-langtrainiumcpp-langresearch-engineerml-platform
posted 11d ago · verified today
Mistral AIfrontier lab
Amsterdam · Lausanne +3 more · hybrid · unknown
post-trainingreinforcement-learningresearch-engineerevaluationfine-tuning
posted 12d ago · verified today
Thinking Machines Labfrontier lab
San Francisco · hybrid · unknown
reinforcement-learningresearch-engineerdistributed-inferenceinferenceinference-engines
posted 3w ago · verified today
Thinking Machines Labfrontier lab
San Francisco · hybrid · unknown
cudagpu-kernelstriton-langresearch-engineercutlass-cute
posted 6w ago · verified today
Thinking Machines Labfrontier lab
San Francisco · hybrid · unknown
research-engineertraining-frameworksdeepspeed-libgpu-genericmegatron-lm
posted 6w ago · verified today
Thinking Machines Labfrontier lab
San Francisco · hybrid · unknown
distributed-inferenceinference-enginesresearch-engineergpu-genericinference
posted 6w ago · verified today
Thinking Machines Labfrontier lab
San Francisco · hybrid · unknown
gpu-genericresearch-engineergpu-kernelsmodel-parallelismquantization
posted 6w ago · verified today
Amazon (AWS)hyperscaler
Cupertino, California, USA · onsite · senior
training-frameworksdistributed-inferencecluster-datacentercollectivesdatacenter-engineer
posted 3w ago · verified today
Amazon (AWS)hyperscaler
San Francisco, California, USA · onsite · senior
cudagpu-kernelsnvidiapython-langresearch-engineer
posted 3mo ago · verified today
Amazon (AWS)hyperscaler
Santa Clara, California, USA · onsite · unknown
gpu-kernelstraining-frameworksml-platformresearch-engineersoftware-engineer
posted 9mo ago · verified today
Amazon (AWS)hyperscaler
Cupertino, California, USA · onsite · unknown
trainiumcpp-langpython-langgpu-kernelsresearch-engineer
posted 3mo ago · verified today
Amazon (AWS)hyperscaler
Santa Clara, California, USA · onsite · unknown
cudagpu-kernelstriton-langgpu-genericmodel-parallelism
posted 4w ago · verified today
Amazon (AWS)hyperscaler
Houston, Texas, USA · onsite · senior
cudagpu-kernelsmodel-parallelismpytorch-disttraining-frameworks
posted 4w ago · verified today
Cerebraschip vendor
Canada · United States · unknown
python-langevaluationpost-trainingreinforcement-learningfine-tuning
posted 6mo ago · verified today
Baseteninference provider
San Francisco · hybrid · $200K–$275K/year · unknown
post-traininggpu-genericmodel-parallelismpytorch-distresearch-engineer
posted 5mo ago · verified today
SambaNovachip vendor
San Jose, CA · San Jose, California, United States · $220K–$300K · staff plus
fine-tuninginferencesoftware-engineerinference-enginespre-training
posted 4w ago · verified today
Scale AIai startup
New York, NY · San Francisco, CA +1 more · $190K–$237K · unknown
cudaflash-attentioninference-enginesml-platformresearch-engineer
posted 18mo ago · verified today
Modalinference provider
New York · San Francisco · $150K–$350K/year · unknown
inferenceinference-engineskv-cache-systemsquantizationresearch-engineer
posted 10w ago · verified today
xAIfrontier lab
Palo Alto, CA · $180K–$440K/year est. · unknown
gpu-genericpost-trainingpre-trainingpython-langresearch-engineer
posted 5mo ago · verified today
CoreWeaveneocloud
Bellevue, WA · Sunnyvale, CA · $185K–$275K/year est. · staff plus
reinforcement-learningpost-trainingresearch-engineerfine-tuninggpu-generic
posted 5mo ago · verified today
CoreWeaveneocloud
Bellevue, WA · Sunnyvale, CA · $182K–$242K/year est. · senior
gpu-genericpost-trainingpython-langreinforcement-learningresearch-engineer
posted 5mo ago · verified today
OpenAIfrontier lab
London, UK · £170K–£445K/year · unknown
research-engineerpre-trainingevaluation
posted 3mo ago · verified today
OpenAIfrontier lab
San Francisco · Seattle · hybrid · $342K–$555K/year · unknown
cudagpu-kernelsperformance-engineertriton-langcluster-datacenter
posted 5mo ago · verified today
Anthropicfrontier lab
New York City, NY · San Francisco, CA +1 more · $500K–$850K · mid
python-langreinforcement-learningresearch-engineertraining-frameworksfine-tuning
posted 11mo ago · verified today
Anthropicfrontier lab
New York City, NY · San Francisco, CA +1 more · $350K–$500K · unknown
gpu-genericresearch-engineercluster-datacenterkubernetes-opssoftware-engineer
posted 11mo ago · verified today
Anthropicfrontier lab
Boston, MA · New York City, NY +3 more · remote · $350K–$850K · unknown
pre-trainingpython-langresearch-engineergpu-generickubernetes-ops
posted 14mo ago · verified today