AI infrastructure roles, filterable by the stack you actually work on.

Distributed training · inference serving · GPU fleets · network fabric — aggregated straight from company boards, never a copy of a copy.

1297 open roles · 85 companies · last verified today

187 roles

gpu-kernels

Amazon (AWS)hyperscaler

Seattle, Washington, USA · onsite · manager

eng-managerml-platformperformance-engineercluster-datacentercuda

posted 17d ago · verified today

Amazon (AWS)hyperscaler

Austin, Texas, USA · Cupertino, California, USA +2 more · onsite · junior

trainiumcpp-langpython-langsoftware-engineerdistributed-inference

posted 3w ago · verified today

Amazon (AWS)hyperscaler

Boston, Massachusetts, USA · Seattle, Washington, USA +1 more · onsite · senior

gpu-kernelsinferenceinference-engineskv-cache-systemsperformance-engineer

posted 3w ago · verified today

Crusoeneocloud

Denver, CO - US · onsite · staff plus

inferenceinference-enginesperformance-engineersglang-enginevllm-engine

posted 3w ago · verified today

OpenAIfrontier lab

San Francisco · hybrid · $266K–$445K/year · unknown

software-engineergpu-kernelscpp-langrust-langlinux-kernel

posted 3w ago · verified today

Amazon (AWS)hyperscaler

Tel Aviv-Yafo, Tel Aviv, ISR · onsite · senior

cpp-langgpu-kernelsperformance-engineerpython-langtrainium

posted 3w ago · verified today

OpenAIfrontier lab

San Francisco · hybrid · $295K–$380K/year · unknown

software-engineertrainiumgpu-kernelsinferenceinference-engines

posted 4w ago · verified today

Amazon (AWS)hyperscaler

Austin, Texas, USA · Cupertino, California, USA · onsite · mid

cpp-langcustom-asicsoftware-engineergpu-kernels

posted 4mo ago · verified today

Amazon (AWS)hyperscaler

Seattle, Washington, USA · onsite · manager

cudaeng-managerml-platformperformance-engineercluster-datacenter

posted 3mo ago · verified today

Amazon (AWS)hyperscaler

San Francisco, California, USA · onsite · senior

cudagpu-kernelsnvidiapython-langresearch-engineer

posted 3mo ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · Seattle, Washington, USA · onsite · manager

collectivescpp-langcudagpu-kernelsnccl-lib

posted 6w ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · onsite · mid

gpu-kernelsperformance-engineertrainium

posted 5mo ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · Seattle, Washington, USA · onsite · unknown

trainiumsoftware-engineerml-platformtraining-frameworksperformance-engineer

posted 9w ago · verified today

Amazon (AWS)hyperscaler

Seattle, Washington, USA · onsite · unknown

software-engineertrainiumcpp-langlinux-kernelml-platform

posted 5mo ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · Seattle, Washington, USA · onsite · senior

performance-engineersoftware-engineertrainiumgpu-kernelsml-platform

posted 11mo ago · verified today

Amazon (AWS)hyperscaler

Santa Clara, California, USA · onsite · unknown

gpu-kernelstraining-frameworksml-platformresearch-engineersoftware-engineer

posted 9mo ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · Seattle, Washington, USA · onsite · mid

trainiumperformance-engineersoftware-engineercollectivesgpu-generic

posted 7mo ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · onsite · unknown

trainiumcpp-langpython-langgpu-kernelsresearch-engineer

posted 3mo ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · Seattle, Washington, USA · onsite · mid

trainiummodel-parallelismtraining-frameworkscollectivesperformance-engineer

posted 5w ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · Seattle, Washington, USA · onsite · senior

software-engineertrainiummodel-parallelismpre-trainingtraining-frameworks

posted 5w ago · verified today

Amazon (AWS)hyperscaler

Cupertino, California, USA · onsite · manager

eng-managertrainiumgpu-kernels

posted 8w ago · verified today