Reliability Engineer, Supercomputing
🇺🇸 San Francisco, CA
$4K - $5K Annual
Posted 1 month ago
Expires September 7, 2026
Thinking Machines Lab is seeking a Reliability Engineer to ensure the dependability of its GPU supercomputing infrastructure. This role involves managing the interface between hardware, firmware, and operating systems to maintain optimal performance for large-scale AI research. The engineer will be responsible for diagnosing and resolving hardware-related issues, collaborating with vendors, and implementing solutions that support the lab's advanced AI experiments.
More Jobs at Thinking Machines Lab
Software Engineer, Platform, Tinker
Thinking Machines Lab
🇺🇸 San Francisco, California
$4K - $5K Annual
Full TimeOn-siteEngineeringProduct
1 month ago
Site Reliability Engineer (SRE)
Thinking Machines Lab
🇺🇸 San Francisco, California
$4K - $5K Annual
Full TimeOn-siteEngineeringOperations
1 month ago
Research Engineer, Tinker, Developer Experience
Thinking Machines Lab
🇺🇸 San Francisco, California
$4K - $5K Annual
Full TimeOn-siteEngineeringProduct
1 month ago
HR Business Partner
Thinking Machines Lab
🇺🇸 San Francisco, California
$2K - $3K Annual
Full TimeOn-siteOperationsLegal
1 month ago