Technical Support Engineer (GPU Clusters)
Together AI
Удалённо
Опубликовано менее 24 часов назад
AI-инфраструктура для inference, fine-tuning и GPU-кластеров
Задачи
- Решать сложные технические проблемы клиентов в Kubernetes GPU-кластерах;
- Работать как customer-facing SRE и поддерживать стабильность кластеров;
- Мониторить здоровье GPU-инфраструктуры и сообщать клиентам о hardware-инцидентах;
- Поддерживать production-инфраструктуру: Slurm, node repair, миграции и Kubernetes workloads.
Требования
- 3+ года в customer-facing technical roles, включая поддержку AI-сервиса или критичного SaaS API;
- Опыт SRE или DevOps-инженера с Kubernetes;
- Знание AI, ML, GPU-технологий и HPC-сред;
- Опыт с Slurm, InfiniBand или RDMA, сетями и distributed storage.
#support #ai #devops #technical #engineer
Skills
Updated January 21, 1970
More jobs
Similar jobs
- DS Systems
Remote Salary: $4,000–8,000 DS Systems — технологическая компания, создающая высоконагруженные B2B-решения в финтехе и антифроде. Наш продукт…
SeniorRemoteFull-time4k–8k $/motoday - Russia
Привет! Меня зовут Ирина. Я представляю группу компаний Top Selection. Ищем Java разработчика уровня Senior на проект для крупного банка. Уровень:…
SeniorRemoteFull-time300k–330k ₽/motoday - МегафонRussia
Москва Компания: Мегафон Какие задачи необходимо решать • Участвовать в проработке архитектурных решений необходимых для запуска новых…
MiddleOfficeFull-timesalary not specifiedtoday