Technical Support Engineer (GPU Clusters)
Together AI
Удалённо
Опубликовано менее 24 часов назад
AI-инфраструктура для inference, fine-tuning и GPU-кластеров
Задачи
- Решать сложные технические проблемы клиентов в Kubernetes GPU-кластерах;
- Работать как customer-facing SRE и поддерживать стабильность кластеров;
- Мониторить здоровье GPU-инфраструктуры и сообщать клиентам о hardware-инцидентах;
- Поддерживать production-инфраструктуру: Slurm, node repair, миграции и Kubernetes workloads.
Требования
- 3+ года в customer-facing technical roles, включая поддержку AI-сервиса или критичного SaaS API;
- Опыт SRE или DevOps-инженера с Kubernetes;
- Знание AI, ML, GPU-технологий и HPC-сред;
- Опыт с Slurm, InfiniBand или RDMA, сетями и distributed storage.
#support #ai #devops #technical #engineer
Навыки
Обновлено 5 августа
Ещё вакансии
Похожие вакансии
- DS Systems
Remote Salary: $4,000–8,000 DS Systems — технологическая компания, создающая высоконагруженные B2B-решения в финтехе и антифроде. Наш продукт…
SeniorУдалённоПолная занятость4k–8k $/мессегодня - Россия
Привет! Меня зовут Ирина. Я представляю группу компаний Top Selection. Ищем Java разработчика уровня Senior на проект для крупного банка. Уровень:…
SeniorУдалённоПолная занятость300k–330k ₽/мессегодня - МегафонРоссия
Москва Компания: Мегафон Какие задачи необходимо решать • Участвовать в проработке архитектурных решений необходимых для запуска новых…
MiddleОфисПолная занятостьзп не указанасегодня