Principal HPC Network Engineer — архитектура и оптимизация сетей@ Mirantis
О позиции
Mirantis — это глобальная компания, занимающаяся открытой инфраструктурой, разрабатывающая платформы для Kubernetes, облачных технологий и AI. Мы ищем Principal HPC Network Engineer, который возьмет на себя техническую ответственность за высокопроизводительные сетевые среды, поддерживающие крупномасштабную инфраструктуру HPC и AI/ML. Эта роль предполагает архитектурное проектирование, развертывание, оптимизацию и устранение неполадок сетей InfiniBand и Ethernet.
Чем вы будете заниматься
- Проектирование, развертывание и эксплуатация высокопроизводительных сетей для HPC и AI кластеров.
- Ответственность за архитектуру и оптимизацию сетей InfiniBand.
- Управление коммутаторами, HCAs, менеджерами подсетей и конфигурациями сетей.
- Устранение сложных проблем с задержкой, пропускной способностью, маршрутизацией и подключением в средах InfiniBand и Ethernet.
- Ведение настройки производительности, мониторинга и планирования емкости.
- Развертывание и поддержка решений Fortinet, включая FortiGate, FortiManager и FortiAnalyzer.
- Сотрудничество с командами по вычислениям, хранению и платформам для поддержки операций кластеров.
- Руководство критическими инцидентами, обновлениями сетей, миграциями и новыми развертываниями.
- Определение стандартов сети, операционных процедур и технической документации.
Требования
- Глубокий практический опыт работы с InfiniBand, предпочтительно Mellanox/NVIDIA.
- Сильные знания сетевых технологий, включая TCP/IP, BGP, OSPF, VLANs, QoS и архитектуру сетей.
- Опыт поддержки HPC, дата-центров или крупномасштабной инфраструктуры AI/ML.
- Практический опыт работы с продуктами Fortinet и конфигурацией межсетевых экранов.
- Знание концепций RDMA, MPI и низколатентной сетевой архитектуры.
- Навыки администрирования Linux и автоматизации с использованием Bash или Python.
- Опыт работы с Ansible, Terraform или другими инструментами Infrastructure-as-Code будет плюсом.
- Способность самостоятельно решать сложные технические задачи и выступать в роли старшего специалиста по эскалации.
Будет плюсом
- Опыт работы в международной команде.
- Знание современных методов и технологий в области сетевой безопасности.
- Опыт работы с облачными решениями и платформами.
Что мы предлагаем
- Гибкий график работы и возможность удаленной работы.
- Конкурентоспособная зарплата, зависящая от опыта и места найма.
- Работа с передовыми технологиями NVIDIA, InfiniBand и HPC.
- Возможность влиять на архитектуру и производительность сетей.
- Решение сложных производственных задач, где проектирование сети напрямую влияет на использование GPU и производительность AI.
- Работа в команде, глубоко вовлеченной в Kubernetes и открытые инфраструктурные решения.
- Поддержка профессионального роста и обучения.
- ДМС и другие социальные гарантии.
Вакансия предлагает интересные технические задачи и возможность работы с передовыми технологиями. Однако, отсутствие четкой информации о зарплате может быть минусом.
Формируем профиль успеха...
Анализируем требования вакансии и данные рынка
Обзор рынка
Навыки и требования
Тренды отрасли
Новости AI/Big Data
Загружаем новости отрасли...
Ищем релевантные статьи за последние 6 месяцев