인기 검색

공고 요약
담당업무
HPE PCAI 및 AI Factory 환경 관리·최적화
HPE DL380a, DL325, Cray XD670 컴퓨트 노드와 NVIDIA L40S/H100/H200 GPU 클러스터 관리
InfiniBand NDR 네트워크, VAST·WEKA·Alletra MP 스토리지 운영
vSphere, RHEL/RHOS, Ezmeral Runtime Enterprise, Kubernetes, Rancher Harvester 등 가상화·컨테이너 플랫폼 관리
DCGM, NetQ, Grafana, Exivity 기반 시스템 상태 모니터링 및 장애 대응
근본 원인 분석, 시정 조치 계획, 운영 문서·런북·장애 로그 관리
Ansible, AWX, HPCM, SLURM을 활용한 클러스터 수명주기·프로비저닝·패치 자동화
HPE Ezmeral Unified Analytics, Data Fabric, AI Essentials 및 NVIDIA AI Enterprise 운영
LLM, NLP, Computer Vision, Chatbots 등 컨테이너 기반 AI/ML 워크로드 관리
Jupyter, Spark, Airflow, MLflow, Kubeflow, Ray 등 개발 도구 운영
Keycloak 인증, 역할 기반 접근제어, IAM·자격증명 관리 및 컴플라이언스 지원
서비스 상태 리뷰, 운영 대시보드, SLA 준수 보고 및 L1/L2 지원 엔지니어 역량 강화
HPE Engineering과 패치 검증·릴리스 준비·운영 피드백 협업
자격요건
HPE 서버 및 GPU 기반 컴퓨트 환경 관리 경험
NVIDIA GPU 스택, InfiniBand NDR, Spectrum-X 스위치 지식
VAST, WEKA 또는 Alletra MP 스토리지 관리 경험
vSphere, RHEL, Ezmeral Runtime Enterprise 운영 경험
Kubernetes, Rancher Harvester, KubeSphere, Morpheus 등 컨테이너 플랫폼 경험
Ansible, AWX, NetBox, HPCM, SLURM 기반 자동화·오케스트레이션 경험
Grafana, NetQ, Exivity, DCGM 기반 관측성·모니터링 경험
HPE Ezmeral Unified Analytics·Data Fabric 운영 경험
NVIDIA AI Enterprise, NIMs, NeMO, Triton Inference Server 관련 경험
TensorFlow, PyTorch, Spark, Kubeflow, MLflow, Jupyter 활용 지식
엔터프라이즈 AI·HPC 환경의 플랫폼 운영·모니터링·수명주기 관리 경험
베어메탈 및 컨테이너 인프라 전반의 자동화·오케스트레이션 경험
분석적 사고와 문제 해결 능력, 글로벌 팀과의 커뮤니케이션·협업 능력
운영 개선 과제 주도 및 지원 엔지니어 멘토링 능력
우대사항
HPE ASE 또는 Master ASE 인증(Compute, Storage, Ezmeral)
NVIDIA Certified Professional 또는 NVAIE Certification
RHCE, Kubernetes Administrator(CKA), VMware VCP
AI 인프라 운영의 신뢰성·확장성·서비스 품질 개선 경험
복리후생
건강·웰빙 지원 프로그램
개인 및 전문성 개발 프로그램
경력 목표 달성을 위한 교육 프로그램
근무환경
Hybrid 근무 방식
HPE 오피스 평균 주 2일 근무
글로벌 팀 협업
포용적인 조직문화
기타 지원사항
내부 직무 이동 지원 시 현 관리자 승인 필요
내부 면접 전 현재 관리자에게 사전 통보 필요
Performance Improvement Plan 대상 직원은 내부 지원 불가
마감기한
상시채용
HP 지원하기 전 이력서 Check
시간이 없다면 AI와 한번에 수정해보세요
공고 원문
댓글
HP에 맞는
이력서로 자동 수정하기