추천 검색

Site Reliability Engineer
공고 요약
담당업무
모니터링 시스템 구축 및 운영을 통한 문제 사전 감지와 신속 대응
성능 테스트 환경 구축 및 수행 과정에서 발생하는 문제 해결
계정계·채널계·전사 시스템의 서비스 안정성 고도화
시스템의 안정성, 확장성, 가용성, 관측성, 지연시간 지속 개선
대규모 트래픽 환경의 모니터링 및 분석 시스템 개선과 자동화
장애 발생 시 근본 원인 분석 및 해결
장애 재발 방지를 위한 개발·설계 주도
자격요건
Java 또는 Kotlin, Spring Framework 관련 개발 경험
성능 테스트를 통한 시스템 가용성 확인 및 병목지점 해결 역량
Linux 및 네트워크 시스템에 대한 깊은 이해
MSA, Kubernetes, Istio, Redis, Kafka, ELK 기반 인프라 운영 경험
Mission-Critical 서비스 운영 환경에서의 높은 책임감
변화에 대한 적응력과 새로운 기술을 빠르게 습득하는 역량
복리후생
보너스
근무환경
재택근무
마감기한
상시채용
공고 원문
소개
[합류하게 될 팀에 대해 알려드려요] • 입사 후에는 Server Platform Tribe의 SRE팀에서 Server Developer로 근무해요. • 효과적인 모니터링 시스템을 구축하고 운영하여 문제를 사전에 감지하고 빠르게 대응하고 있으며 장애 시간을 최소화하는데 집중하고 있어요. • 안정적인 서비스의 성장을 지원하기 위한 성능 테스트 환경을 구축하고 수행하는 과정에서 발생한 문제를 해결해요. • 계정계 시스템과 채널계 시스템 뿐만 아니라 전사 시스템을 대상으로 서비스 안정성을 고도화하기 위한 활동을 해요.
주요업무
[합류하면 함께할 업무예요] • 시스템의 Stability, Scalability, Availability, Observability 그리고 Latency를 지속적으로 개선시켜 나가요. • 대규모 트래픽 환경에서 빠르게 원인을 분석할 수 있도록 모니터링 및 분석 시스템을 지속적으로 개선하고 자동화 해요. • 장애 발생 시 근본 원인을 찾아 문제를 해결하고, 재발 방지를 위한 개발과 설계를 주도하며 해법을 마련해요.
자격요건
[이런 분과 함께하고 싶어요] • Java/Kotlin, Spring Framework 관련 개발 경험과 문제해결 능력이 있는 분이면 좋아요. • 성능 테스트를 통해 시스템의 가용성을 확인하고, 병목지점을 해결할 수 있는 분이면 좋아요. • 리눅스 및 네트워크 시스템에 대한 깊은 이해가 있는 분을 찾아요. • MSA, Kubernetes, Istio, Redis, Kafka, ELK 기반의 인프라 운영 경험이 있는 분이면 좋아요. • Mission-Critical 한 서비스 운영 환경을 즐기며 높은 책임감으로 탄탄한 서비스를 같이 만들어 갈 수 있는 분을 찾아요. • 변화를 두려워하지 않고 새로운 기술에 빠르게 적응하며 지속적인 성장을 원하는 분을 찾아요.
우대사항
[이력서는 이렇게 작성하시는 걸 추천해요] • 그동안의 경험을 단순 나열하는 것이 아닌, 경험 속에서의 임팩트 및 러닝 포인트를 확인하고 싶어요. • 서비스의 안정성을 높이기 위해 스스로 문제를 찾아 해결해 보려고 시도하신 경험이 있는지 궁금해요. • 운영 중인 시스템을 크게 개선한 경험, 또는 새로운 것을 도입해 생산성, 효율성 등을 향상시킨 경험이 있는지 궁금해요. • Dive deep해서 문제를 분석하고 원인을 찾아서 해결한 경험이 있는지 궁금해요. • 대규모 트래픽이나 순간 트래픽이 급증하는 환경을 고려하여 설계부터 효율성을 강조하여 개발한 경험이 있는지 궁금해요. [토스뱅크에서 사용하는 기술] • Kotlin, Java, Gradle • Netty, Spring Mvc, Spring Webflux, Spring Boot, Spring Cloud Gateway, Spring Cloud Config • JPA/Hibernate, MySQL, MongoDB, Oracle Hadoop, Redis, Zookeeper • Kubernetes + Istio, HAproxy, Nginx • GoCD, ArgoCD, Consul, Vault, Git, Docker, Ceph, Harbor • Kafka, ELK, Prometheus + Thanos, Grafana
혜택 및 복지
[이렇게 일해요] • 자율과 책임의 문화: 토스는 Manager가 아닌 Maker들로 구성된 조직으로, 투명한 정보 공유와 수평적인 문화 속에서 구성원 업무에 대한 위임과 신뢰를 바탕으로 세상을 변화 시켜 나가고자 합니다. • 효율적인 업무방식: 가장 중요하고, 큰 영향을 미칠 수 있는 일에 집중합니다. 획일적인 업무 프로세스보다는 데이터 기반의 사고로 적극적으로 토론하며, 가장 효율적인 문제 해결을 위해 협업하고 실행합니다. • 훌륭한 팀과 동료: 각 분야 최고 수준의 역량을 갖춘 인재들이 자율과 책임의 원칙 아래 뛰어난 역량을 발휘하고 있습니다. [이런 지원을 받아요] 1. 자율과 효율의 근무 환경을 제공합니다. • 자율 출퇴근 제도 • 자율 휴가 / 재택근무 • Early Friday & OFF Week 2. 업무와 성장에 몰두할 수 있게끔 지원합니다. • 비포괄임금제 운영 • 업무 관련 비용 100% 지원 • 최고급 장비 및 소프트웨어 제공 • 반기별 성과급 지급 • 매월 통신비 및 체력단련비 지원 • 명절 상여금 및 생일축하비 • 직장단체보험비(가족 포함) 및 경조사비 • 인재추천비 500만원 3. 먹고 마시는 것까지 회사가 책임집니다. • 법인카드 전원 지급 (점심/저녁 식사비용, 야간교통비 등 100% 지원) • 사내카페 커피 Silo 무료 이용 • 사내 편의점, 헤어살롱 등 복지시설 무료 이용
이런 공고는 어때요?

엘리스그룹
5년~10년 · 정규직 · 서울

미리비트
5년~10년 · 정규직 · 경기

vox.ai
1년~9년 · 정규직 · 서울

몬드리안에이아이
5년~20년 · 정규직 · 인천

피트인
7년~10년 · 정규직 · 기타

와탭랩스
6년~10년 · 정규직 · 서울

더페어글로벌
4년~10년 · 정규직 · 서울

미리디
3년~6년 · 정규직 · 서울

블리츠다이나믹스
3년~10년 · 정규직 · 서울
.png)
윤회
3년~10년 · 정규직 · 서울

메크랩
3년~10년 · 정규직 · 기타

스콘에이아이(SconAI)
1년~3년 · 정규직 · 서울
프라임엔시스템
1년~20년 · 정규직 · 서울

페이타랩
10년 이하 · 정규직 · 서울

클루닉스
8년~20년 · 정규직 · 서울

미리디
8년~20년 · 정규직 · 서울

알엑스
5년~10년 · 정규직 · 서울

두노소프트
9년~20년 · 계약직 외 1개 · 서울

데이터라이즈
3년 이상 · 정규직 · 서울

미리비트
3년~10년 · 정규직 · 경기



