Site Reliability Engineer

Site Reliability Engineer

토스증권 소속
정규직

합류하게 될 팀에 대해 알려드려요

  • Site Reliability Engineer는 Server Chapter 소속으로, SRE Team에 속해 업무해요.
  • 토스증권 SRE Team은 서비스의 높은 신뢰성과 안정성을 책임져요.
  • 대규모 트래픽 환경에서 이상 징후를 사전에 감지하고 빠르게 대응할 수 있도록 효과적인 모니터링 시스템을 설계하고 운영해요.
  • 서비스가 성장하는 과정에서 발생한 문제를 해결하고, 재발 방지를 위한 설계와 해법을 마련해요.

토스증권 서버 챕터는

  • 무언가를 함께 만들어내서, 보다 나은 가치를 만들고자 하는 동료들이 정말 많아요. 예를 들어, 아이디어를 냈을 때 "이래서 안 돼!", “이미 잘 되고 있는데 굳이 바꿔야 하는 거야?” 보다 "이렇게 하면 그걸 해낼 수 있겠다."라는 마인드를 가진 분들 말이죠. 자신의 의견을 서슴지 않게 이야기할 수 있고, 어떤 생각이라도 비난하거나 질책하지 않고 경청해 주고 협의해 나갈 수 있는 분위기의 챕터에요.
  • 기술 토론을 좋아하고, 스터디도 많이 하고 있어요. 오시면 그동안 학습이 부족하셨던 분들도 저절로 풍월을 읊게 되고, 평소 많이 하셨던 분들은 공부한 것을 실무에 적용할 부분을 탐구해 보는 신세계를 경험할 수 있어요.
  • 작게는 코드리뷰부터, 크게는 엔지니어링데이와 서버 챕터 위클리에 이르기까지 서버 개발자들의 강력한 횡적 협업을 지탱하는 커뮤니티가 있어요.

합류하면 함께할 업무예요

☑️안정적인 서비스를 위한 장애 예방 및 대응을 담당해요.

  • 장애 발생 시 누구보다 빠르게 대응하고, 서비스 영향도를 최소화하기 위한 대응 프로세스를 설계하고 운영해요.
  • 장애의 근본 원인(RCA)을 분석하고, 사전·사후 탐지 역량을 강화해 복구 시간을 단축하며 재발을 방지할 수 있는 시스템을 구축해요.

☑️서비스 가시성과 가용성을 확보해요.

  • 인프라, 네트워크, Kubernetes 환경 전반의 가시성을 확보하고, 이를 실제 서비스 지표와 유기적으로 연결할 수 있는 환경을 구축해요.
  • 문제 상황을 명확히 정의하기 위해 SLO를 수립하고, 필요한 메트릭을 수집해 알림(Alert) 시스템을 지속적으로 고도화해요.
  • 트래픽 증가에 대비해 병목이 발생할 수 있는 컴포넌트를 선제적으로 찾아내고, 구조를 개선해요.

☑️문제에 대해 심층적으로 분석하고, 원인을 규명해요.

  • 서비스 장애 발생 시 로그 분석에 그치지 않고, eBPF, 메모리, 네트워크, 커널 영역까지 폭넓게 분석해 복합적인 원인을 찾아내요.
  • 애플리케이션 내부 동작을 정밀하게 분석해, 최적의 리소스 설정 가이드를 개발팀에 제시해요.

☑️운영 자동화 및 내부 도구를 개발해요.

  • 반복적이고 패턴화된 분석 작업을 자동화하고, 운영 효율을 저해하는 요소를 찾아, 개선할 수 있는 도구를 직접 개발해요.
  • 서비스 신뢰성을 높이기 위한 테스트 환경을 자동화하고, 동료들이 쉽게 활용할 수 있도록 제공해요.

이런 분과 함께하고 싶어요

  • 성장하는 서비스에 맞춰 확장 가능한 아키텍처로 전환하거나, 구조적 개선을 통해 대규모 트래픽을 안정적으로 처리하는 서비스로 성장시킨 경험이 있으면 좋아요.
  • 단순히 프레임워크의 사용보다는 동작 원리를 이해하고, 언어의 구분 없이 성능 최적화 관점에서 코드를 바라볼 수 있는 분이 필요해요.
  • 복잡한 분산 환경에서 발생하는 문제를 논리적으로 접근해, 근본 원인을 끝까지 추적하는 집요함을 갖춘 분을 찾고 있어요.
  • Linux OS와 커널, 네트워크 프로토콜(TCP/IP)에 대한 탄탄한 기본기를 바탕으로 로우 레벨 분석이 가능하신 분을 찾아요.
  • 단순히 테스트를 수행하는 데 그치지 않고, “동료들이 테스트를 더 쉽고 자동화된 방식으로 할 수 있도록” 고민하며 테스트 플랫폼이나 환경을 구축해 본 경험이 있으면 좋아요.
  • 비효율적인 반복 업무를 문제로 인식하고, 이를 코드로 해결해 시스템화해 본 경험이 있으면 좋아요.

이력서는 이렇게 작성하시는 걸 추천해요

  • 단순한 프로젝트 결과의 나열보다는, 그 결과를 도출하기 위해 치열하게 고민했던 과정을 중심으로 작성해 주세요.
  • 애플리케이션 레벨의 최적화 경험(JVM 튜닝 등)과 시스템 레벨의 트러블슈팅 경험(커널/네트워크 분석)이 균형 있게 드러나면 좋아요.
  • 장애 회고(Post-mortem)를 통해 운영 프로세스를 개선하거나, 재발 방지 대책을 시스템에 반영한 경험이 있다면 함께 공유해 주세요.

서버 플랫폼팀이 사용하는 기술

  • Language & Framework : Java, Kotlin, Spring Boot, JPA/Hibernate
  • Scripting & Tooling : Python, Shell Script, Go, k6
  • Deep Analysis : Linux(Kernel/Network), tcpdump, Wireshark, eBPF, heapdump, async profiler
  • Infrastructure : Kubernetes, Istio, Nginx, Kafka
  • Observability : Prometheus, Thanos, Grafana, ELK Stack
  • CI/CD : GoCD, ArgoCD, GitHub Actions, Harbor
  • Database : MySQL, MongoDB, Oracle, Redis

토스증권으로의 합류 여정

  • 서류접수 > 직무 인터뷰 > 문화적합성 인터뷰 > 레퍼런스 체크 > 처우협의 > 최종합격 및 입사

꼭 확인해 주세요

  • 이력서 및 제출 서류에 허위 사실이 발견되거나 근무 이력 중 징계사항이 확인될 경우, 채용이 취소될 수 있어요.
  • 토스증권 내규에 따라 채용 금지자 또는 결격사유 해당자는 채용이 취소될 수 있어요.
  • 장애인 및 국가보훈대상자는 지원 시 관련법에 따라 우대하고 있어요.
  • 입사 시 직무명은 Server Developer가 될 예정이에요.
  • 최종 합격 시, 적합도에 따라 제픔 조직으로의 배치도 고려될 수 있어요.

함께할 동료를 위한 한마디

"코드 한 줄부터 패킷 하나까지, 시스템의 가장 깊은 곳을 탐험하며 성장의 즐거움을 느끼고 있어요."

  • 단순히 장애를 막는 것을 넘어, 서비스가 가진 성능의 한계를 넓히는 일을 해요. Java 애플리케이션의 Heap 메모리부터 커널까지, 문제의 원인이 있는 곳이라면 어디든 깊게 파고들어요. "왜 느려졌을까?", "어떻게 하면 더 효율적일까?"라는 질문을 끈질기게 던지며, 반복되는 운영 업무는 과감히 코드로 자동화 해요. 복잡한 문제를 논리적으로 해결했을 때의 짜릿함, 그리고 내가 만든 테스트 플랫폼이 동료들의 시간을 아껴줄 때의 뿌듯함을 함께 느끼고 싶은 분을 기다려요!
지원하기
토스증권 소속
정규직

합류하게 될 팀에 대해 알려드려요

  • Site Reliability Engineer는 Server Chapter 소속으로, SRE Team에 속해 업무해요.
  • 토스증권 SRE Team은 서비스의 높은 신뢰성과 안정성을 책임져요.
  • 대규모 트래픽 환경에서 이상 징후를 사전에 감지하고 빠르게 대응할 수 있도록 효과적인 모니터링 시스템을 설계하고 운영해요.
  • 서비스가 성장하는 과정에서 발생한 문제를 해결하고, 재발 방지를 위한 설계와 해법을 마련해요.

토스증권 서버 챕터는

  • 무언가를 함께 만들어내서, 보다 나은 가치를 만들고자 하는 동료들이 정말 많아요. 예를 들어, 아이디어를 냈을 때 "이래서 안 돼!", “이미 잘 되고 있는데 굳이 바꿔야 하는 거야?” 보다 "이렇게 하면 그걸 해낼 수 있겠다."라는 마인드를 가진 분들 말이죠. 자신의 의견을 서슴지 않게 이야기할 수 있고, 어떤 생각이라도 비난하거나 질책하지 않고 경청해 주고 협의해 나갈 수 있는 분위기의 챕터에요.
  • 기술 토론을 좋아하고, 스터디도 많이 하고 있어요. 오시면 그동안 학습이 부족하셨던 분들도 저절로 풍월을 읊게 되고, 평소 많이 하셨던 분들은 공부한 것을 실무에 적용할 부분을 탐구해 보는 신세계를 경험할 수 있어요.
  • 작게는 코드리뷰부터, 크게는 엔지니어링데이와 서버 챕터 위클리에 이르기까지 서버 개발자들의 강력한 횡적 협업을 지탱하는 커뮤니티가 있어요.

합류하면 함께할 업무예요

☑️안정적인 서비스를 위한 장애 예방 및 대응을 담당해요.

  • 장애 발생 시 누구보다 빠르게 대응하고, 서비스 영향도를 최소화하기 위한 대응 프로세스를 설계하고 운영해요.
  • 장애의 근본 원인(RCA)을 분석하고, 사전·사후 탐지 역량을 강화해 복구 시간을 단축하며 재발을 방지할 수 있는 시스템을 구축해요.

☑️서비스 가시성과 가용성을 확보해요.

  • 인프라, 네트워크, Kubernetes 환경 전반의 가시성을 확보하고, 이를 실제 서비스 지표와 유기적으로 연결할 수 있는 환경을 구축해요.
  • 문제 상황을 명확히 정의하기 위해 SLO를 수립하고, 필요한 메트릭을 수집해 알림(Alert) 시스템을 지속적으로 고도화해요.
  • 트래픽 증가에 대비해 병목이 발생할 수 있는 컴포넌트를 선제적으로 찾아내고, 구조를 개선해요.

☑️문제에 대해 심층적으로 분석하고, 원인을 규명해요.

  • 서비스 장애 발생 시 로그 분석에 그치지 않고, eBPF, 메모리, 네트워크, 커널 영역까지 폭넓게 분석해 복합적인 원인을 찾아내요.
  • 애플리케이션 내부 동작을 정밀하게 분석해, 최적의 리소스 설정 가이드를 개발팀에 제시해요.

☑️운영 자동화 및 내부 도구를 개발해요.

  • 반복적이고 패턴화된 분석 작업을 자동화하고, 운영 효율을 저해하는 요소를 찾아, 개선할 수 있는 도구를 직접 개발해요.
  • 서비스 신뢰성을 높이기 위한 테스트 환경을 자동화하고, 동료들이 쉽게 활용할 수 있도록 제공해요.

이런 분과 함께하고 싶어요

  • 성장하는 서비스에 맞춰 확장 가능한 아키텍처로 전환하거나, 구조적 개선을 통해 대규모 트래픽을 안정적으로 처리하는 서비스로 성장시킨 경험이 있으면 좋아요.
  • 단순히 프레임워크의 사용보다는 동작 원리를 이해하고, 언어의 구분 없이 성능 최적화 관점에서 코드를 바라볼 수 있는 분이 필요해요.
  • 복잡한 분산 환경에서 발생하는 문제를 논리적으로 접근해, 근본 원인을 끝까지 추적하는 집요함을 갖춘 분을 찾고 있어요.
  • Linux OS와 커널, 네트워크 프로토콜(TCP/IP)에 대한 탄탄한 기본기를 바탕으로 로우 레벨 분석이 가능하신 분을 찾아요.
  • 단순히 테스트를 수행하는 데 그치지 않고, “동료들이 테스트를 더 쉽고 자동화된 방식으로 할 수 있도록” 고민하며 테스트 플랫폼이나 환경을 구축해 본 경험이 있으면 좋아요.
  • 비효율적인 반복 업무를 문제로 인식하고, 이를 코드로 해결해 시스템화해 본 경험이 있으면 좋아요.

이력서는 이렇게 작성하시는 걸 추천해요

  • 단순한 프로젝트 결과의 나열보다는, 그 결과를 도출하기 위해 치열하게 고민했던 과정을 중심으로 작성해 주세요.
  • 애플리케이션 레벨의 최적화 경험(JVM 튜닝 등)과 시스템 레벨의 트러블슈팅 경험(커널/네트워크 분석)이 균형 있게 드러나면 좋아요.
  • 장애 회고(Post-mortem)를 통해 운영 프로세스를 개선하거나, 재발 방지 대책을 시스템에 반영한 경험이 있다면 함께 공유해 주세요.

서버 플랫폼팀이 사용하는 기술

  • Language & Framework : Java, Kotlin, Spring Boot, JPA/Hibernate
  • Scripting & Tooling : Python, Shell Script, Go, k6
  • Deep Analysis : Linux(Kernel/Network), tcpdump, Wireshark, eBPF, heapdump, async profiler
  • Infrastructure : Kubernetes, Istio, Nginx, Kafka
  • Observability : Prometheus, Thanos, Grafana, ELK Stack
  • CI/CD : GoCD, ArgoCD, GitHub Actions, Harbor
  • Database : MySQL, MongoDB, Oracle, Redis

토스증권으로의 합류 여정

  • 서류접수 > 직무 인터뷰 > 문화적합성 인터뷰 > 레퍼런스 체크 > 처우협의 > 최종합격 및 입사

꼭 확인해 주세요

  • 이력서 및 제출 서류에 허위 사실이 발견되거나 근무 이력 중 징계사항이 확인될 경우, 채용이 취소될 수 있어요.
  • 토스증권 내규에 따라 채용 금지자 또는 결격사유 해당자는 채용이 취소될 수 있어요.
  • 장애인 및 국가보훈대상자는 지원 시 관련법에 따라 우대하고 있어요.
  • 입사 시 직무명은 Server Developer가 될 예정이에요.
  • 최종 합격 시, 적합도에 따라 제픔 조직으로의 배치도 고려될 수 있어요.

함께할 동료를 위한 한마디

"코드 한 줄부터 패킷 하나까지, 시스템의 가장 깊은 곳을 탐험하며 성장의 즐거움을 느끼고 있어요."

  • 단순히 장애를 막는 것을 넘어, 서비스가 가진 성능의 한계를 넓히는 일을 해요. Java 애플리케이션의 Heap 메모리부터 커널까지, 문제의 원인이 있는 곳이라면 어디든 깊게 파고들어요. "왜 느려졌을까?", "어떻게 하면 더 효율적일까?"라는 질문을 끈질기게 던지며, 반복되는 운영 업무는 과감히 코드로 자동화 해요. 복잡한 문제를 논리적으로 해결했을 때의 짜릿함, 그리고 내가 만든 테스트 플랫폼이 동료들의 시간을 아껴줄 때의 뿌듯함을 함께 느끼고 싶은 분을 기다려요!
채용팀에 문의하기