{"id":2064701,"url":"https://alion.io/job/toss-site-reliability-engineer","title":"Site Reliability Engineer","company":{"id":51109,"name":"Toss","domain":"toss.im","url":"https://alion.io/company/viva-republica","size_band":"1001-5000","is_staffing_agency":false,"employer_type":"direct","is_intermediary":false,"listed_via":null,"ats_vendor":"Career site","truth_index":{"grade":"B","score":79,"open_postings":339,"ghost_share":0.265,"stale_share":0,"repost_share":0,"time_to_fill_p50_days":209,"computed_at":"2026-10-10T05:45:15Z"}},"role":"DevOps","role_family":"DevOps","seniority":null,"employment_type":"full_time","work_mode":"on_site","remote_scope":null,"remote_scope_basis":null,"remote_working_hours":null,"hiring_geo_confidence":"structured","locations":["Seoul, South Korea"],"countries":["KR"],"hiring_countries":[],"hiring_countries_total":0,"salary":null,"salary_estimate":null,"experience_years_min":null,"visa_sponsorship":false,"relocation_package":false,"has_equity":false,"technologies":[{"name":"Apache Kafka","optional":false},{"name":"ArgoCD","optional":false},{"name":"CI/CD","optional":false},{"name":"eBPF","optional":false},{"name":"GitHub Actions","optional":false},{"name":"Grafana","optional":false},{"name":"Hibernate","optional":false},{"name":"Istio","optional":false},{"name":"Java","optional":false},{"name":"k6","optional":false},{"name":"Kotlin","optional":false},{"name":"Kubernetes","optional":false},{"name":"Linux","optional":false},{"name":"MySQL","optional":false},{"name":"Nginx","optional":false},{"name":"Oracle","optional":false},{"name":"Prometheus","optional":false},{"name":"Python","optional":false},{"name":"Redis","optional":false},{"name":"Spring Boot","optional":false},{"name":"TCP/IP","optional":false},{"name":"Tcpdump","optional":false},{"name":"Thanos","optional":false},{"name":"Wireshark","optional":false}],"status":"live","first_seen_at":"2026-09-03T06:50:53Z","employer_posted_date":"2026-10-08","last_verified_at":"2026-10-11T16:58:19Z","board_verified":true,"closed_at":null,"days_open":38,"trust":{"level":"ok","repost_count":0,"flags":["company_stale"],"days_open":37},"description":"합류하게 될 팀에 대해 알려드려요\nSite Reliability Engineer는 Server Chapter 소속으로, SRE Team에 속해 업무해요.\n토스증권 SRE Team은 서비스의 높은 신뢰성과 안정성을 책임져요.\n대규모 트래픽 환경에서 이상 징후를 사전에 감지하고 빠르게 대응할 수 있도록 효과적인 모니터링 시스템을 설계하고 운영해요.\n서비스가 성장하는 과정에서 발생한 문제를 해결하고, 재발 방지를 위한 설계와 해법을 마련해요.\n토스증권 서버 챕터는\n무언가를 함께 만들어내서, 보다 나은 가치를 만들고자 하는 동료들이 정말 많아요. 예를 들어, 아이디어를 냈을 때 \"이래서 안 돼!\", “이미 잘 되고 있는데 굳이 바꿔야 하는 거야?” 보다 \"이렇게 하면 그걸 해낼 수 있겠다.\"라는 마인드를 가진 분들 말이죠. 자신의 의견을 서슴지 않게 이야기할 수 있고, 어떤 생각이라도 비난하거나 질책하지 않고 경청해 주고 협의해 나갈 수 있는 분위기의 챕터에요.\n기술 토론을 좋아하고, 스터디도 많이 하고 있어요. 오시면 그동안 학습이 부족하셨던 분들도 저절로 풍월을 읊게 되고, 평소 많이 하셨던 분들은 공부한 것을 실무에 적용할 부분을 탐구해 보는 신세계를 경험할 수 있어요.\n작게는 코드리뷰부터, 크게는 엔지니어링데이와 서버 챕터 위클리에 이르기까지 서버 개발자들의 강력한 횡적 협업을 지탱하는 커뮤니티가 있어요.\n합류하면 함께할 업무예요\n**안정적인 서비스를 위한 장애 예방 및 대응을 담당해요.**\n장애 발생 시 누구보다 빠르게 대응하고, 서비스 영향도를 최소화하기 위한 대응 프로세스를 설계하고 운영해요.\n장애의 근본 원인(RCA)을 분석하고, 사전·사후 탐지 역량을 강화해 복구 시간을 단축하며 재발을 방지할 수 있는 시스템을 구축해요.\n**서비스 가시성과 가용성을 확보해요.**\n인프라, 네트워크, Kubernetes 환경 전반의 가시성을 확보하고, 이를 실제 서비스 지표와 유기적으로 연결할 수 있는 환경을 구축해요.\n문제 상황을 명확히 정의하기 위해 SLO를 수립하고, 필요한 메트릭을 수집해 알림(Alert) 시스템을 지속적으로 고도화해요.\n트래픽 증가에 대비해 병목이 발생할 수 있는 컴포넌트를 선제적으로 찾아내고, 구조를 개선해요.\n**문제에 대해 심층적으로 분석하고, 원인을 규명해요.**\n서비스 장애 발생 시 로그 분석에 그치지 않고, eBPF, 메모리, 네트워크, 커널 영역까지 폭넓게 분석해 복합적인 원인을 찾아내요.\n애플리케이션 내부 동작을 정밀하게 분석해, 최적의 리소스 설정 가이드를 개발팀에 제시해요.\n**운영 자동화 및 내부 도구를 개발해요.**\n반복적이고 패턴화된 분석 작업을 자동화하고, 운영 효율을 저해하는 요소를 찾아, 개선할 수 있는 도구를 직접 개발해요.\n서비스 신뢰성을 높이기 위한 테스트 환경을 자동화하고, 동료들이 쉽게 활용할 수 있도록 제공해요.\n이런 분과 함께하고 싶어요\n성장하는 서비스에 맞춰 확장 가능한 아키텍처로 전환하거나, 구조적 개선을 통해 대규모 트래픽을 안정적으로 처리하는 서비스로 성장시킨 경험이 있으면 좋아요.\n단순히 프레임워크의 사용보다는 동작 원리를 이해하고, 언어의 구분 없이 성능 최적화 관점에서 코드를 바라볼 수 있는 분이 필요해요.\n복잡한 분산 환경에서 발생하는 문제를 논리적으로 접근해, 근본 원인을 끝까지 추적하는 집요함을 갖춘 분을 찾고 있어요.\nLinux OS와 커널, 네트워크 프로토콜(TCP/IP)에 대한 탄탄한 기본기를 바탕으로 로우 레벨 분석이 가능하신 분을 찾아요.\n단순히 테스트를 수행하는 데 그치지 않고, “동료들이 테스트를 더 쉽고 자동화된 방식으로 할 수 있도록” 고민하며 테스트 플랫폼이나 환경을 구축해 본 경험이 있으면 좋아요.\n비효율적인 반복 업무를 문제로 인식하고, 이를 코드로 해결해 시스템화해 본 경험이 있으면 좋아요.\n이력서는 이렇게 작성하시는 걸 추천해요\n단순한 프로젝트 결과의 나열보다는, 그 결과를 도출하기 위해 치열하게 고민했던 과정을 중심으로 작성해 주세요.\n애플리케이션 레벨의 최적화 경험(JVM 튜닝 등)과 시스템 레벨의 트러블슈팅 경험(커널/네트워크 분석)이 균형 있게 드러나면 좋아요.\n장애 회고(Post-mortem)를 통해 운영 프로세스를 개선하거나, 재발 방지 대책을 시스템에 반영한 경험이 있다면 함께 공유해 주세요.\n서버 플랫폼팀이 사용하는 기술\nLanguage & Framework : Java, Kotlin, Spring Boot, JPA/Hibernate\nScripting & Tooling : Python, Shell Script, Go, k6\nDeep Analysis : Linux(Kernel/Network), tcpdump, Wireshark, eBPF, heapdump, async profiler\nInfrastructure : Kubernetes, Istio, Nginx, Kafka\nObservability : Prometheus, Thanos, Grafana, ELK Stack\nCI/CD : GoCD, ArgoCD, GitHub Actions, Harbor\nDatabase : MySQL, MongoDB, Oracle, Redis\n토스증권으로의 합류 여정\n서류접수 > 직무 인터뷰 > 문화적합성 인터뷰 > 레퍼런스 체크 > 처우협의 > 최종합격 및 입사\n꼭 확인해 주세요\n이력서 및 제출 서류에 허위 사실이 발견되거나 근무 이력 중 징계사항이 확인될 경우, 채용이 취소될 수 있어요.\n토스증권 내규에 따라 채용 금지자 또는 결격사유 해당자는 채용이 취소될 수 있어요.\n장애인 및 국가보훈대상자는 지원 시 관련법에 따라 우대하고 있어요.\n입사 시 직무명은 Server Developer가 될 예정이에요.\n최종 합격 시, 적합도에 따라 제품 조직으로의 배치도 고려될 수 있어요.\n함께할 동료를 위한 한마디\n> \"코드 한 줄부터 패킷 하나까지, 시스템의 가장 깊은 곳을 탐험하며 성장의 즐거움을 느끼고 있어요.\"\n단순히 장애를 막는 것을 넘어, 서비스가 가진 성능의 한계를 넓히는 일을 해요. Java 애플리케이션의 Heap 메모리부터 커널까지, 문제의 원인이 있는 곳이라면 어디든 깊게 파고들어요. \"왜 느려졌을까?\", \"어떻게 하면 더 효율적일까?\"라는 질문을 끈질기게 던지며, 반복되는 운영 업무는 과감히 코드로 자동화 해요. 복잡한 문제를 논리적으로 해결했을 때의 짜릿함, 그리고 내가 만든 테스트 플랫폼이 동료들의 시간을 아껴줄 때의 뿌듯함을 함께 느끼고 싶은 분을 기다려요!","description_format":"text","description_chars":3164,"description_truncated":false,"requirements":{"experience_years_min":null,"management_years_min":null,"team_size_min":null,"manages_managers":false,"education":null,"security_clearance":false,"languages":[{"language":"Korean","level":"Advanced (C1)","optional":false}]},"benefits":[],"hiring_locations":[],"hiring_excludes":[],"relocation_offered":false,"industries":[],"lifecycle":[{"event":"open","at":"2026-10-08T03:12:29Z"}],"visa":[],"liveness":{"score":86,"band":"hot","label":"Hiring now","p_open":1,"p_active":0.865,"p_room":1,"age_days":36,"expected_fill_days":209,"reasons":["conf:0","velocity","win:early","comp:brand"],"computed_at":"2026-10-10T05:45:15Z"},"pay":null,"html_url":"https://alion.io/job/toss-site-reliability-engineer","json_url":"https://alion.io/job/toss-site-reliability-engineer.json","meta":{"generated_at":"2026-10-11T19:12:08Z","cache_seconds":300,"methodology":"https://alion.io/methodology","terms":"https://alion.io/terms","contact":"https://alion.io/contact","api":"https://alion.io/developers","about":"Alion is a live layer of people, companies and AI agents: who they are, whether they are real and active right now, what they do and how to work with them, readable by people and by agents and paid per call.","catalog":"https://alion.io/catalog.json","usage":{"tier":"crawler_verified","counted_by":"address","units_charged":1,"used_today":5808,"day_limit":null,"remaining_today":null,"minute_limit":300,"resets_at":"2026-10-12T00:00:00Z"}},"offers":[{"id":"company.slices","title":"One company in depth, by slice","status":"live","price":{"credits":0.02,"usd":0.002,"plus_per_slice":{"credits":0.05,"usd":0.005}},"unit":"per company, plus each slice with data","note":"the employer in depth","call":{"mcp_tool":"get_company","arguments":{"id":51109},"rest":"https://alion.io/mcp/rest/get_company?id=51109"},"human":"https://alion.io/catalog?offer=company.slices&for=job%2Ftoss-site-reliability-engineer"},{"id":"market.stats","title":"A market slice: pay, demand and time to fill","status":"live","price":{"credits":1,"usd":0.1},"unit":"per slice","note":"pay, demand and time to fill for this role and place","call":{"mcp_tool":"market_stats"},"human":"https://alion.io/catalog?offer=market.stats&for=job%2Ftoss-site-reliability-engineer"},{"id":"job.search","title":"Open jobs by role, technology, place, pay and visa","status":"live","price":{"credits":0.02,"usd":0.002},"unit":"per posting in a list","note":"similar open postings","call":{"mcp_tool":"search_jobs"},"human":"https://alion.io/catalog?offer=job.search&for=job%2Ftoss-site-reliability-engineer"},{"id":"company.verify","title":"Is this company real and active right now","status":"pilot","price":null,"unit":"per company","request":{"url":"https://alion.io/catalog/request","method":"POST","body":"{\"offer\": \"company.verify\", \"for\": \"job/toss-site-reliability-engineer\", \"note\": \"what you need it for\"}"},"human":"https://alion.io/catalog?offer=company.verify&for=job%2Ftoss-site-reliability-engineer"}]}