Confirmed on the employer's own hiring board on Sep 24, 2026. First seen by Alion on Sep 24, 2026.
關於團隊與產品
加入跨職能的數位平台開發團隊,負責支撐百萬級活躍用戶、具備點數經營與行銷搶兌活動的高併發應用程式,負責第一線的系統監控、異常排查,並協助團隊平衡「系統穩定性」與「業務連續性」。
工作職掌
* 維護監控告警體系(Grafana、Prometheus、ELK),持續優化告警規則與水位設定,降低誤報干擾
* 透過 Log 分析與根因追蹤,判讀並解決跨服務的連線異常與效能瓶頸
* 負責線上事故的即時處理、進度追蹤與結案,並依規範執行重大事故通報
* 參與高流量場景的效能排查與壓力測試,負責 OS 層級與 Web Server 配置的調優作業
* 維護 CI/CD Pipeline(Azure DevOps / Jenkins)與基礎建設自動化流程,確保部署穩定與環境一致性
* 維護 Linux、資料庫、Cache 與 Message Queue 各層環境,橫跨測試至生產的全環境基礎設施
* 配合集團資安規範,執行套件升級、弱點修正與架構調整,並參與跨部門資安聯防
* 撰寫系統架構說明、操作手冊與事故處理紀錄,建立維運知識管理機制
* 協助 Java/Spring Boot 微服務架構的部署與流量負載平衡,並利用進程管理工具維持服務的高可用性
* 開發自動化腳本以簡化維運流程,快速響應並排除系統異常
必備條件
* 3 年以上工作經驗,其中包含 2 年以上高流量 To-C 端產品的 SRE 實務經驗
* 熟悉 Linux 系統操作,具備 OS 層級與 Web Server(如 Apache MPM)效能排查能力
* 熟悉網路傳輸協定(TCP/IP、HTTP、DNS)、資安設備(WAF),以及系統資源管控(如 Connection Pool)對應用程式效能的影響
* 熟悉監控告警工具(Grafana、Prometheus、Alertmanager)及 Log 分析平台(Elasticsearch / Kibana)
* 熟悉 CI/CD 工具(Azure DevOps、Jenkins)及自動化流程建置
* 具備 Redis、Kafka 等 Cache 與 Message Queue 的實務操作經驗
* 具備 Oracle 或其他主流關聯式資料庫的日常維護與查詢能力
* 具備Python維運腳本開發實務經驗

