{"id":1212299,"url":"https://alion.io/job/moreh-llm-inference-engineer","title":"LLM Inference Engineer","company":{"id":48141,"name":"Moreh","domain":"moreh.io","url":"https://alion.io/company/moreh","size_band":"51-200","is_staffing_agency":false,"employer_type":"direct","is_intermediary":false,"listed_via":null,"ats_vendor":"Greeting","truth_index":null},"role":"AI/ML","role_family":"AI/ML","seniority":null,"employment_type":"full_time","work_mode":"remote","remote_scope":"stated_countries","remote_scope_basis":"board_field","remote_working_hours":null,"hiring_geo_confidence":"structured","locations":["Seoul, South Korea"],"countries":["KR"],"hiring_countries":["KR"],"hiring_countries_total":1,"salary":null,"salary_estimate":{"min_usd":69000,"max_usd":185000,"period":"year","method":null,"sample_n":3649},"experience_years_min":null,"visa_sponsorship":false,"relocation_package":false,"has_equity":false,"technologies":[{"name":"KV Cache","optional":false},{"name":"LLM","optional":false},{"name":"NCCL","optional":false},{"name":"SGLang","optional":false},{"name":"TPU","optional":false},{"name":"Transformers","optional":false},{"name":"vLLM","optional":false}],"status":"live","first_seen_at":"2026-09-08T14:16:20Z","employer_posted_date":"2026-09-25","last_verified_at":"2026-09-25T07:54:22Z","board_verified":true,"closed_at":null,"days_open":18,"trust":{"level":"ok","repost_count":null,"flags":[],"days_open":18},"description":"[직무 소개]\nMoreh는 대규모 GPU/NPU 클러스터에서 다양한 LLM을 서빙하는 “토큰 팩토리” 데이터센터를 효율적으로 구동하기 위한 추론 소프트웨어를 개발, 제공합니다.\nLLM Inference Engineer는 이종 GPU 클러스터에서 LLM 추론을 고성능으로 실행할 수 있도록 다양한 분산 추론 기술을 개발, 통합, 배포하는 업무를 담당합니다.\n[주요 업무]\n다수의 노드와 이기종 가속기를 활용해, LLM 추론 워크로드를 효율적으로 실행할 수 있는 실행 환경 구축\nLLM 서빙 프레임워크(vLLM, SGLang 등)의 성능 최적화\n스토리지, 메모리, GPU 간 고속 통신을 위한 low-level 라이브러리(NCCL, NIXL, UCX 등)의 활용 및 최적화\n효율적인 KV cache 오프로딩 및 티어링\nGPU를 효율적으로 활용하기 위한 라우팅 규칙 개발, 적용\n하드웨어 특성과 서비스 요구를 모두 고려한 병목 분석 및 시스템 성능 개선\n[자격 요건]\n컴퓨터공학 혹은 관련 전공 학부 졸업, 혹은 이와 동등한 경력이 있으신 분\n시스템 소프트웨어 개발 혹은 활용 경험이 있으신 분\nLLM 추론 과정에 대한 기본적인 이해가 있으신 분\n팀워크를 중시하고, 긍정적인 태도로 동료들과 적극적으로 협력할 수 있으신 분\n[우대사항]\nAI 가속기(GPU, TPU, NPU 등) 환경에서의 추론 및 최적화 경험이 있으신 분\nLLM 서빙 프레임워크를 직접 개발하거나 관련 오픈 소스 프로젝트(vLLM, SGLang, Transformers 등)에 기여한 경험이 있으신 분\nNCCL, NIXL, UCX 등의 low-level 통신 라이브러리 활용 및 개발 경험이 있으신 분\n대규모 시스템에서의 분산 처리, 모니터링, 성능 분석 및 해결 경험이 있으신 분\n[복지 제도]\n복지포인트 연간 200만 원\n입사 시 장비지원금 지원\n유연출근제&재택근무\n연 1회 종합건강검진 (본인 및 직계가족 1인)\n생일 반차 휴가\n장기근속 휴가\n사내 동호회 지원 (보드게임, 클라이밍 등)\n오피스 간식 제공 (과자, 음료수 등)\n연말 오피스 클로징 (매년 12/28-12/31 유급휴가 제공)\n중소기업 청년 소득세 감면 (연간 최대 200만 원) \n[채용 절차]\n서류 전형 -> 1차 면접 -> 최종 면접 -> 처우 협의 -> 최종 합격\n포지션에 따라 전형이 변경 또는 추가될 수 있는 점 참고 부탁드립니다.","description_format":"text","description_chars":1161,"description_truncated":false,"requirements":{"experience_years_min":null,"management_years_min":null,"team_size_min":null,"manages_managers":false,"education":null,"security_clearance":false,"languages":[{"language":"Korean","level":"Advanced (C1)","optional":false}]},"benefits":[],"hiring_locations":[{"name":"South Korea","iso":"KR","kind":"country"}],"hiring_excludes":[],"relocation_offered":false,"industries":["MLOps","AI Compute & Inference","AI Development Tools"],"lifecycle":[{"event":"open","at":"2026-09-25T04:54:16Z"}],"liveness":{"score":72,"band":"hot","label":"Hiring now","p_open":1,"p_active":0.796,"p_room":0.9,"age_days":17,"expected_fill_days":50,"reasons":["conf:21","velocity","win:mid"],"computed_at":"2026-09-26T05:45:00Z"},"pay":null,"html_url":"https://alion.io/job/moreh-llm-inference-engineer","json_url":"https://alion.io/job/moreh-llm-inference-engineer.json","meta":{"generated_at":"2026-09-27T05:37:50Z","cache_seconds":300,"methodology":"https://alion.io/methodology","terms":"https://alion.io/terms","contact":"https://alion.io/contact","api":"https://alion.io/developers","usage":{"tier":"crawler","counted_by":"address","units_charged":1,"used_today":4988,"day_limit":5000,"remaining_today":12,"minute_limit":60,"resets_at":"2026-09-28T00:00:00Z"}}}