{"id":1254592,"url":"https://alion.io/job/onepredict-llmops-engineer","title":"LLMOps Engineer","company":{"id":52152,"name":"Onepredict","domain":"onepredict.ai","url":"https://alion.io/company/onepredict","size_band":"51-200","is_staffing_agency":false,"employer_type":"direct","is_intermediary":false,"listed_via":null,"ats_vendor":"Greeting","truth_index":null},"role":"AI/ML","role_family":"AI/ML","seniority":null,"employment_type":"full_time","work_mode":"remote","remote_scope":"stated_countries","remote_scope_basis":"board_field","remote_working_hours":null,"hiring_geo_confidence":"structured","locations":["Seoul, South Korea"],"countries":["KR"],"hiring_countries":["KR"],"hiring_countries_total":1,"salary":null,"salary_estimate":{"min_usd":65000,"max_usd":174000,"period":"year","method":null,"sample_n":3649},"experience_years_min":null,"visa_sponsorship":false,"relocation_package":false,"has_equity":false,"technologies":[{"name":"AI Agents","optional":false},{"name":"AutoGen","optional":false},{"name":"CI/CD","optional":false},{"name":"Docker","optional":false},{"name":"Function Calling","optional":false},{"name":"Knowledge Graph","optional":false},{"name":"Kubernetes","optional":false},{"name":"Langfuse","optional":false},{"name":"LangGraph","optional":false},{"name":"LangSmith","optional":false},{"name":"Linux","optional":false},{"name":"LLM","optional":false},{"name":"LLMOps","optional":false},{"name":"LoRA","optional":false},{"name":"MLFlow","optional":false},{"name":"Model Context Protocol","optional":false},{"name":"NeMo Guardrails","optional":false},{"name":"Outlines","optional":false},{"name":"Prompt Caching","optional":false},{"name":"QLoRA","optional":false},{"name":"RAG","optional":false},{"name":"Structured Outputs","optional":false},{"name":"TensorRT-LLM","optional":false},{"name":"Triton","optional":false},{"name":"vLLM","optional":false},{"name":"LangChain","optional":true},{"name":"PEFT","optional":true},{"name":"TensorRT","optional":true}],"status":"live","first_seen_at":"2026-06-18T01:48:40Z","employer_posted_date":"2026-09-25","last_verified_at":"2026-09-26T02:05:11Z","board_verified":true,"closed_at":null,"days_open":100,"trust":{"level":"ok","repost_count":null,"flags":[],"days_open":100},"description":"\"everyONE can PREDICT\"\n원프레딕트는 지금, 'AI Native Factory'라는 새로운 미래를 코딩하고 있습니다.\n원프레딕트는 단순한 소프트웨어 기업이 아닙니다. 우리는 전 세계 제조·에너지 현장의 두뇌를 AI 기반으로 재정의하는 'Industrial AI' 기업입니다.\n우리는 지금 그 어느 때보다 뜨거운 폭발적 성장기 를 지나고 있습니다.\n700% 성장 : 핵심 솔루션의 확산과 공격적인 시장 개척을 통해 산업 AI 분야에서 압도적인 성장률을 기록하며 시장을 장악\n 미국 모티바(Motiva)사 수주: 2025년, 미국 최대 정유사로부터 수주를 성공, 북미 시장의 표준 정립\n대한민국 대표 AI 팩토리 기업: '산업 디지털 전환 유공' 수상 및 자율제조 얼라이언스 핵심 멤버로 선정\n산업부 대형 국책 사업 연쇄 수주: 산업부 장관상 수상 & 자동차/식음료 대형 국책 사업 연쇄 수주\n 글로벌 데이터 챌린지 10회 연속 수상: 글로벌 데이터 챌린지 10회 연속 수상으로 아시아 최다 기록 보유\n누적 510억 원의 투자(Series C)와 탄탄한 기술력을 바탕으로, 우리는 이제 2027년 IPO 라는 명확한 목표를 향해 달리고 있습니다. 산업의 운영 체제(OS)를 바꾸는 이 거대한 여정에 합류하여, 원프레딕트의 역사를 함께 써 내려갈 '가디언(Guardian)'을 찾습니다.\n[ 팀 소개 및 문화 ]\n원프레딕트에서는 고객 지향적인 제품 개발을 토대로 최적의 솔루션 제공을 추구합니다. \n우리는 AI 기술을 적용한 제품 및 솔루션을 체계적으로 관리하며, 사업과 서비스가 성공적으로 수행될 수 있도록 노력합니다.\n원프레딕트는 실행력 있는 팀워크와 고객 지향적인 마인드를 중요시합니다. \n기획, 기술, 설치, 운영 등 다양한 부서와의 협업 속에서 프로젝트의 중심에서 팀을 이끌며, 단기성과뿐 아니라 장기적인 관계 구축에도 기여합니다.\n[ 팀 미션 및 비전 ]\n최신 예지기반 인공지능(AI) 기술을 통한 제조현장의 혁신를 리드하며, 자사 보유 기술 및 솔루션 공급을 통해 고객의 더 높은 가치창출을 지원합니다. \n제조현장 곳곳에 자율제조를 위한 예지(Prediction), 최적화(Optimization), 자율화 (Autonomization) 등의 AI알고리즘을 적용함으로써 AI Native Factory를 실현합니다. \n이를 위해 본 조직은 제조 AX 제안, 현장 요구분석, 제조 데이터 수집 설계/분석, Data Insight 도출, AI 솔루션 공급/운영을 주도하는 핵심 부서입니다. \nIoT 센서, AI 진단 알고리즘, 제조 데이터 플랫폼 등 다양한 기술을 접목하고 연계함으로써 산업 현장의 혁신을 이끌어갈 역량있는 인재를 모시고자 합니다.\n[ 주요 업무 ]\nLLM·임베딩 모델 추론 서빙 인프라 구축 및 운영 (vLLM/Triton/TensorRT-LLM 등)\n폐쇄망·온프레미스 GPU 환경에서 추론 비용·성능 최적화 (양자화, KV 캐시·배칭 전략, prompt caching, GPU 자원 효율화)\nLLM 서비스 컨테이너화 및 독립적 배포·운영 자동화 (Kubernetes, CI/CD)\n임베딩 모델 서빙 및 벡터DB·RAG 검색 파이프라인 운영\n도메인 특화 LLM 파인튜닝 파이프라인 구축·운영 (데이터셋 구성, 학습, 검증, 어댑터 관리)\n신규 모델 벤치마크·실험 및 주기적 모델 업데이트, 실험 추적·모델 레지스트리 체계 구축 (지속적 성능 개선 루프)\nLLM 응답 품질·안전성 평가 체계 구축 (도메인 정답셋, 자동 평가 파이프라인) 및 Observability 구축\nAI Agent·Agentic AI 개발팀과 협업하여 Tool/Function Calling, 에이전트 워크플로우의 서빙·운영·안정화 지원\n[ 자격 요건 ]\n총 3년 이상의 MLOps, LLMOps, 또는 클라우드/인프라 엔지니어링 실무 경력\nvLLM/Triton 등 LLM 추론 서버 구축 및 서빙 최적화 경험\nKubernetes·Docker 기반 서비스 배포·운영 경험\nLinux·GPU 인프라 운영 경험\nLoRA·QLoRA 등 LLM 파인튜닝 경험\n임베딩 모델 서빙 및 벡터DB 운영 경험\n[ 우대 사항 ]\n온프레미스·폐쇄망 환경에서의 모델 배포·운영 경험\n모델 경량화 경험 (양자화, 지식 증류, 프루닝)\n멀티 GPU·분산 추론 환경 구축 경험\n에이전트 프레임워크(LangGraph, AutoGen 등) 또는 Tool/Function Calling·MCP 연동 경험\nRAG 파이프라인 구축 및 검색 품질 개선 경험 (리랭킹, 하이브리드 검색, Knowledge Graph 연동 등)\nStructured Output·Constrained Decoding (Outlines, guidance 등) 또는 가드레일 프레임워크(NeMo Guardrails 등) 적용 경험\n선호 정렬(DPO/ORPO) 및 catastrophic forgetting 완화 경험\nLLM Observability 도구 경험 (Langfuse, LangSmith 등)\n모델 학습 실험 추적·관리 도구 경험 (MLflow 등)\n[ 혜택 및 복지 ]\nWe Guard the Guardians 최고의 성과에 따르는 최상의 리스펙트\n1. 압도적 보상 (Compensation)\n정착지원금 제도: 재직 중인 직장 연봉의 10%를 정착지원금으로 지급합니다. (수습 통과 후 분할 지급)\n본 혜택은 3분기(9월 30일)까지 지원해 주신 분들에 한하여 제공됩니다.\n성장 공유 인센티브: 회사의 성장이 곧 나의 보상이 되도록, 전사 목표 달성 시 성과급 을 통해 결실을 함께 나눕니다.\n장기 근속 포상: 함께한 시간에 대한 감사로, 3·5·10년 근속 시마다 포상금과 리프레시 휴가 를 드립니다.\n2. 자율과 몰입 (Work & Life)\n주 2회 재택근무: 물리적 제약 없는 몰입을 위해 하이브리드 근무 를 기본으로 합니다.\nFlexible Time: 8시~11시 사이, 나의 바이오 리듬에 맞춰 출퇴근 시간을 자유롭게 선택 합니다. 이제 지하철역에서 뛰지 마세요.\n3. 지원과 케어 (Support)\n런치 프리패스: 메뉴 고민은 하셔도 가격 고민은 마세요. 일 12,000원의 점심 식대 를 별도 지원합니다.\n생일 당일 유급휴가: 1년에 하루뿐인 생일, 온전한 휴식을 위해 유급 휴가를 드립니다.\n건강검진 지원: 매년 종합 건강검진을 지원하여 가디언의 건강을 챙깁니다.\n[ 채용전형 ]\n서류 전형 → 1차 면접 → 2차 면접 → 처우협의 → 최종합격","description_format":"text","description_chars":3145,"description_truncated":false,"requirements":{"experience_years_min":null,"management_years_min":null,"team_size_min":null,"manages_managers":false,"education":null,"security_clearance":false,"languages":[{"language":"Korean","level":"Advanced (C1)","optional":false}]},"benefits":[],"hiring_locations":[{"name":"South Korea","iso":"KR","kind":"country"}],"hiring_excludes":[],"relocation_offered":false,"industries":["Predictive Analytics","Industrial IoT (IIoT)","Industrial AI"],"lifecycle":[{"event":"open","at":"2026-09-25T18:50:47Z"}],"liveness":{"score":18,"band":"cold","label":"Long shot","p_open":1,"p_active":0.496,"p_room":0.36,"age_days":100,"expected_fill_days":53,"reasons":["conf:1","win:tail","crowd:"],"computed_at":"2026-09-26T03:10:20Z"},"pay":null,"html_url":"https://alion.io/job/onepredict-llmops-engineer","json_url":"https://alion.io/job/onepredict-llmops-engineer.json","meta":{"generated_at":"2026-09-26T03:10:20Z","cache_seconds":300,"methodology":"https://alion.io/methodology","terms":"https://alion.io/terms","contact":"https://alion.io/contact","api":"https://alion.io/developers","usage":{"tier":"crawler","counted_by":"address","units_charged":1,"used_today":3364,"day_limit":5000,"remaining_today":1636,"minute_limit":60,"resets_at":"2026-09-27T00:00:00Z"}}}