[담당업무] 1. vLLM, SGLang, TensorRT-LLM 등 LLM 추론·서빙 프레임워크를 활용한 모델 서빙 플랫폼 설계, 구축 및 운영 2. LLM 추론 성능 및 GPU 자원 활용 효율 최적화 3. LiteLLM 등을 활용한 LLM 게이트웨이 설계, 구축 및 운영 4. LLM 호출량, 토큰 사용량, 비용 및 성능 지표 관리·모니터링 5 . Kubernetes 및 Red Hat Openshift Container Platform(OCP) 기반 LLMOps 인프라 설계, 구축 및 운영 6. MCP 서버 운영 및 관리 7. 최신 AI 기술 동향 조사, 기술 검증 및 PoC 수행
[자격요건] - 학사 이상 - 경력 4년~6년차 1. 컴퓨터공학, 전산학, 인공지능, 데이터사이언스 등 관련 분야의 학사 이상 학위 소지자 2. 관련 업무 분야에서 5년 이상의 실무 경험 3. vLLM, SGLang, TensorRT-LLM 등 오픈소스 LLM 추론·서빙 프레임워크 활용 경험 4. LiteLLM 등을 활용한 LLM 게이트웨이 구축, 모델 라우팅 및 사용량 관리 경험 5. Langfuse 등을 활용한 LLM Agent Tracing 및 Observability 환경 구축 경험 6. Kubernetes 또는 Openshift Container Platform(OCP) 기반 플랫폼 구축·운영 경험 7. MCP 서버 구축·운영 경험
<우대사항> 1. 임베딩 모델을 활용한 RAG 파이프라인 구축 경험 2. AI/LLM 플랫폼을 위한 CI/CD 파이프라인 설계·구축 경험 3. AI/LLM 기반 대고객 서비스 구축 및 운영 경험 4. LLM 기반 AI 에이전트 개발 경험 5. AI 에이전트용 스킬 및 도구 개발·활용 경험 6. 금융권 또는 금융 서비스 분야의 LLM 적용 프로젝트 경험 7. 새로운 AI 기술을 빠르게 학습하고 실무에 적용할 수 있는 역량