3
13 지역 채용공고 llm 서빙 및 추론 최적화 엔지니어건
Related jobs to explore
Based on your search for llm 서빙 및 추론 최적화 엔지니어
카카오뱅크 —성남 분당구
모델 압축, KV 캐시 최적화, 요청 스케줄링, 다중 GPU 분산 추론을 적용해 성능을 끌어올리는 동시에 모델 품질 저하 여부를 확인하며, Speculative Decoding이나 Prefill/Decode Disaggregation, Expert Parallelism 같은 새로운…
5일
카카오 —성남 판교역
분산 추론 전략 설계 및 구현 (Tensor / Pipeline / Expert / Sequence Parallelism, MoE 라우팅). Transformer 아키텍처 및 LLM 동작 원리(어텐션, KV cache, 디코딩 전략 등)에 대한 깊은 이해가 있는 분.
13의 llm 서빙 및 추론 최적화 엔지니어에 대한 최신 취업소식을 받고 싶습니다.
계정에 로그인하면 SimplyHired의 서비스 이용약관과 쿠키 및 개인정보 취급방침에 동의하는 것입니다.