AWS 코리아·2026.09.10Amazon EKS에서 vLLM으로 Gemma 4 서빙 최적화하기 [2부: GPU 한 장의 처리량과 지연 SLO]GPU 인프라KubernetesLLM 서빙vLLM성능 최적화원문 보기 ↗
네이버 D2·2026.08.11우리 팀만의 vLLM 플러그인 만들기 2편 - 모델 변환부터 배포까지 AI-native로 자동화하기AI 코딩 도구LLM 서빙MLOpsvLLM모델 경량화원문 보기 ↗