어서줍줍
줍줍한 글
구독
← 목록으로
AWS 코리아
·
2026.09.10
Amazon EKS에서 vLLM으로 Gemma 4 서빙 최적화하기 [2부: GPU 한 장의 처리량과 지연 SLO]
GPU 인프라
Kubernetes
LLM 서빙
vLLM
성능 최적화
원문 전체 보기 ↗
어서줍줍은 본문을 직접 보여주지 않고, 원문(aws.amazon.com/ko/blogs/tech)으로 연결합니다.