어서줍줍
줍줍한 글
구독
← 탐색으로
키워드
모델 양자화
토픽 · LLM 서빙
+ 이 키워드 구독
최근 글
네이버 D2
·
2026.08.11
우리 팀만의 vLLM 플러그인 만들기 1편 - 검색 AI 모델 서빙 성능 극대화하기
KV 캐시
LLM 서빙
vLLM
모델 양자화
성능 최적화
원문 보기 ↗
KT 클라우드
·
2026.08.06
[기술동향] LLM 추론 최적화 핵심 기술: 양자화, KV 캐시, 추론 칩
AI 에이전트
KV 캐시
LLM 서빙
모델 양자화
생성형 AI
원문 보기 ↗