Ollama 보다 빠르다는 vLLM을 뛰어넘었습니다! 로컬 LLM 서빙 엔진 SGLang 소개

0 Views· 22 May 2026
글로벌비전
글로벌비전
5 subscribers
1
In

Ollama 보다 빨랐다던 vLLM을 뛰어 넘는 서빙 엔진? 글로벌 빅테크가 선택한 오픈소스 SGLang! 🚀

⏱️ Timestamps (타임스탬프)

0:00 - 인트로: vLLM을 압도한 SGLang
0:48 - SGLang 프로젝트 소개
1:43 - vLLM의 핵심 기술 1: RadixAttention
4:45 - 추론 성능 비교: Ollama vs vLLM vs SGLang
6:03 - vLLM의 한계점
6:57 - SGLang, 언제 써야 할까?
7:32 - 마무리

📑 Reference

SGLang 공식 GitHub
https://github.com/sgl-project/sglang

LMSYS Org 공식 홈페이지
https://www.lmsys.org/

PyTorch 블로그 (grok이 Sglang의 서빙 엔진으로 사용한다)
https://pytorch.org/blog/sglang-joins-pytorch/

NVIDIA NGC이 SGLang 지원
https://catalog.ngc.nvidia.com..../orgs/nvidia/contain

젠슨황 GTC 2026 연설에 SGLang이 포함
https://www.lmsys.org/blog/2026-03-25-gtc2026/

#sglang #vllm #ollama #llm #opensource #ai #오픈소스

Show less

 0 Comments sort   Sort By