|
Club-3090: RTX 3090 GPU에서 vLLM, llama.cpp, SGLang으로 LLM을 서빙하는 커뮤니티 레시피 모음
|
|
0
|
429
|
5월 4, 2026
|
|
Mini-SGLang: SGLang의 핵심을 담은 경량화 고성능 LLM 추론 프레임워크
|
|
0
|
1447
|
12월 18, 2025
|
|
HAIF(Hyperswarm-RPC AI Inference Framework): MSA 구조로 AI 추론 작업을 분산처리하도록 설계된 프레임워크
|
|
0
|
218
|
10월 14, 2025
|
|
vLLM Semantic Router: 지능형 LLM 라우팅을 위한 차세대 아키텍처
|
|
0
|
1976
|
9월 24, 2025
|
|
LMCache: LLM 서빙 효율성을 높여주는 캐시 시스템
|
|
0
|
2053
|
6월 26, 2025
|
|
Nano-vLLM: 처음부터 다시 구현한, 1200줄 가량의 경량 vLLM 구현체
|
|
0
|
1094
|
6월 24, 2025
|
|
[2025/06/16 ~ 22] 이번 주에 살펴볼 만한 AI/ML 논문 모음
|
|
0
|
662
|
6월 23, 2025
|