|
NVIDIA Model Optimizer: 모델을 경량화하여 vLLM / TensorRT / SGLang 등의 추론 서버용 배포용 체크포인트를 만드는 프로젝트
|
|
0
|
167
|
9월 2, 2026
|
|
NVIDIA Agent Skills: NVIDIA가 공개한 검증된 AI 에이전트용 스킬 카탈로그
|
|
0
|
1656
|
5월 28, 2026
|
|
TokenSpeed: 에이전트형 워크로드를 위한 빠른 LLM 추론 엔진 (feat. Kimi K2.5, NVIDIA Blackwell)
|
|
0
|
282
|
5월 12, 2026
|
|
NVIDIA H100 & TensorRT-LLM으로 Mixtral 8x7B 모델 고성능 달성하기 (feat. NVIDIA 블로그 글)
|
|
0
|
355
|
7월 10, 2024
|
|
[GN] NVIDIA, LLM 추론을 가속하는 TensorRT-LLM 오픈소스 공개
|
|
0
|
888
|
9월 13, 2023
|
|
[TLDR] 오늘의 AI 뉴스, 2023-09-11: NVIDIA의 더 빨라진 LLM 추론 엔진 💨, Imbue, 2억 달러 투자 유치 💰, 브라우저에서의 딥 러닝 💻
|
|
0
|
339
|
9월 12, 2023
|