|
Lucebox: 추측 디코딩과 전용 커널로 소비자용 GPU의 LLM 추론을 끌어올리는 서버
|
|
0
|
195
|
8월 11, 2026
|
|
Mixture-of-Kittens: Cursor가 새로 공개한 NVL72용 MoE 학습 메가커널
|
|
0
|
164
|
8월 7, 2026
|
|
[GN⁺] CUDA 커널을 실행하면 내부에서 벌어지는 일
|
|
0
|
228
|
7월 1, 2026
|
|
TileKernels: DeepSeek AI가 공개한, LLM 연산을 위한 고성능 TileLang 기반 GPU 커널 라이브러리
|
|
0
|
179
|
6월 24, 2026
|
|
cuda-oxide: 순수 Rust로 CUDA GPU 커널을 작성해 PTX로 컴파일하는 NVIDIA의 실험적 컴파일러
|
|
0
|
137
|
6월 12, 2026
|
|
tiny-vllm: C++와 CUDA로 vLLM을 직접 구현하며 배우는 LLM 추론 엔진
|
|
0
|
3902
|
6월 1, 2026
|
|
chipStar: HIP·CUDA를 SPIR-V로 컴파일해 Intel과 ARM GPU에서 실행하는 컴파일러
|
|
0
|
107
|
5월 25, 2026
|
|
PyTorch 2.12가 출시되었습니다 🎉
|
|
0
|
250
|
5월 14, 2026
|
|
FlashKDA: MoonshotAI가 공개한, Kimi Delta Attention을 위한 고성능 CUDA 커널 라이브러리
|
|
0
|
461
|
4월 26, 2026
|
|
cuLA(CUDA Linear Attention): NVIDIA Blackwell, Hopper GPU를 위한 선형 어텐션 고성능 CUDA 커널 라이브러리
|
|
0
|
277
|
4월 12, 2026
|
|
rvLLM: Rust로 처음부터 구현한 고성능 LLM 추론 엔진, vLLM 완전 대체제
|
|
1
|
6867
|
4월 3, 2026
|
|
CUDA Tile: NVIDIA가 제시하는 차세대 타일(Tile) 기반 GPU 프로그래밍 (feat. cuTile Python, Tile IR, TileGym)
|
|
0
|
554
|
12월 28, 2025
|
|
The Little Book of llm.c: Andrej Karphathy의 llm.c를 해설한 GPT-2 학습 도서 [영문/PDF&EPUB/255p]
|
|
0
|
335
|
9월 29, 2025
|
|
Torch Memory Saver: PyTorch에서 효율적으로 GPU 메모리를 관리할 수 있도록 돕는 경량 라이브러리
|
|
2
|
412
|
9월 9, 2025
|
|
RightNowAI의 rightnow‑cli: AI 기반의 CUDA 커널 자동 최적화 CLI 도구
|
|
0
|
275
|
8월 17, 2025
|
|
Rust CUDA Project, Rust로 CUDA를 직접 제어하려고 하는 실험적인 프로젝트
|
|
0
|
674
|
4월 12, 2025
|
|
[GN⁺] LibreCUDA - 독점 런타임없이 NVIDIA GPU에서 CUDA 코드를 실행
|
|
0
|
252
|
8월 11, 2024
|
|
[GN⁺] SCALE - AMD GPU에서 수정 없이 CUDA 실행
|
|
0
|
871
|
7월 16, 2024
|
|
GPU CUDA 없음 오류
|
|
4
|
1450
|
6월 13, 2024
|
|
llm.c: ML Framework 없이 순수 C/CUDA를 사용한 GPT-2 학습 코드
|
|
0
|
1197
|
4월 9, 2024
|
|
cuda out of memory 에러 관련 질문 입니다
|
|
6
|
47670
|
3월 26, 2024
|
|
Onnxruntime c++ gpu 속도느림이슈 문의드려요
|
|
6
|
2201
|
10월 30, 2023
|
|
conv2d 동작 시 에러
|
|
3
|
1076
|
10월 25, 2023
|
|
[GN] AITemplate - 심층 신경망을 고성능 CUDA/HIP C++ 코드로 변환하는 파이썬 프레임워크
|
|
0
|
456
|
6월 10, 2023
|