|
확산 언어 모델(Diffusion LLM)의 개념과 동작에 대한 연구 정리: LLaDA에서 DiffusionGemma까지
|
|
0
|
228
|
7월 20, 2026
|
|
Bonsai 27B: 노트북과 폰에서 실행되는 27B급 이진 및 삼진 저비트 LLM (feat. PrismML)
|
|
0
|
283
|
7월 16, 2026
|
|
colibri: 744B MoE 모델을 25GB RAM 소비자 PC에서 실행하는 순수 C 추론 엔진
|
|
0
|
3269
|
7월 14, 2026
|
|
하드웨어 인식 동적 추측 디코딩(DSD): 배치 크기에 맞춰 초안 토큰 수를 조절하는 추론 최적화 (feat. Cohere)
|
|
0
|
98
|
7월 12, 2026
|
|
TorchSpec: 추측 디코딩 초안 모델을 대규모로 학습하는 파이토치 네이티브 프레임워크
|
|
0
|
437
|
7월 8, 2026
|
|
DeepSpec: 추측 디코딩 초안 모델을 학습하고 평가하는 DeepSeek의 풀스택 코드베이스
|
|
0
|
121
|
7월 3, 2026
|
|
DiffusionGemma: vLLM이 네이티브로 지원하는 최초의 디퓨전 언어 모델(dLLM)
|
|
0
|
1900
|
6월 11, 2026
|
|
Orthrus: Dual-View 디퓨전 디코딩으로 LLM 추론을 가속하는 무손실 병렬 토큰 생성 프레임워크
|
|
0
|
185
|
5월 20, 2026
|
|
Fast Byte Latent Transformer(Fast-BLT): BLT의 바이트 단위 생성을 가속하는 BLT-D/BLT-S/BLT-DV 모델에 대한 연구 (feat. Meta FAIR, Stanford, UW)
|
|
0
|
150
|
5월 13, 2026
|
|
DFlash: 블록 확산(Block Diffusion) 기반으로 LLM 추론 속도를 높이는 오픈소스 라이브러리 (feat. Z.ai)
|
|
0
|
730
|
4월 24, 2026
|
|
메두사: 여러 디코딩 헤더를 사용한 대규모 언어 모델 추론 가속화 프레임워크 (Medusa: Simple Framework for Accelerating LLM Generation with Multiple Decoding Heads)
|
|
0
|
1289
|
12월 26, 2023
|