|
WARP: 2.78조 파라미터 Kimi K3를 64GB 맥북에서 실행하는 C 기반 추론 엔진
|
|
0
|
289
|
8월 12, 2026
|
|
kimi-k3-in-c: 2.78조 파라미터 모델을 GPU 없이 8GB 램에서 돌리는 C99 추론 엔진
|
|
0
|
870
|
8월 12, 2026
|
|
Thinking Machines Lab, 4분의 1 크기로 Inkling에 필적하는 Inkling-Small 공개
|
|
0
|
227
|
8월 5, 2026
|
|
TurboFieldfare: 8GB 맥북에서 Gemma 4 26B를 약 2GB 메모리로 돌리는 Swift 런타임
|
|
0
|
361
|
8월 3, 2026
|
|
LLaDA2.2: 레벤슈타인(Levenshtein) 편집 기법을 도입하여 에이전트 작업을 지원하는 확산 언어 모델(Diffusion LM)
|
|
0
|
212
|
7월 30, 2026
|
|
Soofi S 30B-A3B: 독일어/영어를 위한 주권형 오픈소스 하이브리드 Mamba-MoE 모델
|
|
0
|
119
|
7월 21, 2026
|
|
MoBA: 어텐션에 전문가 혼합을 적용해 긴 문맥을 효율적으로 처리하는 블록 어텐션 (feat. MoonshotAI)
|
|
0
|
205
|
7월 20, 2026
|
|
Inkling: Thinking Machines Lab가 처음으로 공개하는 975B 멀티모달 MoE 모델
|
|
0
|
158
|
7월 17, 2026
|
|
colibri: 744B MoE 모델을 25GB RAM 소비자 PC에서 실행하는 순수 C 추론 엔진
|
|
0
|
3505
|
7월 14, 2026
|
|
Apple, 3세대 파운데이션 모델(AFM) 5종 공개, 온디바이스 희소 아키텍처로 진화한 Apple Intelligence
|
|
0
|
713
|
6월 10, 2026
|
|
LLaDA2.0-Uni: 마스크 토큰 예측 패러다임으로 멀티모달 이해와 생성을 통합한 확산 언어 모델에 대한 연구
|
|
0
|
207
|
4월 27, 2026
|
|
MiniMind: 단돈 3달러, 2시간 만에 64M GPT를 처음부터 학습시키며 학습하는 오픈소스 초경량 언어 모델 프로젝트
|
|
0
|
8618
|
3월 31, 2026
|
|
flash-moe: 순수 C와 Metal로 구현한, M3 Max 맥북 프로에서 397B 파라미터 MoE 모델을 실행하는 고성능 추론 엔진
|
|
0
|
2430
|
3월 23, 2026
|
|
Qwen3.5: 초기부터 멀티모달 데이터로 학습한, 에이전트 중심의 워크플로우에 최적화된 Native Multimodal Agent Model
|
|
1
|
3953
|
2월 24, 2026
|
|
Qwen3-VL: Alibaba Qwen팀이 공개한 더 선명한 시각, 더 깊은 생각, 더 넓은 행동이 가능한 Multimodal LLM
|
|
0
|
4056
|
9월 30, 2025
|
|
dots.llm1: 14B의 활성 파라매터로 Qwen2.5-72B 모델과 유사한 성능을 보이는 MoE 모델
|
|
0
|
646
|
6월 12, 2025
|
|
DeepEP: 효율적인 Mixture-of-Experts 병렬 통신 라이브러리 (feat. DeepSeek)
|
|
0
|
594
|
2월 25, 2025
|
|
EPLB: MoE 모델에서 GPU들 간의 부하를 분배(Load Balancing)하는 라이브러리 (feat. DeepSeek)
|
|
0
|
602
|
2월 27, 2025
|
|
Microsoft, Phi-3 모델들을 개선한 Phi-3.5 모델 시리즈 공개 (+ Phi-3.5-MoE-instruct)
|
|
0
|
1235
|
8월 22, 2024
|
|
[2024/07/08 ~ 07/14] 이번 주의 주요 ML 논문 (Top ML Papers of the Week)
|
|
0
|
629
|
7월 14, 2024
|
|
NVIDIA H100 & TensorRT-LLM으로 Mixtral 8x7B 모델 고성능 달성하기 (feat. NVIDIA 블로그 글)
|
|
0
|
355
|
7월 10, 2024
|
|
MoA(Mixture-of-Agents, 에이전트 혼합 기법), LLM 성능을 향상시키기 위한 새로운 기법
|
|
0
|
2229
|
6월 21, 2024
|
|
DeepSeek-V2: 강력하고 경제적이며 효율적인 전문가 혼합(MoE) 언어모델
|
|
0
|
1218
|
5월 15, 2024
|
|
[GN⁺] Mistral AI, 새로운 오픈 모델 Mixtral 8x22B 공개
|
|
0
|
598
|
4월 19, 2024
|
|
MoD(Mixture-of-Depths): Transformer 기반 언어 모델 연산 최적화를 위한 접근법, 그리고 MoDE(MoD+MoE)
|
|
0
|
2817
|
4월 7, 2024
|
|
Jamba: AI21이 공개한 Mamba 기반의 MoE 공개 모델 (OpenLLM)
|
|
0
|
1797
|
3월 29, 2024
|
|
Qwen1.5-MoE: 2.7B 규모의 활성화된 매개변수로 7B 규모의 모델과 유사한 성능을 보이는 Qwen의 새로운 MoE 모델
|
|
0
|
721
|
3월 29, 2024
|
|
[GN⁺] 구글의 차세대 모델: Gemini 1.5
|
|
0
|
558
|
2월 16, 2024
|
|
MoE-LLaVA: 대규모 Vision-Language 모델을 위한 전문가 혼합 기법 적용 (Mixture of Experts for Large Vision-Language Models)
|
|
0
|
1624
|
2월 6, 2024
|
|
[2024/01/01 ~ 01/07] 이번 주의 주요 ML 논문 (Top ML Papers of the Week)
|
|
0
|
903
|
1월 8, 2024
|