inference-cost
| 글 | 댓글 | 조회수 | 활동 | |
|---|---|---|---|---|
| Weave Router: 코딩 에이전트의 요청마다 로컬 임베딩으로 모델을 골라 주는 LLM 라우팅 프록시 |
|
0 | 135 | 8월 28, 2026 |
| [GN⁺] 외주 인력 + LocalAI 조합이 곧 프론티어 랩보다 경제적이 될 것 |
|
0 | 2029 | 5월 31, 2026 |
| DeepSeek-V3/R1 추론 시스템 개요 공개 (feat. DeepSeek OpenInfra) |
|
0 | 711 | 3월 2, 2025 |
| LLMflation: 대규모 언어 모델(LLM) 추론 비용의 급격한 감소 (feat. a16z) |
|
0 | 808 | 11월 15, 2024 |