|
AI 에이전트의 지식 노동 재편: Perplexity 실사용 데이터로 본 자율성, 효율성, 범위
|
|
0
|
23
|
8월 17, 2026
|
|
AI 가치 정렬 논문 94편 중 79%는 가치를 정의하지 않는다: 정렬 연구의 암묵적 가치 이론 분석
|
|
0
|
62
|
8월 15, 2026
|
|
멀티에이전트 시스템의 실패 패턴: AI 에이전트 군집의 쏠림, 담합, 목표 충돌에 대한 Anthropic의 연구
|
|
0
|
167
|
8월 13, 2026
|
|
ai-knowledge-graph: 비정형 텍스트에서 지식 그래프를 뽑아 시각화하는 파이썬 도구
|
|
0
|
416
|
8월 11, 2026
|
|
Model DNA 심층 분석 — 공개 아티팩트만으로 LLM '밑바닥 학습'을 검증할 수 있는가 (아키텍처·토크나이저·CKA, PyTorch 재현)
|
|
0
|
208
|
8월 9, 2026
|
|
anydoc: 오피스 문서를 LLM이 읽을 Markdown으로 5밀리초 안에 바꾸는 Rust 라이브러리
|
|
0
|
548
|
8월 9, 2026
|
|
Meta, 터미널 코딩 에이전트 Muse Code와 코딩 특화 모델 Muse Spark 1.2 출시
|
|
0
|
247
|
8월 8, 2026
|
|
[GN⁺] LLM은 ‘점프’할 수 없다: Einstein의 등가원리와 귀추(abduction)
|
|
0
|
231
|
8월 8, 2026
|
|
SeedRealtime: ByteDance Seed의 보면서 듣고 말하는 전이중(Full-Duplex) 모델
|
|
0
|
179
|
8월 8, 2026
|
|
Liquid AI, 휴대폰에서 실행 가능한 온-디바이스 에이전트 모델 LFM2.5-2.6B 공개
|
|
1
|
348
|
8월 7, 2026
|
|
DiffusionGemma 기술 문서 리뷰: 자기회귀 Gemma 4를 이산 확산 모델로 변환한 초고속 텍스트 생성에 대한 연구
|
|
0
|
286
|
8월 6, 2026
|
|
Mistral, 추론 시점에 정책을 바꾸는 3B 규모의 멀티모달 안전성 분류 모델 Shieldstral 공개
|
|
0
|
145
|
8월 6, 2026
|
|
DeepSeek-V4-Flash 정식 버전 출시, 성능은 좋아지면서 가격은 낮아진 모델 (Task당 약 $0.027)
|
|
0
|
299
|
8월 6, 2026
|
|
Instella-MoE: AMD Instinct GPU에서 처음부터 학습한 완전 오픈 16B MoE 모델
|
|
0
|
148
|
8월 4, 2026
|
|
ScientistOne: Chain-of-Evidence로 모든 주장을 증거에 잇는 자율 연구 시스템에 대한 Google의 연구
|
|
0
|
272
|
8월 3, 2026
|
|
Qwen, Max 계열 최초로 가중치를 공개하는 2.4T 규모 플래그십 모델 Qwen3.8-Max 출시 및 공개 예정
|
|
0
|
458
|
8월 3, 2026
|
|
stop-slop: 산문에서 AI 글쓰기 패턴을 찾아 제거하는 Claude 스킬
|
|
0
|
393
|
7월 31, 2026
|
|
GRAM: 좋게도 나쁘게도 사용할 수 있는 이중용도(Dual-Use) 지식만 떼어내는 모듈형 사전학습 기반 접근 제어 기법에 대한 연구 (feat. Anthropic)
|
|
0
|
142
|
7월 29, 2026
|
|
Kimi K3 모델 가중치 및 기술 문서 공개: 2.8T 오픈 모델의 아키텍처와 학습 레시피 심층 분석
|
|
0
|
545
|
7월 29, 2026
|
|
SymptomAI: 임상의보다 정확한 대화형 증상 평가를 위한 AI 에이전트 실증 연구 (feat. Google)
|
|
0
|
125
|
7월 28, 2026
|
|
Unstract: 프롬프트로 비정형 문서에서 구조화된 JSON을 추출하는 LLM 플랫폼
|
|
0
|
258
|
7월 28, 2026
|
|
Anthropic이 공개한 Claude Opus 5 프롬프트 작성법 및 Opus 4.8 마이그레이션 가이드
|
|
0
|
1445
|
7월 28, 2026
|
|
Quivr: 어떤 LLM과 파일에도 연결되는 제품 중심의 오픈소스 RAG 프레임워크
|
|
0
|
347
|
7월 27, 2026
|
|
Anthropic, Fable 5급 성능을 절반 가격에 제공하는 Claude Opus 5 공개
|
|
0
|
299
|
7월 27, 2026
|
|
PIKE-RAG: 산업용 RAG를 위한 지식 원자화와 작업 분해 프레임워크에 대한 연구 (feat. Microsoft)
|
|
0
|
423
|
7월 26, 2026
|
|
아이폰에 350억 파라미터 모델을 담아본 이야기
|
|
2
|
436
|
7월 26, 2026
|
|
gigatoken: HuggingFace보다 약 1000배 빠른 GB/s급 LLM 토크나이저
|
|
0
|
228
|
7월 25, 2026
|
|
WANDR, 리서치 에이전트의 넓고 깊은 탐색 능력을 평가하는 벤치마크 (feat. Perplexity)
|
|
0
|
118
|
7월 23, 2026
|
|
AppLess: 물어보면 화면이 즉석에서 생성되는 앱 없는 스마트폰 실험
|
|
0
|
236
|
7월 23, 2026
|
|
feyn, 답변 전 DB를 먼저 살펴보는 text-to-SQL 모델 SQRL 공개 (feat. Chonkie)
|
|
0
|
213
|
7월 23, 2026
|