|
MiniMax Music 3: 가사와 음악 설명만으로 5분 길이의 완성곡을 만드는 음악 생성 모델
|
|
0
|
428
|
8월 16, 2026
|
|
Xiaomi-Robotics-1: 로봇 없이 모은 10만 시간 데이터로 VLA 스케일링을 검증한 연구
|
|
0
|
283
|
8월 10, 2026
|
|
[2026/06/29 ~ 07/05] 이번 주에 살펴볼 만한 AI/ML 논문 모음
|
|
0
|
1228
|
7월 5, 2026
|
|
ELF: 임베딩 공간에 머무는 연속 확산 언어 모델(Continuous Diffusion Language Model)에 대한 연구
|
|
0
|
221
|
6월 30, 2026
|
|
Supertonic: ONNX 런타임 기반의 초경량 온디바이스 다국어 TTS 시스템 (feat. Supertone AI)
|
|
0
|
1414
|
5월 18, 2026
|
|
ThinkSound: 생각의 사슬(CoT) 추론으로 비디오와 텍스트에서 오디오를 생성하는 통합 프레임워크 (NeurIPS 2025)
|
|
0
|
181
|
4월 30, 2026
|
|
Qwen3-TTS: 500만 시간의 학습 데이터, 12Hz 초저지연 토크나이저로 완성한 오픈소스 Omni-Audio 모델
|
|
0
|
3121
|
1월 25, 2026
|