|
FRIDAY: 음성으로 대화하며 MCP 도구를 실시간으로 활용하는 AI 비서
|
|
0
|
186
|
7월 19, 2026
|
|
Microsoft AI, 5개 분야 7종 MAI 모델 공개. 증류 없이 바닥부터 학습한 모델 패밀리
|
|
3
|
1331
|
6월 26, 2026
|
|
MOSS-TTS-Local-Transformer-v1.5, 로컬 서빙에 최적화된 48kHz 스트리밍 TTS 모델 (feat. SGLang-Omni)
|
|
0
|
189
|
6월 22, 2026
|
|
MoneyPrinterTurbo: 키워드만 입력하면 자막과 음성까지 갖춘 숏폼 영상을 자동 생성하는 도구
|
|
0
|
195
|
6월 14, 2026
|
|
OmniVoice: 600개 이상의 언어를 지원하는 제로샷 음성 복제 및 음성 디자인 TTS 모델
|
|
1
|
2965
|
4월 15, 2026
|
|
MOSS-TTS-Nano: CPU만으로 실시간 동작하는 0.1B 파라미터 다국어 TTS 모델
|
|
0
|
497
|
4월 15, 2026
|
|
Pixelle-Video: 주제 하나만 입력하면 스크립트부터 영상까지 자동 완성되는 AI 숏폼 영상 제작 엔진
|
|
0
|
413
|
4월 14, 2026
|
|
VibeVoice: 60분 장시간 음성 인식(ASR)과 실시간 TTS를 통합한 Microsoft의 오픈소스 음성 AI 모델 패밀리
|
|
0
|
647
|
4월 3, 2026
|
|
Voicebox: Qwen3-TTS 기반의 오픈소스 모던 음성 통신 플랫폼
|
|
0
|
445
|
2월 25, 2026
|
|
VoxCPM: 토크나이저 없이 작동하는, 0.5B 규모의 고품질 AI 음성 생성 및 복제를 위한 영어/중국어 TTS 모델
|
|
1
|
560
|
1월 11, 2026
|
|
Audibit: 개발자를 위한 오픈소스 TTS 팟캐스트 플랫폼
|
|
0
|
270
|
5월 3, 2025
|
|
Dia: 감정 표현 및 비언어적 요소까지 생성이 가능한 1.6B 규모의 오픈소스 TTS 모델 (feat. Nari Labs)
|
|
2
|
2279
|
4월 25, 2025
|
|
countless.dev, TTS / STT / LLM / Embedding 등 분야별 모델 비교 서비스
|
|
0
|
410
|
12월 8, 2024
|
|
june, 로컬에서 실행되는 음성 비서 (ollama w/ Llama-3 + OpenAI Whisper + Coqui TTS)
|
|
0
|
2725
|
6월 25, 2024
|
|
[GN] AI 어플리케이션을 위한 새로운 Language Model Stack
|
|
0
|
367
|
6월 19, 2023
|
|
Meta, 1100개 이상의 언어에 대한 음성-텍스트, 텍스트-음성 변환 모델 MMS(Massively Multilingual Speech) 공개
|
|
0
|
2403
|
5월 23, 2023
|