AI音频

OmniVoice:支持 600+ 语言的零样本语音合成模型

OmniVoice:支持 600+ 语言的零样本语音合成模型

OmniVoice 是一个大规模多语言零样本文本转语音(TTS)模型,支持 600+ 种语言,是目前同类模型中语言覆盖最广的。基于扩散语言模型式架构,生成高质量语音且推理速度极快——RTF 最低 0.025,约 40 倍于实时速度。有论文和在线 Demo,模型权重托管在 HuggingFace,可本

指北君 指北君 2026-09-10
61 0 0
Musio:本地优先的音乐 Agent

Musio:本地优先的音乐 Agent

Musio 是一个本地优先的音乐 Agent,在本机启动音乐源适配器、Spring Boot 后端、React Web 控制台和 Java CLI 启动器,让用户通过网页或命令行连接 QQ 音乐、搜索歌曲、播放音乐、查看歌词/评论,并让 Agent 基于本地记忆和音乐源能力完成推荐、歌单和对话任务。

指北君 指北君 2026-08-22
75 0 0