OmniVoice 是一个大规模多语言零样本文本转语音(TTS)模型,支持 600+ 种语言,是目前同类模型中语言覆盖最广的。基于扩散语言模型式架构,生成高质量语音且推理速度极快——RTF 最低 0.025,约 40 倍于实时速度。有论文和在线 Demo,模型权重托管在 HuggingFace,可本
Musio 是一个本地优先的音乐 Agent,在本机启动音乐源适配器、Spring Boot 后端、React Web 控制台和 Java CLI 启动器,让用户通过网页或命令行连接 QQ 音乐、搜索歌曲、播放音乐、查看歌词/评论,并让 Agent 基于本地记忆和音乐源能力完成推荐、歌单和对话任务。