GitHub 精选microsoft/VibeVoiceGitHub Repomicrosoft/VibeVoice微软开源的前沿语音AI模型家族,支持60分钟长音频单次ASR(含说话人识别)、90分钟多说话人TTS和实时流式TTS,可处理50+语言。long form audiomultimodal creationrealtime ttsspeech recognitiontext to speechvoice ai推荐理由创造者可拆解其长音频ASR/TTS能力,用于播客笔记、会议转录、语音对话产品原型,或接入AI工作流实现自动语音内容生成。二创切入点围绕项目能力写工具教程、场景拆解或对比评测。复制 GitHub 概要后可直接改写成文章、社媒卡片或选题备忘。生成分享卡片可以用于私域传播、收藏夹或选题库归档。项目事实语言Python协议mitIssues178首次收录2026/07/03