第 65 期·2026 年 9 月 7 日 · 周一·6 条·来源 2 家·3 个分类

Lyria 3.5 上线 Gemini,Meta 发布实时音频模型 Muse Voice Transcribe

头条 Top Stories

模型MODELS

The Decoder ↗

Google 在 Gemini 中集成 Lyria 3.5 音乐生成模型

Google 将 Lyria 3.5 音乐模型接入 Gemini app 及 API,同时支持 Flow Music、AI Studio 和 Google Vids。新模型在人声表现力和编曲丰富度上有所提升,且官方称训练数据仅使用授权内容。对 AI 音乐创作者而言,这意味着可以直接在 Gemini 生态内完成从生成到视频配乐的流程。

模型MODELS

The Decoder ↗

Meta 发布实时语音转录模型 Muse Voice Transcribe

Meta Superintelligence Labs 推出 Muse Voice Transcribe,以 80 毫秒为单位处理语音流,支持说话人分离与句界检测。据 Artificial Analysis 评测,该模型在流式转录精度和价格上均处于市场前列。Meta 将其定位为个人 AI Agent 的基础组件,未来可配合智能眼镜等设备持续监听并理解对话。