Xiaomi MiMo-V2-TTS – 小米推出的语音合成大模型

Xiaomi MiMo-V2-TTS 是小米为 Agent 时代推出的语音合成大模型。模型基于自研 Audio Tokenizer 和多码本架构,经上亿小时语音数据预训练与多维度强化学习,实现高度可控的多粒度语音风格控制——从整体基调到局部情绪均可精准调节,支持语气转折、情感递变。

新闻资讯 2026-05-29 PPISO
2 0

文章摘要

Xiaomi MiMo-V2-TTS 是小米为 Agent 时代推出的语音合成大模型。模型基于自研 Audio Tokenizer 和多码本架构,经上亿小时语音数据预训练与多维度强化学习,实现高度可控的多粒度语音风格控制——从整体基调到局部情绪均可精准调节,支持语气转折、情感递变。

特别声明

本文内容由 PPISO 编辑整理发布,仅作为工具选择、资料整理与效率实践参考。涉及第三方网站功能、价格和服务条款时,请以对应官方网站信息为准。

原文链接:http://ainav.ppiso.com/xwzx/359.html

本文标签

这篇文章暂未设置标签。

相关阅读

暂无相关阅读。

评论交流

暂无评论,欢迎留下你的看法。