千问发布语音合成大模型 Qwen-Audio-3.0-TTS,支持自然语言指令控制,Flash 版首包延时 300 毫秒级别
2026-07-20 17:22:48
来源:
市场资讯
作者:疏桐
据千问官方消息,千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS。该模型支持 Free-style 自然语言指令控制,用户可通过自然语言描述实现对合成语音效果的定制。
此次发布的模型包含两个版本:Flash 版本与 Plus 版本。Flash 版本面向实时交互场景设计,首包延时达到 300 毫秒级别,可用于对话等低延迟语音合成任务。Plus 版本面向高质量生成需求,提供更优的合成音质表现。
市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开 

全部评论
机会情报
- 伦铜连破历史新高,铜矿龙头迎来“算力底层材料”逻辑重估
- 8月全球食品价格指数创近4年新高,农业种植迎来价值修复
- 伦铜创历史新高 瑞银:未来铜价或升至15500美元(附概念股)
- AI基建投资激增 两大存储芯片巨头库存告急,存储芯片又要涨了?(附概念股)
- 增资3600亿元,八大金融央企补充核心一级资本!金融板块将受何影响?
- 折叠屏手机迎“超级发布周”,产业链三大增量环节受关注
- 金刚石散热正处于从0到1的产业化拐点 具备高壁垒与高弹性双重优势
- 猪周期大拐点临近 机构布局养殖板块(附概念股)
- AI算力扩张遭遇电力硬约束,算电协同打开绿电重估空间
- 26年上半年中国新船订单接近2023年全年,头部船厂满产,行业高景气持续
