HiAPI
概览模型广场API 密钥用量统计调用日志充值账单推荐奖励在线试用产物存储更新公告联系我们账号设置
金额单位
N
Powered by hiapi
账号设置

欢迎

联系我们

在线体验 Qwen-Audio 3.0 TTS Flash 低延迟文本转语音,试听真实中英混合样例,查看音色、语速、音高、价格与 API 代码。

提供商: Alibaba

类型: 音乐生成

接口: /v1/tasks

状态: 已开放

消耗: 查看页面实时价格

返回模型列表

Qwen-Audio 3.0 TTS Flash

提供商 Alibaba语音

在线体验 Qwen-Audio 3.0 TTS Flash 低延迟文本转语音,试听真实中英混合样例,查看音色、语速、音高、价格与 API 代码。

定价

标准用量

60 积分/ 1,000 字符

输入

更多参数

生成设置

输入要转换为语音的内容;单次最多 20,000 个 Unicode 字符,长度:1 - 20000 个字符

选择当前模型支持的系统音色

选择输出音频格式;PCM 为原始音频数据

输出音频采样率(Hz),必须是整数

输出音量,范围 0–100,范围:0 - 100,必须是整数

语速倍率,1 为正常语速,范围:0.5 - 2

音高倍率,1 为原始音高,范围:0.5 - 2

仅在音频格式为 Opus 时生效,单位为 kbps,范围:6 - 510,必须是整数

可选,用于提示合成文本的语言;一次只能选择一种,最多 1 个

可选,用于控制方言、情绪或角色风格,至少 1 个字符

高级参数

用于复现结果 · 整数 0 - 65535
预估费用0 积分0 字符 × 60 积分 / 千字符

输出

准备生成

配置参数并点击"运行"查看输出结果。

--

试听真实语音样例

试听中英混合文本的真实输出,并查看本次合成使用的文本与默认音色。

低延迟 · longanhuan_v3.6

中英混合实验室样例

使用默认系统音色测试中文清晰度、英文切换、数字读法、节奏和自然停顿。

输入文本

欢迎来到 HiAPI 音频模型实验室。我们正在比较两种语音合成模型在中文表达、英文切换和数字读法上的表现。Today, we test clarity, rhythm, and natural pauses. 版本三点零,样本编号二零二六。

相关音频模型

根据音乐、单人语音或多人对白任务选择相邻路线。

高质量旁白

Qwen-Audio 3.0 TTS Plus

适合视频旁白和有声内容的高质量配音。

多说话人

ElevenLabs Text to Dialogue

在结构化对话中为每句台词使用不同音色。

对比 AI 音频 API

关于 Qwen-Audio 3.0 TTS Flash

在线体验 Qwen-Audio 3.0 TTS Flash 低延迟文本转语音,试听真实中英混合样例,查看音色、语速、音高、价格与 API 代码。

本页 Playground 和 API Quickstart 使用同一个模型 ID:qwen-audio-3.0-tts-flash。

提供商
Alibaba
任务
文本转语音
输出
音频
价格
60 积分 / 千字符

模型规格

以下规格对应当前 Qwen-Audio 3.0 TTS Flash 请求契约。

文本
1-20,000 个 Unicode 字符
系统音色
longanhuan_v3.6longjielidou_v3.6loongeva_v3.6loongjohn
输出
PCM / WAV / MP3 / Opus8-48 kHz
计费
60 积分 / 千字符

如何使用 Qwen-Audio 3.0 TTS Flash

用三步完成输入组织、试听验证和 API 接入。

01 准备朗读文本

整理标点、数字和中英文切换,让停顿与读法更明确。

02 选择音色与参数

选择系统音色,再调整语速、音高、音量、采样率和格式。

03 试听后接入

在 Playground 核对读法与节奏,再通过同一个模型 ID 创建正式任务。

API 快速接入

复制可运行的最小请求;完整参数、任务查询与错误码请查看文档。

接口
POST /v1/tasks
模型 ID
qwen-audio-3.0-tts-flash
cURL
curl -X POST "https://api.hiapi.ai/v1/tasks" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen-audio-3.0-tts-flash",
  "input": {
    "text": "欢迎来到 HiAPI 音频模型实验室。我们正在比较两种语音合成模型在中文表达、英文切换和数字读法上的表现。Today, we test clarity, rhythm, and natural pauses. 版本三点零,样本编号二零二六。",
    "voice": "longanhuan_v3.6",
    "format": "mp3",
    "sample_rate": 22050,
    "volume": 50,
    "rate": 1,
    "pitch": 1,
    "seed": 0
  }
}'

创建请求会立即返回 taskId;音频生成在后台异步完成。

查看完整 API 文档
需要比较不同模型和计费档位?查看全部模型实时价格

常见问题

Qwen-Audio 3.0 TTS Flash 一次可以合成多少文字?

当前单个任务接受 1 至 20,000 个 Unicode 字符。中文汉字在上游计费时按两个有效字符计算,其他字符按一个计算。

可以调节语速、音高和输出格式吗?

可以。rate 和 pitch 的范围都是 0.5 至 2;输出支持 PCM、WAV、MP3 和 Opus,并可选择 8 kHz 至 48 kHz 采样率。

Qwen-Audio 3.0 TTS Flash 如何计费?

HiAPI 按有效字符数计费;实时单价以本页价格区为准。