Qwen3.5-LiveTranslate-Flash模型介绍、能力、费用价格及免费token领取指南

阿里云千问Qwen3.5-LiveTranslate-Flash模型是阿里云百炼平台推出的高精度、高响应、高鲁棒性的多语言实时音视频同传大模型,基于Qwen3.5-Omni基座模型,融合海量多模态数据、跨语言跨模态对齐与视觉增强技术,通义千问3.5-LiveTranslate-Flash 实现了离线和实时两种音视频翻译能力,能听懂60种语言,会说29种语言。

开通百炼:https://t.aliyun.com/U/fPVHqY 免费领Token,Qwen3.5-LiveTranslate-Flash可以免费体验100万Tokens。

Qwen3.5-LiveTranslate-Flash模型可用于国际会议、跨境直播、多语种客服等对实时性与准确性要求高的场景,可通过 函数计算FC 一键快速部署该模型。

Qwen3.5-LiveTranslate-Flash模型能力

  • 多语言覆盖:支持 60 种语言互译,其中 29 种语言支持音频+文本输出,其余 31 种仅输出文本
  • 视觉增强翻译:同时处理 音频 + 图像输入,通过分析画面中的口型、动作、文字等视觉上下文,显著提升嘈杂环境或一词多义场景下的翻译准确率
  • 低延迟高质量:端到端同传延迟低至 2.8 秒,采用语义单元预测技术解决跨语言语序差异,翻译质量接近离线水平
  • 自然拟人语音:生成语气、情感自适应的高质量合成语音;支持 声音复刻(可实时或使用预存音色),使翻译播报“听起来像本人说外语”
  • 热词配置:支持注入领域热词,提升专业术语翻译准确性

技术规格

  • 输入模态:Audio + Image
  • 输出模态:Text + Audio
  • 上下文长度:53,248 tokens(最大输入 49,152,最大输出 4,096)
  • 不支持功能:Function Calling、结构化输出、联网搜索、前缀续写、批量推理、模型调优

费用价格与限流(华北2/北京)

  • 价格:音频输入 40 元/百万 tokens,图片输入 3.3 元/百万 tokens,文本输出 100 元/百万 tokens,音频输出 160 元/百万 tokens
  • 限流:RPM=10,TPM=100,000

更多关于Qwen3.5-LiveTranslate-Flash模型的介绍,请移步到阿里云百炼AI大模型官方平台查看:https://t.aliyun.com/U/fPVHqY

云服务器租用优惠价格,2026年最新: