Qwen3.8-Omni-Flash 上架:能听录音、能看视频,1M 上下文,输入每百万 token 0.8 元
阿里云百炼 2026-09-17 上架,只提供 API,没有开源权重。输入文本 / 图片 / 音频 / 视频,只输出文本,1M 上下文,音频支持 113 种语言和方言;中国内地每百万 token 输入 0.8 元、输出 2.7 元。本站洛洛 AI 目前选不到它
按 2026-09-29 的状态整理。上架日期来自阿里云百炼的「模型上下架与更新」页,规格来自百炼的 Qwen-Omni 文档,价格来自百炼模型定价页。Qwen 官方博客的正文靠前端渲染,本站抓不到,所以博客里的评测数字这篇一个都没收。页末附全部来源。
hihi!洛洛来了!
这次主角的名字有点长:Qwen3.8-Omni-Flash。拆开看就好懂了:Qwen3.8 是千问这一代,Omni 是「全模态」,Flash 是便宜、快的那一档。合起来就是:一个能听录音、看视频、看图、读文字,然后用文字回你的便宜模型。
洛洛第一反应是想起手机里那一堆没整理的课堂录音。要是能把两小时的录音丢进去让它写笔记,期末周能少熬好几个夜。
洛洛碎碎念
名字里带 Omni,洛洛还以为它能开口说话,特意去翻了文档。
结果它只会打字。想让它说话,得用四天后上架的实时版,或者上一代的 Qwen3.5-Omni。好吧,一个只会打字的全能选手。
一句话总结
赶时间的话,看完这一段就够了。
阿里云百炼在 2026-09-17 上架 Qwen3.8-Omni-Flash,模型 ID qwen3.8-omni-flash。输入可以是文本、图片、音频、视频,输出只有文本;上下文 1M token,音频输入支持 113 种语言和方言;有思考和非思考两种模式,支持函数调用和联网搜索。只提供 API,截至 2026-09-29 没有开源权重。中国内地价格是每百万 token 输入 0.8 元、缓存命中 0.1 元、输出 2.7 元,定价页上它只有一个输入价,不像上一代 Omni 那样音频单独按高价算。
时间线
千问 9 月上新挺密,洛洛把和这篇有关的几条排在一起:
| 日期 | 事件 |
|---|---|
| 2026-09-02 | 百炼上架 qwen3.8-max-0902,是 qwen3.8-max 的快照,官方说编程、智能体和视觉理解都有增强,价格和 qwen3.8-max 一样 |
| 2026-09-17 | 百炼上架 qwen3.8-omni-flash,北京和新加坡两个地域同一天 |
| 2026-09-20 | Qwen-Image-2.1 开源,权重放在 Hugging Face 和 ModelScope |
| 2026-09-21 | 实时版 qwen3.8-omni-flash-realtime 上架,做实时音视频对话,能输出文本和音频 |
| 截至 2026-09-29 | Hugging Face 上 Qwen 官方账号下没有 Qwen3.8-Omni 的仓库;本站洛洛 AI 能选 Qwen3.8 Max,选不到 Omni-Flash |
关键数字
这张表来自百炼的 Qwen-Omni 文档。洛洛最在意「视频最长 2 小时」这一行,一节大课刚好塞得下。
| 项目 | Qwen3.8-Omni-Flash |
|---|---|
| 模型 ID | qwen3.8-omni-flash |
| 上下文 | 1M tokens |
| 输入 / 输出 | 文本、图片、音频、视频 / 文本 |
| 音频语种 | 113 种语言和方言,和 Qwen3.5-Omni 一样(74 种语言、39 种方言) |
| 视频 | 单个最长 2 小时,一次最多 64 个 |
| 音频 | 单段最长 3 小时 |
| 思考模式 | 默认开启,默认档位 xhigh;可选 low、medium、xhigh,传 none 关闭 |
| 工具 | 函数调用、联网搜索;Responses API 的内置工具目前只有 web_search |
| 接口 | Chat Completions、Responses |
| 缓存 | 隐式缓存;Responses 另有 Session 缓存 |
| 地域 | 北京、新加坡、中国香港、东京、法兰克福、弗吉尼亚 |
| 权重 | 未开源 |
架构
这一节很短,因为官方基本没说。
- 参数量、模型结构:未公开。 百炼文档只写了能力和用法。上一代 Qwen3-Omni-Flash 在上架记录里写的是 Thinker–Talker 混合专家架构,3.8 这一代有没有沿用,官方没说
- 文档里能看到的细节: 图片每 32×32 像素算 1 个 token,视频画面的 token 算法和 Qwen3.5-Omni 相同;音频每秒 7 个 token;支持双声道立体声和四声道 FOA 空间音频(要打开
use_multichannel),能保留声音的方位信息
评测
截至 2026-09-29,百炼文档页没有评测表。
发布时有媒体转述官方博客,说它「30 项评测平均提升超过 26%」。博客正文本站抓不到,百炼文档里也没有这个数,洛洛没核到官方原文,先不收。本篇也没有收录第三方榜单。
想知道它听录音准不准,最靠谱的办法还是拿自己的录音试一段。
API 与价格
终于到了洛洛百分之百看得懂的部分:多少钱。
百炼定价页原价(人民币 / 每百万 token):
| 地域 | 服务部署范围 | 输入 | 缓存命中输入 | 输出 |
|---|---|---|---|---|
| 华北 2(北京) | 中国内地 | 0.8 元 | 0.1 元 | 2.7 元 |
| 中国香港、东京、法兰克福、弗吉尼亚 | 全球 | 0.8 元 | 0.1 元 | 2.7 元 |
| 新加坡 | 国际 | 1.094 元 | 0.117 元 | 3.427 元 |
洛洛自己算了两笔账:
- 一小时录音多少钱:音频每秒 7 个 token,一小时约 25,200 个 token,按 0.8 元算,输入费大约 2 分钱。回答另按输出价算,思考默认开在 xhigh,只要转写摘要的话记得调低或关掉
- 跟上一代比:Qwen3.5-Omni-Flash 的音频输入是 18 元,换成 0.8 元约降 96%;跟 Qwen3.5-Omni-Plus 的 53 元比约降 98%。媒体说的「音频输入降价超过 98%」可能是后一种比法,官方页面上洛洛没找到这句原话。另外 Qwen3.5-Omni 能输出语音,3.8-Omni-Flash 不能,两者并不完全等价
几个要注意的点:
- 没列免费额度:同一张定价页上,Qwen3.5-Omni 等老型号在北京地域有新人免费额度,Qwen3.8-Omni-Flash 那一行没有这一栏
- 联网搜索另算钱:文档让去看百炼的联网搜索计费说明
- 实时版另有价格:
qwen3.8-omni-flash-realtime(北京)输入文本 / 图片 / 视频 1.5 元、音频 6 元,输出文本 4.5 元、音频 12 元,都是每百万 token - 大文件别用 Base64:Base64 方式编码后要小于 10MB,长录音、长视频得用公网 URL 传
表里是原价,活动价看百炼控制台。价格随时会调整,以百炼定价页为准。
对你意味着什么
- 要整理录音、会议、网课的:这是它最对口的活。两小时视频、三小时录音一次塞得进,价格低到可以放心试。官方文档把会议纪要、字幕生成列为它的首选场景,还给了几段现成提示词:按时间线描述音视频、把语音转写和画面文字分开输出、按场景输出 JSON
- 调 API 的开发者:模型名填
qwen3.8-omni-flash,Chat Completions 和 Responses 都能调。默认开着 xhigh 思考,简单任务传reasoning_effort为 none 关掉,能少出很多 token。在 Chat Completions 里开联网搜索用enable_search加search_options - 需要模型开口说话的:它做不到。实时语音对话用 09-21 上架的实时版,离线生成语音用 Qwen3.5-Omni
- 想自己部署的:没有权重,只能调 API
- 本站用户:洛洛 AI 的模型列表里能选的是 Qwen3.8 Max(标准档,每问 2 核,见苹果核规则),Qwen3.8-Omni-Flash 不在列表里;站里的输入框目前也只收文字
局限
- 只输出文字,不能输出语音
- 没有开源权重,想本地跑的没办法
- 官方没公开架构和参数量,文档里也没放评测表,截至 2026-09-29 能判断效果的只有你自己的测试
- 思考默认开在三档里最高的 xhigh,不改参数的话简单任务也会先想一阵
同月千问的其它上新
- Qwen3.8-Max-0902(09-02):
qwen3.8-max的快照,别名qwen3.8-max-2026-09-02。官方说编程、协作智能体、视觉理解都有增强,延续 1M 上下文和思考模式。北京地域原价和qwen3.8-max一样,每百万 token 输入 12 元、输出 36 元 - Qwen3.8-Omni-Flash 实时版(09-21):
qwen3.8-omni-flash-realtime,做实时音视频交互,能输出文本和音频,新增多通道音频、视频聚合和远程 MCP 工具调用,支持 WebSocket、WebRTC 和 AOQ 接入 - Qwen-Image-2.1(09-20 开源):文生图和改图合在一个模型里,视觉生成部分 7B 参数,能直接生成透明背景的 RGBA 图,改图最多带 10 张参考图。许可是 Qwen Research License,只允许非商用,商用要另找官方申请
洛洛写完这篇最大的感受是:这次的看点不在分数(官方分数洛洛一个都没核到),而在「一个价吃下所有模态」。上一代 Qwen3.5-Omni-Flash 传音频比传文字贵 8 倍多,现在一样价,丢录音进去终于不用先心疼了。
数字都会过期,看到这篇的时候记得回百炼的定价页对一眼。更多新模型速览在模型时讯。洛洛先去把那堆课堂录音翻出来了。
参考来源
官方:
- 阿里云百炼「模型上下架与更新」(qwen3.8-omni-flash 09-17、qwen3.8-omni-flash-realtime 09-21、qwen3.8-max-0902 09-02 条目):https://help.aliyun.com/zh/model-studio/newly-released-models(查阅于 2026-09-29)
- 阿里云百炼 Qwen-Omni 文档(模态、1M 上下文、113 种语言和方言、思考模式、工具、输入限制、token 换算、地域):https://help.aliyun.com/zh/model-studio/qwen-omni(查阅于 2026-09-29)
- 阿里云百炼模型定价(Qwen3.8-Omni-Flash 各地域价格、实时版价格、Qwen3.5-Omni 对比价、qwen3.8-max 与 0902 快照价格):https://help.aliyun.com/zh/model-studio/model-pricing(查阅于 2026-09-29)
- Qwen-Image-2.1 GitHub 仓库(09-20 开源、视觉生成部分 7B、Qwen Research License):https://github.com/QwenLM/Qwen-Image-2.1(2026-09-20)
- Qwen-Image-2.1 Hugging Face 模型页:https://huggingface.co/Qwen/Qwen-Image-2.1(2026-09-20)
- Hugging Face 上 Qwen 官方账号的模型列表(核对没有 Qwen3.8-Omni 权重):https://huggingface.co/Qwen(查阅于 2026-09-29)
本站洛洛 AI 的可选模型来自站点配置(2026-09-29),每问扣几核见苹果核规则。
阶跃 Step 5 Preview 上线:1M 上下文、能看图看视频,每百万 token 输入 7 元、输出 20 元
阶跃星辰 2026-09-20 发布的新一代旗舰基模预览版。1M 上下文、64K 最大输出,输入文本、图片、视频,推理强度 low / medium / high;输入 7 元、缓存命中 0.35 元、输出 20 元每百万 token。官方没公布评测和参数量,权重未开放,本站洛洛 AI 暂时选不到
DeepSeek-V4.1-Flash 发布:新架构、原生多模态、KV 缓存压到 890 字节/token
2026-09-10 正式发布。552B MoE,prefill 只激活 8B,1M 上下文,MIT 开源,API 模型名改为 deepseek-flash。发布时宣布 V4 Pro 将被路由到它,之后官方改为 9 月 14 日后继续提供 V4 Pro、计费不变