Qwen3.8-Omni-Flash 是阿里云百炼(Model Studio)上的全模态模型,输入支持文本、图片、音频与视频,输出为文本,官方定位是音视频理解与内容分析。上下文长度 1M tokens,非思考模式最大输入 991808 tokens、思考模式 983616 tokens,最大输出 131072 tokens;音频输入覆盖 113 种语言和方言,并支持空间音频(Chat Completions 通过 use_multichannel 开启)。
能力上默认开启深度思考并支持调节思考强度,带自定义工具调用(Function Calling)与联网搜索(Responses 内置 web_search);上下文缓存支持自动生效的隐式缓存与 Responses Session 缓存,可显著降低对长音频、长视频反复提问的成本。调用走 Chat Completions 或 Responses,已在华北2(北京)、新加坡、中国香港、日本(东京)、德国(法兰克福)、美国(弗吉尼亚)等地域提供,需使用对应地域的 API Key。适合会议与客服录音的结构化信息提取、视频内容分析、跨语言语音问答这类需要一次性吃下长音视频的场景。
- 四模态输入(文本/图片/音频/视频)→ 文本输出,1M tokens 上下文、最大输出 131072 tokens
- 音频输入覆盖 113 种语言和方言,原生支持空间音频输入,默认开启深度思考
- 支持 Function Calling、联网搜索与隐式上下文缓存,按地域分别提供 API Key
数据统计
数据评估
关于Qwen3.8-Omni-Flash(全模态 API 模型)特别声明
本站AI之旅导航提供的Qwen3.8-Omni-Flash(全模态 API 模型)都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由AI之旅导航实际控制,在2026年9月21日 上午5:05收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,AI之旅导航不承担任何责任。
相关导航
暂无评论...
