首页 / 大模型动态

QwenCloud 上线 Qwen3.8-Omni-Flash:文本、图像、音频与视频输入合入同一模型

QwenCloud 将 Qwen3.8-Omni-Flash列入9月18日模型更新,提供最长100万Token上下文及多模态输入能力。

今日科技圈头条C编辑部已完成来源核验
查看行业与公司影响↓

阿里云旗下 QwenCloud 在9月18日的模型更新记录中列出 qwen3.8-omni-flash。根据该页面的说明,这一模型可接收文本、图像、音频和视频输入,最长上下文为100万Token。

QwenCloud还称,该模型兼容 DashScope 与 OpenAI 协议。上述输入范围、上下文上限和接口兼容性均为厂商公开信息,并非本站测试结论。

多模态接入对应用架构的传导

若开发团队确实需要在同一业务流程中处理文字、图片、录音和视频,单一模型入口可能减少不同模型之间传递中间结果的环节,并让同一段上下文在后续处理时更易保持连贯。但这一变化能否转化为产品效率,仍取决于具体任务下的输出质量、调用延迟、并发限制和计费方式。100万Token是厂商披露的服务上限,不等同于所有应用场景都适合长上下文调用。涉及音视频的数据还需按业务要求处理授权、敏感信息和人工复核;接口兼容性能够降低部分迁移工作,却不能替代上线前的实际验证。

涉及行业行业影响分析简要理由
应用软件中性多模态输入与长上下文被纳入同一模型服务,扩展了统一调用的服务供给;多媒体流程可评估简化接入,但效果与成本仍需结合具体产品验证。
互联网服务与基础设施中性长上下文及多模态请求可能改变资源调度需求,影响取决于实际调用规模。

新闻热点内容来源于媒体公开报道。文章分析仅代表个人观点,不构成投资建议。

进一步了解

从报道到选型

相关报道

专题:AI模型与技术

#通义千问#多模态模型#模型API#长上下文