Qwen3.5-Omni:新一代原生全模态大模型,支持 10 小时音频与 400 万帧视频
Qwen3.5-Omni 是新一代原生全模态大模型,支持文本、图像、音频、视频输入输出。采用 Thinker-Talker 架构和 Hybrid-Attention MoE,支持 256k 上下文、10 小时音频、400 万帧视频处理,在 215 个基准测试中达到 SOTA。
Qwen3.5-Omni 全模态模型 AI 模型
9 min read
1 篇文章
浏览关于 Qwen3.5-Omni 的 1 篇文章、工具介绍与使用记录,按发布时间查找相关内容。