阿里千问Qwen3.5-Omni:全模态大模型的新突破
近日,阿里正式发布千问新一代全模态大模型Qwen3.5-Omni。该模型在音视频理解、识别及交互等215项任务中取得SOTA(性能最佳)成绩,综合表现超越Gemini - 3.1 Pro,跻身全球顶尖全模态大模型行列。它具备极强的音视频理解与实时交互能力,支持生成详细且可控的结构化描述,还可精准识别113种语言及方言。
Qwen3.5 - Omni尤为引人注目的是自然涌现出音视频Vibe Coding能力。用户仅需对着镜头口述需求,即可自主生成App、网页等复杂产品代码。这一功能极大地降低了开发门槛,让更多非专业开发者也能参与到产品开发中来,为软件开发领域带来了新的变革。
在商业化方面,阿里云百炼已上线Plus、Flash、Light三种API,广泛适用于短视频、游戏及自媒体等行业。开发者调用成本极具竞争力,每百万Tokens输入不到0.8元,仅为Gemini - 3.1 Pro的十分之一。同时,普通用户亦可通过Qwen Chat免费体验,这有助于吸引更多用户和开发者,扩大市场份额。
编辑观点:阿里Qwen3.5 - Omni凭借强大的全模态能力和创新的音视频代码生成功能,在大模型市场脱颖而出。低成本的商业化策略有望吸引大量开发者和用户,未来有望在多个行业发挥重要作用,提升阿里在AI领域的竞争力。
