Description
千问最新一代全模态模型 Qwen3.5-Omni 正式发布!支持文本,图片,音频,音视频理解,包含 Plus、Flash、Light三种尺寸的Instruct版本,灵活适配不同场景需求,更在离线智能与实时交互两大维度实现了突破。
💡 突出亮点:惊喜涌现的「氛围编程」
Qwen3.5-Omni-Plus 自发涌现出 Audio-Visual Vibe Coding 能力:只需对着镜头描述创意,即可转化为可运行的代码。
🧠 离线模式:硬核智力升级
精细化音视频Caption: 支持时间戳、场景切片及角色-音频映射,输出剧本级详细描述!
业界领先性能: 在215项音视频/音频子任务与基准测试中全面领先!音频任务超越 Gemini-3.1 Pro,音视频理解能力与 Gemini-3.1 Pro对齐。
原生多模态:基于超1亿小时音视频数据训练,支持长达10小时音频输入,及超过 400 秒的 720P(1 FPS)音视频输入。
多语言支持:语音识别覆盖113种语言及方言,语音合成支持36种语言及方言。
🎙️在线模式:拟人实时交互
细粒度语音控制: 实时调节情绪、语速、音量。
个性化声音克隆: 上传语音样本,即可定制拥有克隆音色的专属AI助手。
语义级打断: 精准识别意图,有效过滤无意义的背景噪音干扰与附和回应。
联网增强: 内置 WebSearch 与复杂工具调用。
👉 快来试试:
Blog: https://qwen.ai/blog?id=qwen3.5-omni
QwenChat:https://chat.qwen.ai/
阿里云百炼:
离线:https://bailian.console.aliyun.com/cn-beijing?tab=model#/model-market/detail/qwen3.5-omni-plus
实时:https://bailian.console.aliyun.com/cn-beijing?tab=model#/model-market/detail/qwen3.5-omni-flash
魔搭社区:
离线:https://modelscope.cn/studios/Qwen/Qwen3.5-Omni-Offline-Demo
实时:https://modelscope.cn/studios/Qwen/Qwen3.5-Omni-Online-Demo
Comments
说qwen不好用的,可以试试这个版本的[doge]
♥ 137 ↩ 73
我就不太明白,每次新上的这些模型,为什么在APP里就是用不了?难道你们不是一家吗?在国内安装千问APP还有什么意思?新上的模型却没有。
♥ 133 ↩ 22
何意味
♥ 89 ↩ 31
跟MiniMax学,现在Qwen也打算不开源了?
♥ 88 ↩ 22
想要zimage edit[doge]
♥ 74 ↩ 3
大概率不开源,大家散了吧。开源了来打我脸
♥ 57 ↩ 34
qwen3.5-coder会出吗?
♥ 48 ↩ 5
已经用上
♥ 46 ↩ 19
开源呢,为什么直接叫plus和flash了,不打算开源了吗[大哭]不要啊,千问也不开源的话,瓦塔西
♥ 46 ↩ 5
说好的保持开源呐?
♥ 40 ↩ 2
[笑哭]这个看起来很厉害,为啥app就拉胯呢
♥ 39 ↩ 27
我认可,闭源开源都可以,只要能未来能超越claude code的效果且性价比很高,我就支持!现在claude code是真不干人事,便宜的选项都不少但是都不够好用。
♥ 33 ↩ 16
你app的3.5plus去哪了,有钱发奶茶没钱给模型
♥ 30 ↩ 3
你知道的,大伙一直在等的不是这个,某2.5 2.6开不开嘛给句痛快话[doge]
♥ 25 ↩ 5
你app的3.5plus去哪了
♥ 24 ↩ 4
散了散了,反正不开源,而且也没比kimi强多少
♥ 24 ↩ 1
[微笑][微笑][微笑]何意味??
♥ 18 ↩ 7
千问推广那么用力,能不能把产品包装好好搞一搞啊?一打开千问网页版,左上角一大堆模型选项,全都是英文名,也没法一眼看出来应该选哪个。这是给普通用户用的吗?模型选项不应该是根据用户需求自动切换的吗?
♥ 18 ↩ 11
这应该是大佬走后的最后的最好的一个模型
♥ 16 ↩ 8
感觉ai发展到一定的便利性,世界可能更需要文科了,语言逻辑表达能力会变得十分重要
♥ 13 ↩ 12