开云(中国)kaiyun网页版登录入口实测 QVQ-Max领先-开云官网登录入口 开云app官网入口

发布日期:2025-08-18 11:43    点击次数:160

开云(中国)kaiyun网页版登录入口实测 QVQ-Max领先-开云官网登录入口 开云app官网入口

阿里又发了个故艳羡的大模子——开云(中国)kaiyun网页版登录入口

QVQ-Max,初版视觉推理模子,对落拓图像或视频都不错进行深度想考。

举个道理的例子,上传一张你的手掌,再点击Thinking,QVQ-Max 就不错给你看手相:

不错看到,在深度想考事后,QVQ-Max 就初始逐渐分析手掌上的线条和其他特征。

包括心线、头线、人命线等主要线条的分析,以及限定手指上的金限定的记号意旨。

这还只是一个比拟有文娱性的例子。

如果你连气儿给 QVQ-Max "喂"多张图片,它也不错进行深度想考:

这两张图片描画了哪些表象?它们之间的洽商是什么?

在一顿想考事后,QVQ-Max 准确地识别出两张图洽商——都是西湖的表象,但一张是春夏时节,另一张是冬季。

再如数学推理,雷同是给它"喂"一张图即可,连发问都省了:

在想考之后,QVQ-Max 是找到了数字们之间的轨则,并最终给出了正确谜底:10。

以及获胜上传一个手绘简笔画视频,并附上一句:

分析视频,将视觉现实与翰墨联结,并为视频中的镜头创建活泼道理的字幕。

最终,QVQ-Max 依旧是稳稳地完成了任务。

网友们看罢,亦然麻溜地去试了试。

不外这一次,QVQ-Max 有点小翻车——路飞是认对了,但这个乔巴……

以及啊,这两天被 OpenAI GPT-4o 图像生成带火的吉卜力,网友们亦然跟上了:

那么 QVQ-Max 的图像视频深度想考实力到底怎么,咱们这就亲手尝试一番。

实测 QVQ-Max

领先,咱们依然来测试一下 QVQ-Max 看图解数学题的智商。

题目是这么的:

然后咱们发问:

这谈题的谜底是若干?

在深度想考事后,QVQ-Max 不仅精确识别出了手写的题目,何况给出了正确谜底:2。

刚才 Qwen 官方给出了看手相的例子,此次咱们再来"喂"下这张图:

问题是这么的:

这是什么?

嗯,是比拟全面地先容了星盘。

接下来,咱们再来测试一下视频推理,例子就用 Anthropic 最新发布的一个:

如果刨去视频里的配景音,单是看现实,依然比拟玄虚的。

对此,QVQ-Max 给出的连结是:

从不雅察到推理

除了限定除外,天然 Qwen 团队莫得公布有关论文,但关于背后的时间亮点,团队依然简便的先容了一番。

领先,团队在 MathVision 这个 benchmark(收罗千般发愤多模态数学)上进行了一番测试:

限定标明,通过弯曲模子 thinking 的最大长度,模子在 MathVision 上的准确率也会抓续普及。

除此除外,团队还回来了 QVQ-Max 的三大智商特色。

包括对图片的通晓智商突出强,无论是复杂的图表依然闲居生存中唾手拍的像片,它都能快速识别出关键元素。比如,它不错告诉你一张像片里有哪些物品、有什么翰墨标志,致使还能指出一些你可能忽略的小细节。

只是识别出图片里的现实还不够,QVQ-Max 还能进一步分析这些信息,并联结配景常识得出论断。

举例,在一谈几何题中,它不错字据题目附带的图形推导出谜底;在一段视频里,它能字据画面现实臆度出接下来可能发生的情节。

除了分析和推理,QVQ-Max 还能作念一些道理的事情,比如帮你经营插画、生成短视频剧本,致使字据你的需求创作变装演出的现实。

如果你上传一幅草稿,它可能会帮你完善成一幅完好的作品;上传一个闲居像片,它不错化身机敏的驳倒家,占卜师。

值得注视的是,QVQ-Max 是免费可用的哦,感兴致的一又友快去试试吧 ~

体验地址:

https://chat.qwen.ai

参考相连:

[ 1 ] https://qwenlm.github.io/zh/blog/qvq-max-preview/

[ 2 ] https://x.com/Alibaba_Qwen/status/1905342260100956210

一键三连「点赞」「转发」「防御心」

接待在驳倒区留住你的看法!

—  完  —

速抢席位!中国 AIGC 产业峰会不雅众报名通谈已开启  � � ‍♀️

首批嘉宾曝光啦  � �   百度、无问芯穹、数势科技、生数科技、像素绽放等十数位 AI 限制创变者将皆聚峰会,让更多东谈主用上 AI、用好 AI,与 AI 一同加快成长~

4 月 16 日,就在北京,通盘来深度求索 AI 何如用  � �  

� � 一键星标 � �

科技前沿弘扬逐日见开云(中国)kaiyun网页版登录入口