Hy Image 3.5 Preview测评报告!真的能打吗?
这一集测评的是腾讯新出的图像模型 Hy Image 3.5 Preview,测试依然直接在 OpenRouter 的 Playground 上进行,用的还是那套 6 题的文生图 Benchmark。先给个提醒:答案也许不是你想要的,观看需谨慎。
Q1 中文长文本排版支持(水彩风珠海 5 天行程插画):这一题错得挺多。第一天渔女的形象就不对,「渔民老鹈鹕」和「海鲜」里的「鹈鹕」两个字写错;第二天「鲸鲨馆」三个字明显错;第四天「农家乐」的「农家」两个字错;第五天「励骏庞都」的「骏」和「庞」都错,「手撕鸡」的「撕」还少了提手旁。估计它对中文的支持还是不大好。
Q2 推理和中文支持(桂林手绘三日行程图):这一题不给具体的行程描述,要求模型自己推理。三天行程的安排没有问题,说明它是有推理能力的;但中文错别字同样不少,这里就不一个个指出来了,毕竟本题主要考察的是推理能力。
Q3 同一角色多视角一致性(女孩四宫格不同角度):很明显不是四宫格排列,而且没有看到 3/4 视角的半身照,这一题没做到。
Q4 物理常识(女孩落地镜自拍 + 水杯筷子折射):一共挑出四处问题。第一,镜子里面的女孩明显是在镜子外面的;第二,女孩的左手是拇指扶着手机边框,但镜子中的女孩明显是食指扶着手机;第三,从我们这个角度看,杯子不大可能出现在镜子中;第四,杯子的水不是满的。(更正:视频里提过的「手机取景器的成像有问题」不算问题 —— 对着镜子自拍应当用后置摄像头,取景画面本来就是镜中景象;题面现已补充「用后置摄像头」这一限定。)不过值得一提的是,筷子的折射它是做对了——终于有一个模型把折射画对了。
Q5 柱状图和饼图图表生成:先看左边的柱状图,Q3 的高度超出了 25。再看右边的饼图,提示词明确说了 B 品牌是 28%,但它画的是 35%,而下面的标签又是对的;不过标签里 D 品牌的 15% 又是错的,C 品牌干脆没有标签,直接就跳到了 D 品牌。
Q6 参考图和图片编辑(将多个人物参考图里左右两个男生的位置互换):左右男生的位置确实互换了,但有几个问题。第一,画面下方还残留着原来白人男生握着手机的一只手;第二,原来右边穿花衣服的小女孩,有一小部分身体换到左边来了;第三,右边同一个小女孩身上,平白无故多了个黑人的手指。
最终这个模型在这套 Benchmark 上的得分如何,我这里还没有算出来,晚点会在博客上公布,敬请查阅。大家看完之后,觉得这个模型怎么样呢?评论区聊聊。








