最新上线 GPT-6 Sol 测评报告来了,继续在 Pi 中接入思考拉到 xhigh,废话不多说开始。

第一题强约束指令遵循句子生成测试,结尾都是从 1 到 10 结尾的,句子都是通顺的。值得提一下的是,GPT-6 写的句子很少用成语和俗语,不像国内模型什么九九归一、腊八、数九之类的。

第二题鹈鹕土星环骑自行车 SVG 测试,转弯感觉还可以,但有几个问题:一是把手没有用翅膀扶着,很多模型实现都有不然车怎么稳定向前走;二是车轮感觉是反方向滚动的;三是左边转弯还是有点别扭。

第三题复合弓射箭 SVG 测试,复合弓和射箭整体还可以。唯一想吐槽的是弓箭竟然像有魔法一样,水平射出后嗖一下就开始抬升变成抛物线运动。慢镜头可以看到拉满弓放手时,弓箭没有跟着弦一起出去。

第四题实现精美浏览器操作系统,界面还挺 macOS 风格的,右上方弹窗功能没问题,Dock 栏应用也没问题。太空射击游戏看着按钮感觉只实现了左右移动,确实如此只能左右移动,但 3D 感觉是出来了,如果能支持上下移动就完美了。

第五题 3D 赛车游戏测试,功能没什么问题,但这车就是几个方块搭起来的……等等,难道是马斯克最新的 Cybercab?算我个土包子孤陋寡闻了,失礼失礼。

第六题无第三方库实现高颜值 Trello 看板,UI 呈现还挺清新的,和之前测评过的国内模型的布局都很大不一样,还不错。功能没看到有什么问题。但有个要吐槽的是用中文叫它做的项目,做出来却是英文界面,这个要扣点分。

这次测评就先到这,大家看完后觉得这个模型怎么样呢?