GLM 5.3 测试报告!究竟有多能打?
发表于|更新于|大语言模型
GLM 5.3 测试报告,本此在 Claude Code 完成测试,推理设置 high、编程拉满 max 思考深度;强约束指令测试第五句不符合结尾规则,其余语句通顺,24 点、密码锁推理全部作答正确;编程任务浏览器操作系统、太空射击游戏完成度优秀,3D 赛车画面精致但按键左右反转,Trello 看板功能仅好拖动动画质感一般,整体无严重 bug,综合表现属于上乘水准……
相关推荐

2026-09-18
GLM 5.3 FlashX测评报告!究竟有多能打?
智谱最新发布的 GLM 5.3 FlashX 测评报告来了,还是在 PI 中接入、思考深度放大最高。来看看这个高速版本实际表现如何。 第一题:强约束指令遵循——句子生成测试。 生成速度相当快,有点 DeepSeek V4 Flash 的味道,起码比 GLM 5.3 Flash 快多了。仔细检查生成的句子,第四、六、七、八、十句为了凑成数字结尾都硬生生去掉了单位,读起来不太通顺。 第二题:鹈鹕土星环骑自行车 SVG 测试。 效果不错,虽然这几期提示词难度调低了,但 GLM 5.3 FlashX 依然是第一个实现得比较完整的模型,值得肯定。 第三题:复合弓射箭 SVG 测试。 如果不吹毛求疵的话,还算是可以的了。非要挑毛病的话也有不少:箭是被弓箭手推出去的而不是射出去的,弓弦应该在复合弓左边,但弓箭手却用右手拉弓,存在方向矛盾。 第四题:精美浏览器操作系统。 UI 看上去不错,右上角弹窗、dock 栏应用功能都没有问题,太空射击游戏则是这题的压轴大戏——可惜效果不大行,飞机和子弹离得太远,不移动的话根本看不出子弹是从自己飞机发射出去的,子弹大、飞机小,如果游戏能实现得更好这题应...
2025-10-09
GLM 4.6 测评报告!国产Claude 4.5?
昨天的视频分享了对Claude 4.5的测评,今天打算测下也是刚出来的智普的GLM 4.6。废话不多说,赶紧开干。我们来到网页客户端。这次主要还是测试下我关注的推理和编程。推理的话,我会先关闭深度思考,如果做错了,我再会打开深度思考测一遍。其他情况我都会开深度思考… 访问入口

2026-09-20
topoexport!一键生成3D地图模型!
本期快速分享一个法国开发者做的工具 TopoExport,玩法很简单:在地图上搜索你想要的地方(比如我在珠海,就搜了一下珠海),框选出目标区域,它就会自动提取并生成对应区域的 2D 和 3D 模型素材。 这些素材涵盖建筑、道路、水系、地形起伏等要素,并且支持按图层单独选择,比如建筑、道路、等高线都可以分开导出。格式上兼容 DXF、SVG、OBJ、STL 等多种常见格式,方便导入各类设计软件做后续修改。 唯一不好的地方是它要收费。如果大家知道免费或者开源的平替方案,欢迎告诉我,到时候我再分享一期。 访问入口
2026-04-08
即梦一键CLI化!小龙虾直接用!
即梦一键CLI化是一款值得体验的AI产品,本文带你了解它的主要功能和适用场景。
2026-02-16
Deepseek 重大更新!用API的要注意了!
DeepSeek发布了重大更新,使用其API的开发者需要注意了!本次更新可能涉及:API接口变更、模型版本升级、定价策略调整和功能增加/废弃。本视频详细解读DeepSeek最新更新的内容,如果你是DeepSeek API的用户,这些变化可能会影响你的应用——需要了解具体的迁移步骤、兼容性信息和最佳应对策略,确保你的服务不受影响。 访问入口
2025-07-10
Gemini CLI!正确的打开方式!
竟然还有这么多童鞋以为谷歌大火的Gemini CLI只是个命令行工具,不适合编辑代码!我哪个天!这些哥们平时都不用vscode或者cursor等IDE的吗?我们正确的做法应该是把Gemini CLI作为一个AI编程助手来用,而不是代码编辑了!快速Demo下吧 Gemini CLI访问入口
公告





