Qwen 3.8 27B(FP8) 测评报告!相当的能打!
发表于|更新于|大语言模型
Qwen-3.8-27B FP8 量化版本实测对比,相较于上期 Q4 版本表现更进一步,强约束指令生成全部通顺无重复字符,24 点、密码锁推理题全部答对;浏览器操作系统出现计算器计算错误,太空射击游戏存在小瑕疵,3D 赛车游戏运行正常、按键方向无误,Trello 看板功能完好,综合性能足以胜任日常办公、网页开发等常规编程需求……
相关推荐

2026-06-02
Qwen 3.7 Plus 测试报告!真的能打吗?
本期视频实测阿里巴巴通义千问最新发布的 Qwen 3.7 Plus,国产旗舰开源大模型系列高配版本。本期视频用祖传测试用力测评,看 Qwen 3.7 Plus 究竟能不能打。 访问入口

2026-07-21
Qwen-Audio-3.0-TTS!阿里语音合成新模型登顶榜单!
此前实测千问3.8 Max Preview综合表现十分亮眼,阿里同期上新的Qwen-Audio-3.0-TTS语音合成模型实力同样顶尖,拿下全球语音榜单榜首。传统TTS音色规整生硬,很难还原真实情绪,只能生硬输出笑声文字,这款模型支持细粒度情绪调控,喜怒骂等神态语气都能自然还原,同时完美适配多方言与多种语言合成。模型可在百炼平台调用,代码简介易懂,采用websocket全双工传输,区别于传统单次应答的HTTP接口,支持实时打断对话,交互流畅度大幅提升,适合有语音生成、实时语音交互需求的开发者自行上手体验。 访问入口

2026-07-19
Qwen 3.8 预览版测评报告,打得过Kimi K3吗?
千问 3.8 Max Preview 实测测评,对比此前 Kimi K3 的测评表现如何呢? 统一标准祖传测试用例实测,约束文本生成全对且速度更快,24 点、密码推理答题准确;编程项目生成效率大幅提升,浏览器系统配套太空射击游戏 UI 与功能完整,3D 赛车运行流畅无操控故障,复刻 Trello 看板还原度极高,仅缺少单条待办删除按钮一处小瑕疵。 对比 Kimi K3 存在答题失误、赛车失控、界面 bug 且生成耗时极长等短板,千问新版本综合实力更出众,响应速度优势突出。 关注 AI 产品狙击手,持续更新各类 AI 模型实测干货! 访问入口

2026-08-27
Qwen 3.8 Flash 多模态测评!究竟有多能打?
Qwen 3.8‑Flash 多模态专项测评来了!在上一期测试推理与编程实力之后,本期就用专属祖传测试用例,深度检验它识图、视觉理解的真实水平。 电影截图识别一题翻车、一题答对;空间方位判断、细微倾斜图形辨别表现出色;鸳鸯计数出现误判,将野鸭归类成了雌性鸳鸯。视觉时序测试中,并线时间识别准确,右转时间判断却出现了较大偏差。综合来看,这款 125B 参数的模型图像感知能力可圈可点,但在复杂识别、长视觉时序轴判断上依旧存在短板,感兴趣的小伙伴可以亲自动手实测感受一下…… 访问入口

2026-08-15
Qwen-3.8-27B 测评报告!真的能打吗?
Qwen-3.8-27B 开源模型测评,本次测试使用 Q4_K_S 量化版本,BF16 原版权重留给大家自行部署。指令生成测试全部达标通顺,24 点、密码锁推理作答无误;浏览器操作系统项目启动失败,3D 赛车游戏画面可用但按键左右反转,Trello 看板功能完整。27B 量化后依旧有着不俗实力,非量化版本潜力更高,非常适合个人以及小型企业本地部署使用…… 访问入口

2026-06-07
Qwen3.6 27B 测试报告!真的能打吗?
本期视频实测阿里巴巴通义千问最新发布的 Qwen3.6 27B 大模型,国产旗舰开源系列全新版本。27B 参数规模,主打更强推理与 Agent 能力。本期视频用祖传测试用力测评,看这款阿里旗舰模型究竟能不能打。 访问入口
公告






