Qwen3-Max正式支持深度思考!测评报告!
发表于|更新于|大语言模型
大家看了我早上的《AI早报》的话应该知道,千问3 Max终于推出深度思考模式!高难度推理号称达到100%准确率!如此,厉害,赶紧测试下它的推理能力…
相关推荐
2024-11-29
GPT4ALL:本地安装任意大模型
GPT4ALL是由Nomic AI开发的桌面应用,让你可以在自己的电脑上本地运行大语言模型,无需联网、无需付费,并且完全保护隐私。它支持一键下载和运行各种开源大模型(如Llama、Mistral、Falcon等),提供简洁易用的聊天界面,操作简单到只需点几下鼠标就能开始与本地AI对话。GPT4ALL还支持本地知识库(LocalDocs)功能,可以让你用自己的文档来增强AI的回答。无需强大的GPU——即使是普通CPU也能流畅运行经过优化的量化模型,是个人隐私保护场景下使用AI的最佳选择。 访问入口
2025-05-10
UI-Gen-T27B:一个专注UI开发的大模型炸裂登场!
一个专注于开发UI的开源大语言模型炸裂登场啊! 今天快速跟大家分享这个只有7B参数的UI-Gen-T27B, 它是个基于阿里的Qwen2.5 Coder,和其他大语言模型不同,它是专门用5万个多样化UI案例通过loRA微调出来的模型,能生成更专业的UI,只需要16G显存就能本地跑 Demo访问入口

2024-12-07
Grok:马斯克大语言模型免费用
兄弟们,马斯克x ai 的grok免费用啊!再也不用充会员了!听到这个消息后我当然第一时间去推特,哦不是,早改名了,去x上试下,我自己是没有充Premium的 点开这个Grok,随便问几个我做大语言模型评测的问题,strawberry有多少个r,回答两个;9.11和9.8谁大,可惜,答案都错了,所以这水平感觉有点水啊 还是试下它的文生图功能的,接入的是顶尖的Flux 1.1,随便生成几张图吧, 大家看下,效果还可以吧。 大家想尝鲜的可以去玩下,但是不要抱太高的希望,文字回答我感觉就是1年前的chatgpt 3.5的水平,文生图倒是值得关注。 访问入口

2025-04-08
文心推理模型X1测评:和DeepSeek有很大差距!
看来无论是4.5还是x1,文心一言在编程方面都是一样的拉胯。所以总的来说,在我看来文心一言这些模型的能力和deepseek嘴型 v3.1 以及推理模型 r1还是存在比较大的差距… 访问入口
2025-08-12
GPT-5测评报告!推理编程能力爆表!
上两个视频分享了OpenAI刚推出的GPT-5都有哪些亮点,除了统一访问自动判断应该调用哪个模型,最令我振奋的是推理和编程能力的提升,看swe-bench的话得分74.9%,已经超过了昨天跟大家分享的claude最新的opus 4.1的74.5%了。同时应反诈牢陈的请求,准备测评下。废话不多说,直接开干 访问入口
2026-01-06
Claude Code 入门(二)!正确打开方式!
上一集我们学习了claude code的安装以及怎么切换到国内模型,这一集开始,准备说下我claude code究竟应该怎么用?很多人认为claude code是个命令行工具,代码编辑也太麻烦了!用它不是编程领域的退步吗?事实上,我们可以…
公告






