文心推理模型X1测评:和DeepSeek有很大差距!
发表于|更新于|编程工具
看来无论是4.5还是x1,文心一言在编程方面都是一样的拉胯。所以总的来说,在我看来文心一言这些模型的能力和deepseek嘴型 v3.1 以及推理模型 r1还是存在比较大的差距…
相关推荐

2024-12-28
DeepSeek V3:打败GPT4O的国产开源大模型
最新开源大语言模型王者出炉啊。国产开源模型DeepSeek v3发布,在各种benchbarks上超越llama3等一众大模型,更在编码领域打败Claude 3.5 sonnect和GPT 4o。循例,我们今天的任务就是快速对这种新模型做一次测评… 访问入口

2025-03-26
DeepSeek V3.1 测评:最强非推理大语言模型!
DeepSeek 推迟最新非推理模型 DeepSeek v3.1升级,大幅度提升数学和编程等能力,今天我们来测评下它的能力去到哪… 访问入口
2025-05-03
文心X1 Turbo测评:与完美之间差个编程!
早上测评了文心最新的4.5 Turbo,表现还不错。承诺大家会再测试下最新推理模型X1 Turbo的,这次我将会用一套升级后的由浅入深的推理模型测试用例来测试下… 访问入口

2025-02-01
O3-Mini:OpenAI推出免费版应对DeepSeek挑战
OpenAI推出O3-Mini硬扛国产DeepSeek的挑战啊!我这段时间分享了不少我们国产之光DeepSeek R1推理大语言模型的视频,以其强大的性能和低廉的API价格直接冲击OpenAI的O系列的地位。OpenAI应该也是迫于这种压力,今天赶紧推出O3-Mini来应战,无论付费用户还是免费用户,都将会逐渐用上O3-Mini,而O3-Mini呢又分为三个版本low,medium和high,并且开始支持上函数调用等各种高级功能… 访问入口
2025-05-03
文心Turbo 4.5测评:效果炸裂!
最近百度文心发布了最新的4.5 Turbo和推理模型x1 turbo,据说performance都有很大提升,这一集准备先测评下通用的4.5 turbo,下一集再测评下x1 turbo。废话不多说,我们赶紧去测评下… 访问入口
2025-04-14
DeepSeek 技巧:设计图转代码!
今天快速跟大家分享个deepseek的使用技巧,利用deepseek强大的编程能力,直接将设计图转成可运行代码… 访问入口
公告





