豆包2.1 Pro测评报告!真的能打吗?
豆包刚出的 doubao-seed-2.1-pro 测评报告来了。这次测评依然在 Pi 上接入来做,上下文、Max tokens 和思考模式全都开到最大。 第一题是强约束指令遵循句子生成测试。句子确实都从 1 到 10 结尾,乍看没什么问题——但不仔细看差点被它糊弄过去:只看尾部几个字的话所有句子都挺顺,可读完整句就会发现,第 5、7、9 句都是不通顺的,挺狡猾。 第二题鹈鹕土星环骑自行车 SVG 测试,前几天测了好几个国内顶尖大模型都做不好,结果豆包更离谱——鹈鹕和自行车直接不见了。 第三题复合弓射箭 SVG 测试,真抠细节的话问题不少:头断了,轮子也不是复合弓的轮子,反而像个闹钟。不过毕竟是 SVG,可能不用太强求。这里比较严重的问题是弓弦只有一根,而复合弓和一般弓箭不同,不会只有一根弦。 第四题浏览器内操作系统,UI 看上去还可以,但右上角的弹窗点下去却跑到左上角去了;Dock 栏的计算器不工作,点几次等于号都没算出结果;压轴的太空射击游戏其他都还好,就是没法移动——按下左右键一放手,飞机立刻回弹到原来的位置,根本没法好好控制。 第五题 3D 赛车游戏,画面太模糊,根...
千问办公实战(26),一键生成专业图表!数据可视化神器!
做数据展示时,手动绘制专业图表费时费力。千问办公内置的 EChart 技能,可以让你用自然语言一句话生成折线图、饼图、柱状图等多种专业图表。 操作方法很简单:点击左侧技能菜单,找到 EChart 技能并安装。EChart 是前端开发者熟悉的专业图表库,千问办公的这项 skill 背后调用的正是该库的能力。安装完成后,新建任务,通过斜杠命令唤起技能,直接输入提示词描述你想要的图表即可。 以折线图为例,只需告诉它你要展示的数据维度和标题,几秒钟内就能生成一张带样式主题的专业图表。适合需要经常做数据汇报、做 PPT 写文档的朋友收藏使用。 访问入口
AI智能体开发(第一集)!初识LangChain!
大语言模型能输出文本,但本身无法调用命令行或外部工具。要让模型按需求执行实际操作,需要在语言模型基础上加一层 Harness——结合模型的推理能力与工具调用能力,这就是我们常说的 Agent。 做 Agent 开发可以从零调用 LLM API 写起,但这就跟不用任何 Web 框架、从纯 HTML/JS 写 Web 应用一样:能做,只是麻烦。LangChain 就是 Agent 开发领域的”Vue / React”——一个成熟、易用的第三方框架,能让开发效率大幅提升。本系列所有示例均使用 Node.js,适合有编码经验的朋友直接上手。 本集从 LangChain 版 Hello World 入手。代码逻辑很简单:向大语言模型提问”1+2等于几”,把返回结果打印出来。 运行前需在项目根目录放置 .env 文件,配置大语言模型的访问入口和 API Key。当前使用 DeepSeek,提供 OpenAI 风格和 Anthropic 风格两种接入方式——这是目前行业两家主流标准,所以其他模型基本都会兼容这两种格式,方便用户迁移。 LangChain 通过 Chat...
Ghidra,可执行程序秒变源码!开源免费逆向神器!
你信不信,世界上最强的逆向工程工具之一,是白送的。它叫 Ghidra,美国安全局 NSA 出品,原本是他们内部分析恶意软件、挖漏洞的主力工具,后来整个往 GitHub 上一扔,安全圈直接炸了——现在已经 7 万多颗星。 用法一句话就能说完:丢一个二进制文件给它。比如一个疑似病毒的可执行程序,直接丢进去,它会自动反汇编加反编译,把机器码一行行变成能读懂的 C 代码。里面有哪些函数、调用了谁、偷偷往哪些进程里注入、启动的时候干了什么,调用关系图全给你画出来;哪里可疑,点过去就能看那段代码。 没有源码的程序、设备固件,它都是这么处理的,几百种处理器架构和文件格式通吃,Windows、Mac、Linux 随便跑。 玩恶意软件分析、漏洞研究、固件逆向的兄弟,建议先装到机器上,丢个平时看不透的小程序进去,看看它里面究竟在搞什么鬼。 访问入口
GeoLibre,免费开源地图工作台,一键编辑 3D 地图!
玩 GIS 的兄弟要注意了。opengeos 刚开源没多久的 GeoLibre 项目,能把又大又重、还得花钱买授权的 GIS 制图软件,变成打开网页就能用的地图工具,目前在 GitHub 上已经有 7000 多颗星。电脑、手机、浏览器、笔记本里全都能跑,而且打开的都是同一份工程文件。 用法很简单:把数据文件往窗口里一拖,不用装环境,不用配服务器,就能画地图、上颜色、算面积。它自带 1000 多个分析工具,全部在浏览器里跑完——想算一座山的坡向和光照,想看一场雨在哪个角落先积成水,想把某个区域的建筑轮廓对齐整齐,都可以点个按钮就出结果。你的数据一直留在自己电脑上,不上传给任何人。 更有意思的是,拉一下时间滑块,曼哈顿的房子能从 1850 年开始按年份一栋栋长出来。底图还不止地球,月球、火星、冥王星都能选,量距离、算面积也会自动换成那颗星球的参数。 代码是 MIT 协议,允许按协议商用。做测绘、国土规划和地图开发的兄弟,可以先打开网页版,把手头最乱的那份数据拖进去看一眼。 访问入口
VoiceStudio!本地声音克隆神器!ElevenLabs平替!
用你自己的电脑就能轻松做语音克隆,哪里还用得上付费的 ElevenLabs。VoiceStudio 是一个海外开发者做的开源项目,干的事就是把 ElevenLabs 那一套语音能力搬回你自己的电脑上跑,目前在 GitHub 上已经快 3 万颗星了。 它不用注册账号,也不用 API key:装好软件、让它把模型拉下来,录 3 秒你本人的声音当样本,敲一段文字就能出同音色的成品。Mac、Windows、Linux 和 Docker 都能跑,N 卡、苹果芯、纯 CPU 也都认。 做内容的可以把 PDF 这类书稿导进去,分好角色和章节,就能出带时间轴的有声书;也能把一条外语视频直接配成中文——它会先把人声扒出来,翻译完还会把不同说话人分开,并对上原来的音色。 另外它还起了个 OpenAI 兼容接口和 MCP,本地起一个服务就能让别的应用来调。做配音、有声书、语音助手的兄弟可以先收藏起来,拿自己 10 秒录音试一次克隆,比看我在这尬聊直观多了。 访问入口
Minimind,自己动手实现 LLM,2 小时训练一个大模型!
先看成果:一个只花了三块钱训练出来的大语言模型,聊起来还可以。如果你想真正弄懂大语言模型的工作原理,或者想知道一个大模型到底是怎么训练出来的,这个叫 MiniMind 的开源项目必须要收藏——花 3 块钱租一张 3090,两个小时就能从零开始训练出属于你自己的大语言模型。 这个项目目前在 GitHub 上已经涨到 6.1 万颗星、近 8000 个 fork。训出来的模型只有 6400 万参数,体积大概是 GPT-3 的两千七百分之一,普通个人显卡就能跑得动训练。整个流程也很简单:把仓库克隆下来,装好依赖,下载它开源的数据集,跑一条预训练命令,再补一条微调命令,就能得到一个小巧但会中文聊天的模型。之后还能直接用 Ollama 拉起来跑,或者通过 OpenAI 兼容接口接到 OpenWebUI 里。 真正少见的是,作者把 MoE、LoRA、DPO 强化学习、蒸馏、工具调用这一整条链路的核心算法,全用原生 PyTorch 手写了一遍,没有藏在第三方封装后面,你跟着练的同时每一行都能看懂。项目甚至还延伸出了视觉和多模态的孪生项目。 想认真搞懂大模型这个黑盒的人,不妨先拿家里那张显卡...
Hy4 Preview 鹈鹕骑自行车SVG测评报告!
本期视频继续我们新 Benchmark V2.2 中的鹈鹕土星环骑自行车和复合弓射箭 SVG 测试。上一集测了千问 3.8 Max 0902,这一集应粉丝要求先测腾讯混元 Hy4 Preview。 第二题:鹈鹕土星环骑自行车 SVG 测试 我们看一下效果,发现三个比较明显的问题: 第一个问题是自行车骑到左侧或右侧时不会转弯,而是在快要出跑道时才闪现回正确方向。第二个问题在于鹈鹕的屁股没有坐在坐垫上,且坐垫上面有一块铁状凸出物——这大概就是鹈鹕不敢坐上去的原因。第三个问题需要细看:鹈鹕的两条腿都画在了同一侧,这是因为自行车横杠是青色的,但右腿本应被横杠挡住的部分却没有被遮挡。 第三题:复合弓射箭 SVG 测试 弓箭明显还是反的。原因是仔细观察可以发现,手上方的瞄具应该在面向人的这一侧,但当前方向完全相反。好在下面的平衡杆方向倒是正确的。 其余测试内容大家如果感兴趣,可以去博客上看 V2.1 版本的完整评测。由于 V2.2 只改动了以上两个测试题目,其他项目保持不变,这里就不再重复测了。 访问入口
Lingbot-map!手机拍视频秒变 3D!开源三维建图神器!
灵波团队的这个开源项目,能把随手拍的一段视频变成一个可以转着看、还能逛进去看的 3D 场景,目前在 GitHub 上已经有 17K 多颗星。用法很简单:拿手机围着展厅、街区或者工地拍一圈,把视频丢进去,就能看着它一边播视频、一边把现场一点点搭成 3D 的。车载记录仪拍的路面、旅游时拍的街景、在楼里走十几分钟录的长视频,都能直接喂给它。 它还会自动把天空去掉,出来的模型干净很多;跑起来也快,每秒能处理二三十帧,几万帧的超长视频照样啃得下来。 模型可以免费下载,网上已经有人用普通游戏本把它跑通了;代码开源,按协议可以商用。做测绘、自动驾驶、机器人的朋友尤其值得关注。 项目自带有三个示例场景,可以先下载下来跑一遍看看效果,再决定是否要自己部署玩一下。 访问入口
Qwen 3.8 Max 鹈鹕骑自行车SVG测评报告!
本期继续跑 Benchmark 里的两道 SVG 测试题——「鹈鹕土星环骑自行车」和「复合弓射箭」。上一集测的是 GLM 5.3 Flash,这一集轮到千问 3.8 Max 0902 上场。 第二题「鹈鹕土星环骑自行车 SVG 测试」,先看效果。鹈鹕和自行车的结构没有问题,但骑到右边之后,鹈鹕和自行车整个倒了过来。这一点和 GLM 5.3 Flash 刚好相反:GLM 是在上方跑道正常,一来到下面跑道就倒过来。 第三题「复合弓射箭 SVG 测试」同样有几个问题。第一,弓箭明显是反的;第二,人物的右手去拉弓的时候,是穿过了持弓的左手的,属于明显的穿帮。 其他题目这次就不重测了,分数继续沿用 Benchmark V2.1 的测评结果,只有第二、第三题换成本次的新得分。大家翻 Benchmark 数据的时候请注意这一点,我也会在页面上标注出来。 访问入口









