从头写ChatGPT!手把手实现教学!
发表于|更新于|大语言模型
兄弟们,手把手教你从头打造自己的ChatGPT!你是不是也好奇,那些像ChatGPT一样聪明的AI,到底是怎么跑起来的?AI大神卡帕西现在有个叫“Nanochat”的项目,直接把你这个好奇心满足了!它玩的就是一个“少即是多”,所有代码都清清楚楚地摆在你面前,让你从头到尾都能看明白AI是怎么炼成的…
相关推荐

2025-03-01
CoD:大模型推理思维链CoT升级版!
大语言模型推理思维链CoT升级版,推理草稿链,Chain of Draft,aka CoD啊!我们试过高级prompting或者用过deepseek r1和Gpt o3都知道,里面用的就是推理思维链。你问他就算一个很简单的问题,它都会做一大堆的思考,速度和tokens的消耗确实令人堪忧!最新一篇海外著名视频会议大厂Zoom论文出来,提出CoD的prompting技术,让大语言模型输出的质量接近CoT,但是速度飞快…
2024-11-29
ChatGPT常见的One-shot,few-shot是什么鬼
One-shot(单样本学习)和Few-shot(少样本学习)是让大语言模型快速适应新任务的关键技术。简单来说,就是在不进行微调(Fine-tuning)的情况下,通过在提示词中提供少量示例来引导模型理解任务。One-shot是给1个示例,Few-shot是给2-5个示例。例如你想让模型用特定格式输出,只需在提示词中给2-3个正确格式的例子,模型就会自动模仿这种格式。本视频通俗讲解这些概念的原理、使用场景和最佳实践。
2025-12-12
Titans:Transformer危险!Titans打破记忆瓶颈
Transformer危险了! 大家看了我今天的《AI早报》没有?头条就是“谷歌发Titans新架构破Transformer长上下文瓶颈”。为什么说它危险?因为它直击了我们现在用的所有AI模型的核心痛点!平时跟ChatGPT、Gemini聊天是不是总觉得它记性不太好?稍微聊长一点就“失忆”,让它读长文就崩溃? 这要怪现在主流的 Transformer 架构。它的核心要求是模型每处理一个新的字,就必须回头把前面所有字 挨个看一遍,并且计算它们之间所有复杂的关系。你可以想象一下,如果文本长度翻了一倍,它需要做的计算量和花的精力,可不是简单地翻倍…
2026-01-06
Claude Code 入门(七)!自定义命令!
上一集我们学习了claude code 的plan mode,这一集学习下自定义命令。我们知道通过斜杠命令可以选择很多预定义的命令,比如我们前面几集已经学过的clear, compact, init等命令。我们现在打算自定义一个命令,执行后就能创建一个按钮… 访问入口

2025-01-07
SmallThinker 3B:可本机运行的推理大模型
阿里推出最小参数推理大模型Qwen SmallThinker,只有3B参数量大小,完全可以在本机上跑啊。不知道大家有没有话200刀每月去用OpenAI的o1模型,我觉得一般的推理,这个确实太昂贵了。要不今天我们来测试下这个SmallThinkier吧…

2026-04-23
Kimi K2.6!是否真的能打?打得过GLM 5.1吗?
Kimi K2.6是月之暗面对标GLM-5.1的最新力作。本视频将Kimi K2.6与GLM-5.1进行全面横向对比测评,测试维度包括:语言理解、代码生成、数学推理、多模态能力和中文专长。通过数十个实际测试案例和基准测试数据,客观分析两个国产顶级模型的优劣势。对于正在选择国产大模型的开发者和企业用户来说,这是一份有价值的参考报告。 访问入口
公告






