说实话,因为工作中要经常整理庞大数据和文档,AI我算折腾得比较多的那种人。
Claude
Code源码泄露的新闻出来那会儿,朋友圈里炸了一天。有人说这是"有史以来最棒的生日礼物",有人说Anthropic丢人现眼,有人就在那截图找彩蛋——那个有18种虚拟宠物的Buddy系统,鸭子、龙、卡皮巴拉,宠物有稀有度和五维属性,开发者还故意用字符混淆把它藏起来,怕内部防泄露扫描器发现他们在摸鱼。
我看完,没觉得信任危机,反而更确认了——这家公司,和我想象的差不多。
但让我印象最深的,不是宠物彩蛋,是代码结构本身。
懂工程的人看完普遍的评价是:这是典型的生产级AI
agent设计,结构非常成熟。主流程分成REPL启动、QueryEngine、工具注册、权限系统、任务系统,每个环节独立模块,层层制约,不是一条线跑到底就交差。说白了,每个环节都有人"盯着",糊弄不过去。
这让我想起我之前对比不同AI做复杂任务的感受。
ChatGPT和Gemini有一个很固定的规律,前三分之一,聪明得让你眼前一亮,思路清晰,措辞也漂亮;到中间,明显开始省力;到后半段,那东西出来简直像在应付作业,给你一个框架,里面空心的,内容几乎没有了。
每次遇到这种情况,我都在想:这不就是那种有小聪明但会糊弄人的员工嘛。面试的时候能说,做起来看着差不多,但你真把一件复杂的事交给他,他能省的全省,差不多得了。
Claude不一样。给它一个复杂任务,干到最后还是那个劲,不缩水,不跑偏,最后一段和第一段一样认真。现在看了源码,我多少明白了点为什么——模块化的任务系统,每一步都有约束,架构上就不太容易"跑偏了没人知道"。
泄露的代码里还有个叫KAIROS的功能模块,目前还藏在feature
flag后面没开放,设计是让Agent具备后台运行能力,其中有个操作在注释里被写作"dream"——在空闲时做记忆整理和压缩。
一个给AI的空闲时间起名叫"做梦"的工程师,大概率不是那种对产品质量无所谓的人。
还有一个细节:遥测系统里,专门追踪用户是否在终端对Claude骂人、连续输入"continue"的频率。采集这个数据的目的,是量化开发者的挫败感。
一个公司如果不在乎用户被糊弄了的感受,不会去追踪这个。
用AI越多,我越信一件事:靠谱的产品,底层一定有一套不允许它偷懒的机制。Claude在我这边,就是那个每个节点都有人盯着的系统。