楼主:
themlb09 (themlb09)
2026-08-18 16:21:48[爆卦] 媒体报完大家就忘?最近各大AI集体暴强的“恐怖真相”
这阵子有在关注 AI 发展的人,应该都有一种强烈的体感:
最近这两三个月(2026年6月到8月),各大厂的 AI 产品更新换代速度简直疯了。
马斯克的 Grok 4.6 搭配 Grok Build CLI 工具,自动除错稳到不可思议;Google 的低
端模型 Gemini Flash 3.7 在终端工具的反应速度与多任务调度大幅进化;更不用说open
ai调出来的 Codex Sol 5.6。
特别是“通义千问”和“DeepSeek(深度求索)”最近发布的新版本,在 Coding 推理能
力上简直是恐怖的跃进。以前千问写大型专案很容易在多步骤执行时掉链子,现在却能极
其流畅地在多个档案之间来回修改;而 DeepSeek 更是把复杂代码的除错成本压到极低,
甚至学会了类似资深工程师的“防错主动思考”。
很多人以为这是各大厂“算力突破”或“模型权重微调”的结果。但各大科技媒体除了在
3、4 月稍微提了一下之后,现在几乎集体失声、只字不提。
大家都忘了今年 3 月底 Anthropic 那场历史级的“Claude Code 51万行原始码外泄事件
”!
当时大众媒体都把它当成一个“内部人为疏失的低级笑话”来看(工程师发布 npm 忘记
设定 .npmignore 导致整个除错 map 裸奔)。新闻热度过了两三天,大家就通通忘光了
。
但大众健忘,科技巨头可不傻!对于业内各大 AI 实验室的架构师来说,那高达 59.8MB
、未经混淆的 TypeScript 原始码,根本是上帝送来的“AI Agent 终极教科书”。大厂
研发团队如获至宝,秘密消化了两三个月,才有了最近 7、8 月各家模型的集体大爆发。
近期(7月中旬到8月中旬)很多硬核的专业技术研究,就直接戳破了这个不能说的秘密:
1. 近期研究直接实证(xAI 篇)
科技分析平台 Composio 在 7 月中旬发表了对 Grok Build 的 50 小时硬核实测分析。
报告直接指出,Grok 4.6 最近之所以能从一个聊天框,迅速迭代出具备“8个并发子智能
体、隔离 Git 工作区”的顶级终端工具,就是因为 xAI 团队直接拿走了 Claude Code
外泄架构中关于环境隔离与并发调度的硬逻辑。其最强的 /goal 任务模式,底层的双模
型管线(Planner & Executor)调度逻辑,跟当初外泄的 Claude 状态机蓝图惊人地如出
一辙。
2. 千问与 DeepSeek 的技术大进补(开源篇)
前几天(8月17日)SSRN 顶级学术论文库刚更新的技术调查论文《The Claude Code Leak
: A Complete Technical & Security Investigation》就揭露了更深的内幕。
报告指出,外泄代码中完整曝光了 Anthropic 如何利用知识图谱(如开源的 Cognee 架
构)来帮 AI 建立“持久性长期记忆”。这直接引领了最近这两个月,千问和 DeepSeek
研发团队的集体大转向。以前开源推理模型“智商高但手脚残”,看了考卷后,千问和 D
eepSeek 直接学会了 Claude Code 外壳(Harness)中的“文件分片处理”与“Bash 指
令安全过滤”。这也是为什么最近这两家模型在处理长文本、多文件、且“不忘记前后脉
络”的自主除错能力上,突然变得跟以前完全不是同一个级别。
简单来说,媒体在 3、4 月报完就去追别的八卦了,留下一群以为事情过去的吃瓜群众。
但实际上,全球顶级大厂与开源圈的架构师们,过去这三个月全部都在闭关、逐行逆向工
程那 51 万行程式码。他们把 Anthropic 耗资数百万美元试错出来的“法拉利变速箱设
计图(Agent 状态机与引导提示词)”吃透后,在最近的 7、8 月集体套进了自己的 Gro
k 4.6、Gemini Flash 3.7、千问和 DeepSeek 里面!
这根本不是什么技术奇点到了,这是一场科技巨头趁著媒体和公众遗忘时,集体分食 Ant
hropic 机密、集体大进补的黑幕。
大家最近用各家新版 AI Agent,有没有也觉得写程式跟自动除错的“稳定度”突然强到
很夸张?有业内大佬要出来现身说法,聊聊你们团队当初有没有下载那份 59.8MB 的天书
吗?