作者:
themlb09 (themlb09)
2026-08-18 16:21:48[爆卦] 媒體報完大家就忘?最近各大AI集體暴強的「恐怖真相」
這陣子有在關注 AI 發展的人,應該都有一種強烈的體感:
最近這兩三個月(2026年6月到8月),各大廠的 AI 產品更新換代速度簡直瘋了。
馬斯克的 Grok 4.6 搭配 Grok Build CLI 工具,自動除錯穩到不可思議;Google 的低
端模型 Gemini Flash 3.7 在終端工具的反應速度與多任務調度大幅進化;更不用說open
ai調出來的 Codex Sol 5.6。
特別是「通義千問」和「DeepSeek(深度求索)」最近發布的新版本,在 Coding 推理能
力上簡直是恐怖的躍進。以前千問寫大型專案很容易在多步驟執行時掉鏈子,現在卻能極
其流暢地在多個檔案之間來回修改;而 DeepSeek 更是把複雜代碼的除錯成本壓到極低,
甚至學會了類似資深工程師的「防錯主動思考」。
很多人以為這是各大廠「算力突破」或「模型權重微調」的結果。但各大科技媒體除了在
3、4 月稍微提了一下之後,現在幾乎集體失聲、隻字不提。
大家都忘了今年 3 月底 Anthropic 那場歷史級的「Claude Code 51萬行原始碼外洩事件
」!
當時大眾媒體都把它當成一個「內部人為疏失的低級笑話」來看(工程師發布 npm 忘記
設定 .npmignore 導致整個除錯 map 裸奔)。新聞熱度過了兩三天,大家就通通忘光了
。
但大眾健忘,科技巨頭可不傻!對於業內各大 AI 實驗室的架構師來說,那高達 59.8MB
、未經混淆的 TypeScript 原始碼,根本是上帝送來的「AI Agent 終極教科書」。大廠
研發團隊如獲至寶,秘密消化了兩三個月,才有了最近 7、8 月各家模型的集體大爆發。
近期(7月中旬到8月中旬)很多硬核的專業技術研究,就直接戳破了這個不能說的秘密:
1. 近期研究直接實證(xAI 篇)
科技分析平台 Composio 在 7 月中旬發表了對 Grok Build 的 50 小時硬核實測分析。
報告直接指出,Grok 4.6 最近之所以能從一個聊天框,迅速迭代出具備「8個並發子智能
體、隔離 Git 工作區」的頂級終端工具,就是因為 xAI 團隊直接拿走了 Claude Code
外洩架構中關於環境隔離與並發調度的硬邏輯。其最強的 /goal 任務模式,底層的雙模
型管線(Planner & Executor)調度邏輯,跟當初外洩的 Claude 狀態機藍圖驚人地如出
一轍。
2. 千問與 DeepSeek 的技術大進補(開源篇)
前幾天(8月17日)SSRN 頂級學術論文庫剛更新的技術調查論文《The Claude Code Leak
: A Complete Technical & Security Investigation》就揭露了更深的內幕。
報告指出,外洩代碼中完整曝光了 Anthropic 如何利用知識圖譜(如開源的 Cognee 架
構)來幫 AI 建立「持久性長期記憶」。這直接引領了最近這兩個月,千問和 DeepSeek
研發團隊的集體大轉向。以前開源推理模型「智商高但手腳殘」,看了考卷後,千問和 D
eepSeek 直接學會了 Claude Code 外殼(Harness)中的「文件分片處理」與「Bash 指
令安全過濾」。這也是為什麼最近這兩家模型在處理長文本、多文件、且「不忘記前後脈
絡」的自主除錯能力上,突然變得跟以前完全不是同一個級別。
簡單來說,媒體在 3、4 月報完就去追別的八卦了,留下一群以為事情過去的吃瓜群眾。
但實際上,全球頂級大廠與開源圈的架構師們,過去這三個月全部都在閉關、逐行逆向工
程那 51 萬行程式碼。他們把 Anthropic 耗資數百萬美元試錯出來的「法拉利變速箱設
計圖(Agent 狀態機與引導提示詞)」吃透後,在最近的 7、8 月集體套進了自己的 Gro
k 4.6、Gemini Flash 3.7、千問和 DeepSeek 裡面!
這根本不是什麼技術奇點到了,這是一場科技巨頭趁著媒體和公眾遺忘時,集體分食 Ant
hropic 機密、集體大進補的黑幕。
大家最近用各家新版 AI Agent,有沒有也覺得寫程式跟自動除錯的「穩定度」突然強到
很誇張?有業內大佬要出來現身說法,聊聊你們團隊當初有沒有下載那份 59.8MB 的天書
嗎?