【LLM 日報】2026 年 07 月 03 日 — 砸了 $1,450 億然後說「慢了」:Zuckerberg 的內部坦白,和一群開始幫 AI 寫工具的 AI
經過兩天 Anthropic 的產品海嘯,今天的 LLM 新聞圈終於從「新模型發布」轉向兩個更安靜但更重要的方向:一個科技巨頭 CEO 在內部承認 AI agent 不如預期,以及一群開發者開始認真思考「怎麼讓 AI agent 有記憶」——不是訓練資料的記憶,是工作過程的記憶。
🔥 Zuckerberg:AI agent 開發不如預期,不是技術問題,是組織問題
Meta CEO Mark Zuckerberg 在 7 月 2 日的內部全員會議上,罕見地對 AI agent 進度給出了負面評估。原話是:「過去至少四個月的 agentic 開發軌跡,並沒有如我們預期地加速。」他補充說:「對新組織結構的賭注,還沒有開花結果。」
這場全員會議的時間點值得注意。Zuckerberg 回顧了年初的決策脈絡:一月到二月,高層擔心「動作不夠快」;當時他們對 Claude Code 等工具「超級樂觀」。五月,Meta 裁員約 10%(數千人),同時把約 7,000 人從新分配到 AI 團隊。六月十二日,一份內部備忘錄承認了重組中的「錯誤」,直言過程「不如原本期望那麼乾淨」。
Meta 今年規劃的 AI 基礎設施支出高達 $1,450 億美元,整個科技巨頭產業合計超過 $7,000 億。Zuckerberg 在會議上承諾「三到六個月內」會看到更顯著的回報——這個時間表他已經在不同場合說過好幾次了。
資本市場的反應冷冷的。股市沒有明顯波動,投資人似乎已經把 Zuck 的樂觀時間表自動打折。CTO Andrew Bosworth 在會議中也談到一場滑鼠追蹤軟體的資料安全事件,內部審查顯示沒有員工資料被用於 AI 訓練。Reuters 向 Meta 發言人請求評論,對方拒絕回應。
llm-coding-agent 0.1a0:Simon Willison 自己寫了一個 Claude Code 風格的 agent
Simon Willison 發布了 llm-coding-agent 的首個 alpha 版本——一個基於他自家 LLM 函式庫的 coding agent,風格參考 Claude Code。有趣的是開發過程本身:他用 Claude Code for web 搭配 Fable 5,先讓 AI 寫 spec,再用 red/green TDD 逐個 commit 實作。
這個 agent 提供六個工具:edit_file、execute_command、list_files、read_file、search_files、write_file——就是一個最小可行 coding agent 的標準工具箱。可以用 uvx --prerelease=allow --with llm-coding-agent llm code 直接跑,支援 --yolo 模式(跳過所有確認提示)和 --allow 選擇性放行特定指令模式。
Simon 用 llm code --yolo 測試讓 GPT-5.5 實作一個 ASCII 時鐘 CLI——模型自己判斷 SwiftUI 不適合純 CLI、改用 Swift 寫了一個終端機時鐘,跑起來長這樣:
█ █████ ████ █ █ ███
██ █ █ █ ██ █ ██ █ █
█ ████ ███ █ █ █
█ █ █ █ █ █ █ █
███ ████ ████ ███ ███ █████
從 spec 到 TDD 到完成,整條開發鏈都是 AI 跑的。Simon 的角色是下第一行指令和最後驗收。
Simon Willison 用 DSPy 讓 Fable 5 幫 Datasette Agent 改 prompt——然後 Fable 選了 GPT
Simon 聽完 AIE 大會的 DSPy 演講後,用 Claude Fable 5 跑了一個實驗:讓 Fable 5 指揮 DSPy 框架,去優化 Datasette Agent 的 SQL 系統 prompt。指令只有一句:「pip install 最新版、用 dspy 評估並改進系統提示」。
Fable 5 做了一個務實的選擇:測試模型用 GPT 4.1 mini 和 nano,不選 Claude。原因跟工程師選工具一樣——這任務不需要最強模型,便宜的夠了。
DSPy 跑完後發現了一個經典的人機盲點:Datasette Agent 的 schema 列表只給 table name、不給 column name,同時 prompt 說「如果你已經有資訊,不要重複呼叫 describe_table」。結果 agent 不查 column、改用猜的——page_count、o.order_id、first_name——猜錯就報錯、報錯就重試、重試再猜錯,陷入無限迴圈。人類看到 schema 只有 table name 會自然去查 column,但 LLM 聽話:prompt 說不要查,它就真的不查。
Fable 的修正建議很簡單:要嘛在 schema 列表附上 column name,要嘛把「不要再查」那條規則改軟一點。