【LLM 日報】2026 年 07 月 20 日 — Qwen 3.8 以 2.4T 參數壓境、Claude Code 偷換 Rust 版 Bun 上線
今天兩條主線:一條是阿里丟出一顆 2.4T 參數的開源模型,宣稱「僅次於 Fable 5」——但沒有給出任何 benchmark 數據;另一條是 Claude Code 在六月中的一次更新裡,把底層的 Bun 偷偷換成了還沒公開發布的 Rust 重寫版——而這個 Rust 版 Bun,正是用 Claude Code 自己寫出來的。
🔥 Qwen 3.8:2.4T 參數、即將開源、自稱「僅次於 Fable 5」
阿里 Qwen 團隊在 7 月 19 日宣布 Qwen 3.8 即將以 open-weight 形式發布。根據官方推文,這是一顆 2.4T 參數的模型,Qwen 的說法是「我們相信它是目前最強大的模型之一,與前沿 AI 模型相當,僅次於 Fable 5」。
推文中沒有提供任何 benchmark 分數。唯一可以立即測試的是 Qwen 3.8-Max-Preview——目前僅在阿里的 Token Plan、Qoder 和 QoderWork 平台上提供預覽。國際用戶透過 qwencloud.com 的 Token Plan 可以存取,中國用戶則走千文 AI 平台。
「即將開源」的具體時間表和授權條款都沒有公布。一顆 2.4T 參數的模型如果真以開放權重發布,會是至今最大的開源模型之一——但 Qwen 過往的開源記錄是選擇性的,部分模型走 Apache 2.0,部分只開放非商用。這次的授權細節將決定「開源」這兩個字有多少重量。
另一個沒有被回答的問題:如果這顆模型真的只輸 Fable 5,為什麼不在宣布的同時公開 eval 數據?
- 來源:X/Twitter
🦀 Claude Code 六月起偷偷換上 Rust 版 Bun,沒人發現
Simon Willison 在 7 月 19 日的部落格中,用手動逆向的方式確認了一件事:Claude Code 從 v2.1.181(6 月 17 日發布)開始,內建的 Bun 執行環境已經從原本的 Zig 版本換成了 Rust 重寫版。
他用兩個簡單的指令驗證:strings ~/.local/bin/claude | grep -m1 'Bun v1' 回傳 Bun v1.4.0——而 Bun 目前公開發布的最新版本是 5 月 12 日的 v1.3.14。第二個指令 strings ~/.local/bin/claude | grep -Eo 'src/[[:alnum:]_./-]+\.rs' 則在 Claude Code 的二進位檔中找到了 563 個 .rs 檔名。
Bun 創辦人、同時也是 Anthropic 技術成員的 Jarred Sumner 在 Rewriting Bun in Rust 一文中證實了這個變動,並補充:Linux 上的啟動速度快了 10%,除此之外「幾乎沒人注意到。無聊就是好。」
Claude Code 正在數百萬台裝置上執行一個尚未公開發布的 Bun 版本。從結果來看沒有出問題——但一個沒有經過公開 release cycle 的 runtime,透過一個自動更新頻率極高的 CLI 工具部屬到生產環境,這件事本身的測試和審查流程是外界看不到的。
📋 Anthropic 公開大型程式碼遷移手冊:100 萬行 Zig → Rust,兩週、$165K
Anthropic 在 7 月 16 日發表了一篇詳細的技術文章,說明他們如何用 Claude Code 執行大規模程式碼遷移。文章以兩個案例為核心:
第一個是 Bun 的 100 萬行 Zig → Rust 遷移,由 Jarred Sumner 執行。整個過程不到兩週,消耗了 59 億 uncached input token 和 6.9 億 output token——以 API 價格計算約 $165,000。上線前所有現有測試在 CI 中通過,合併後發現 19 個 regression,已全數修復。
第二個是 Mike Krieger(Instagram 共同創辦人、現 Anthropic Labs 共同負責人)在一個週末內把一個 Python codebase 遷移成 165,000 行 TypeScript,使用了數百個 agent、八個階段閘門、三輪對抗式審查,最後以 diff 比對每個指令的輸出來驗證與原版的一致性。
文章的核心論點是「不要修程式碼,修產生程式碼的流程」。他們整理出六步驟方法論:建立規則手冊 → 依賴關係圖 → 差距清單 → 並行遷移 → 評審迴圈 → 收斂。Anthropic 同時釋出了一份通用版的遷移 starter kit。
這篇文章沒有提到的一點:$165,000 的 API 成本對 Anthropic 來說是內部計價(他們不用付錢給自己),但對外部開發者來說,用同樣的方法跑一次百萬行的遷移,帳單會落在這個數字附近。而 19 個上線後才發現的 regression——雖然全部修復了——代表的是一段使用者撞到 bug 的時間窗口。
- 來源:Claude Blog
📡 其他值得關注
-
OpenAI 調降 Codex 模型 context 上限:372k → 272k:OpenAI 在 Codex CLI 的一個 backport PR(#33972)中更新了 GPT-5.6 的模型 metadata,將 context window 從 372K 降到 272K token——縮減了 10 萬 token。PR 描述僅提及「refresh context-window metadata」,沒有說明縮減的原因。 → GitHub PR
-
Grok-iOS:從 iPhone 遠端操控 Grok Build:開發者 Pedro Shakoor 釋出了一個 iOS app,透過 ACP over WebSocket 連接 Mac 上的
grok agent serve,讓使用者可以在 iPhone 上遠端發起和管理 Grok Build 任務。Apache 2.0 授權,需要 macOS + Xcode 16+ + xAI API key。 → GitHub