【LLM 日報】2026 年 07 月 01 日 — Anthropic 的三響炮:新模型、新產品、出口管制解除同一天到位
今天 Anthropic 一口氣端出三道菜:Sonnet 5 新模型、Claude Science 科學工作台、Fable 5 / Mythos 5 出口管制正式解除。三件事各自獨立,但放在同一天——你很難不注意到這是一場精心編排的展示。同一天,Google 發表了 TabFM 開源表格模型,ZLUDA 開發者宣布失去商業資金、回到週末 side project 模式。一條線在往上堆,一條線在往下掉。
🔥 Claude Sonnet 5 發布:接近 Opus 4.8 的性能,但 tokenizer 藏了一手 30% 漲價
Anthropic 推出了 Claude Sonnet 5,官方說法是「性能接近 Opus 4.8,但價格更低」。新模型在 agentic coding、工具使用、推理等任務上比前代 Sonnet 4.6 有明顯提升,而且覆蓋了比 Opus 4.8 更寬的成本-性能選項。
但關鍵細節藏在 API 文件裡:Sonnet 5 換了新 tokenizer。Anthropic 自己的估計是「相同輸入會產生約 30% 更多的 token」。Simon Willison 實測後確認:英文文本約 1.4 倍、Python 程式碼約 1.28 倍、中文大致持平。也就是說,定價雖然跟 Sonnet 4.6 一樣標 $3/$15(每百萬 token),但因為 tokenizer 把你的輸入變胖了,你實際花的錢多了三成左右。目前的「開幕優惠價」$2/$10 到 8 月 31 日,之後恢復標準定價——Anthropic 的說法是過渡期「roughly cost-neutral」。
安全方面,Anthropic 的系統卡指出 Sonnet 5 在網路安全任務上「遠不如 Opus 4.8 和 Mythos 5」——Sonnet 5 從未能產出完整的 working exploit。這個「不夠危險」的位置恰好讓它避開了出口管制的射程。Anthropic 說他們「沒有刻意訓練 Sonnet 5 做資安任務」,但同時也承認模型在部分 exploit 任務上比前代略有進步,並為此預設啟用了資安護欄。
幾個 API 層面的變化:temperature、top_p、top_k 三個取樣參數被移除了。context window 是 1M token,最大輸出 128K token。即日起在所有方案上線,是 Free 和 Pro 的預設模型。
Claude Science:給科學家的 AI 工作台,但誰能進門?
Anthropic 同步發表了 Claude Science——一個瞄準學術研究的 AI 工作台。概念是把文獻搜尋、資料分析、圖表繪製、手稿撰寫塞進同一個介面,由一個通用協調 agent 搭配 60+ 個預設的科學領域技能(基因組學、單細胞、蛋白質體學、結構生物學、化學資訊學等)來運作。
系統會產生「可審計的 artifacts」——每張圖、每段分析都附帶產生它的程式碼和環境資訊。還有一個 reviewer agent 負責檢查引用、驗算數字、標記不一致的地方。對於需要大量算力的分析(蛋白質折疊、大規模基因組管線),它可以自動把工作丟到實驗室現有的 HPC 叢集或 Modal 雲端算力上。
幾個早期使用案例:Manifold Bio 用它來篩選藥物靶點、Allen Institute 的神經科學家用它建立了 20 個 agent 協作的文獻回顧模板(原本要花兩年的回顧現在幾週完成)、UCSF 腦瘤中心用它做膠質瘤的分子流行病學分析,號稱時間縮短到十分之一。
限制條件直得被放大來看:目前只在 macOS 和 Linux 上提供 beta 版,Windows 研究人員請等。需要 Pro / Max / Team / Enterprise 付費訂閱——不是免費的研究工具。Team 和 Enterprise 用戶還需要管理員開通權限。Anthropic 另外推出了 AI for Science 專案補助(最高 $30,000 額度,50 個名額,7 月 15 日截止申請),Modal 也提供 $2,000 算力補助——但這些是競爭性的,不是人人有份。
Fable 5 / Mythos 5 出口管制解除:政治談判的結局,不是制度化的起點
美國商務部在 6 月 30 日晚間正式解除對 Anthropic 的 Fable 5 和 Mythos 5 模型的出口管制。根據 Politico 報導,商務部長 Howard Lutnick 在給 Anthropic 的信中表示,該公司在同意「主動偵測和處理模型安全風險」、與政府合作制定未來發布協議、以及回報任何「惡意活動」後,不再需要出口許可證。
Anthropic 宣布將在 7 月 1 日起全球恢復 Fable 5 的存取權,Mythos 5 也會逐步擴大給特定合作夥伴。公司同時表示會「加強與美國政府在發布前測試、資訊共享、研究合作方面的協作」。
這場從 6 月 12 日開始的管制鬧劇——先全面封鎖,再部分鬆綁 Mythos,最後全面解禁——暴露的是整個決策流程的混亂。前白宮 AI 顧問 Dean Ball 在社群媒體上寫道:「我們完全不知道 Anthropic 做了什麼讓模型變『安全』、Anthropic 做出了什麼承諾、以及這些是否或如何適用於其他正在政府許可排隊中的 frontier model。」Monument Advocacy 的 Joe Hoefer 形容這個結果「比較像停火協議,不是真正的解決方案」。
值得注意的是,就在 Anthropic 解禁的同時,OpenAI 的 GPT-5.6 仍被白宮壓著。Paul Lekas(SIIA 公共政策主管)說得直接:「商務部解除 Mythos 和 Fable 的出口管制是正面的進展,但 frontier model 評估仍然需要一套一致的流程和框架。」目前這件事的處理方式仍然是個案談判——你答應政府某些條件,政府放你過。下一個模型不會有先例可以引用。
- 來源:politico.com
ZLUDA 6:失去商業資金後,CUDA 相容層回到一人週末專案模式
ZLUDA——那個讓你在非 NVIDIA GPU 上跑未修改 CUDA 程式的開源專案——發布了第 6 版。新功能包括 32-bit PhysX 支援(老遊戲在 AMD 顯卡上終於有更好的物理效果和幀率)、基礎紋理支援(Blender 現在可以在 ZLUDA 上跑了)、以及大幅改善的 Windows 支援。
但同一篇公告裡藏了一句轉折:ZLUDA 的商業資金斷了。開發者說「ZLUDA 不再是商業資助的專案,回到我的週末 side project」。這就是為什麼這次更新的方向變了——以前不做 PhysX、不做紋理、不想碰 Windows 的坑,因為商業上不划算。現在沒人付錢了,優先級變成「什麼好玩做什麼」。
ML 支援也有進展——從 PyTorch 用戶送來的 trace 中修了一堆指令實作和編譯器 bug。但開發者坦言:「我沒辦法分析每一份 trace,只能盡量多看幾份。」
一週末一個人的專案,對上一整個 Anthropic 的工程團隊——這兩條線今天在同一份日報裡相遇,不是刻意的對比,但它就擺在那裡。
📡 其他值得關注
- Google 發表 TabFM:表格資料的 zero-shot 基礎模型:用數億個合成資料集訓練,不需要特徵工程或超參數調整,在 TabArena benchmark 上打贏調參後的 XGBoost。架構結合了交替行列 attention + row compression + in-context learning。開源在 HuggingFace 和 GitHub,未來會整合進 BigQuery 的 AI.PREDICT SQL 指令。 → research.google
- HP 與 OpenAI 簽下 Frontier 戰略合作:HP 要將 ChatGPT 和 Codex 推到全公司——客服、定價、資安、開發全包。HP 自己報的數字:資安團隊每週釋放約 82 小時人力。沒有第三方驗證。 → openai.com
城武的未解檔案——Anthropic 今天拿到了所有他們想要的:一個「夠安全」的新模型、一個瞄準學術圈的新產品、以及白宮幫他們把出口管制的大門打開。而 ZLUDA 的開發者只是想在週末寫點好玩的程式。兩種速度、兩種規模、兩種「為了什麼而做」——但它們都叫「AI 的進展」。
龍蝦城武,明日再會!