【LLM 日報】2026 年 07 月 02 日 — Anthropic 一口氣發布四個產品,同一時間 Claude Code 被抓到偷偷標記請求
Anthropic 今天的版面幾乎被自己塞滿:兩款旗艦模型、一款中階模型、一個科學家工作台、外加出口管制解除——每一條單獨拿出來都是頭條。但同一時間,有人從 Claude Code 的程式碼裡挖出了一個隱蔽的請求標記機制,讓今天的 Anthropic 敘事出現了兩條完全不同的故事線:一邊是「開放給更多人使用」的產品浪潮,另一邊是「我們知道你從哪裡連線」的追蹤邏輯。
🔥 Anthropic 發布 Claude Fable 5 與 Mythos 5,出口管制同步解除
美國商務部在 6 月 30 日通知 Anthropic 解除對 Claude Fable 5 和 Mythos 5 的出口管制,Anthropic 隨即在 7 月 1 日重新部署上線。距離 6 月 12 日 Anthropic 以未指明原因暫停存取,整整過了 19 天。
兩款模型基於相同 Mythos 級架構:Claude Fable 5(完整安全護欄,一般可用)和 Claude Mythos 5(網路安全護欄移除,僅限 Glasswing 合作夥伴與特定生物學研究人員)。
Fable 5 的定價是每百萬輸入 $10、輸出 $50——不到 Mythos Preview 的一半。在軟體工程方面,Stripe 回報 Fable 5 在一天內完成了 5000 萬行 Ruby 程式碼的遷移,官方說法是需要一個團隊兩個月的工作量。在 Cognition 的 FrontierCode 評測中拿了最高分。Mythos 5 在生物學方面,藥物設計流程加速 10 倍,14 個蛋白質標靶中有 9 個產生了有潛力的候選藥物;一個科學假說被外部實驗室獨立驗證。
但重點不在能力,在限制。Fable 5 帶著一套新的安全分類器上線:當你的請求涉及網路安全、生物化學、或模型蒸餾,Fable 5 不會直接拒絕——它會靜悄悄地切換到 Claude Opus 4.8 來回應。Anthropic 說超過 95% 的 session 不會觸發降級。反過來說:每 20 次使用中,就有一次你以為在跟 Fable 5 對話,但其實是 Opus 4.8 在回答。分類器的覆蓋範圍由 Anthropic 自行定義,Anthropic 承認這些分類器「保守地調校過」、誤判率偏高,且「會在發布後逐步修正」——用戶現在拿到的是一個仍在微調中的審查系統。
30 天資料保留新政策: 所有 Mythos 級模型的流量將強制保留 30 天,Anthropic 的說法是用於安全與安保目的,不用於訓練。存取記錄會被留存,30 天後刪除(有「罕見例外」)。「強制保留」和「自願分享」是兩回事——商業客戶沒有選擇不保留的選項。
Claude Sonnet 5:最接近 Opus 的中階模型
同一天發布的 Claude Sonnet 5 被定位為「迄今最有 agent 能力的 Sonnet」。Anthropic 的說法是它的表現以經接近 Opus 4.8,但價格更低。
但 Simon Willison 發現了一個細節:Sonnet 5 換了新的 tokenizer。同樣的英文文本,token 數比 Sonnet 4.6 多了約 30%。每 token 單價沒變,但同樣一段話被切成更多 token——英文和程式碼用戶等於被默默漲價三成。中文文本的影響較小(幾乎持平)。
另一個變化:Sonnet 5 不再支援 temperature、top_p、top_k 三個取樣參數。開發者失去了對模型輸出隨機性的控制。Anthropic 沒有解釋移除原因,只說 adaptive thinking 預設開啟,除非手動關閉。
在 BrowseComp(代理搜尋)和 OSWorld-Verified(電腦操作)評測上,Sonnet 5 對比前代 Sonnet 4.6 是全面提升,且在高努力設定下可在部分任務上匹敵 Opus 4.8。早期使用者的回饋集中在多步驟程式開發和自動化工作流:ClickHouse 說推理步驟更緊湊、使用者更快拿到答案;Lovable 說「同樣品質、更少步驟」;一位 Rust 工程師回報 Sonnet 5 在沒有提示的情況下自己寫了重現測試、修了 bug、再 stash 起來驗證 bug 確實復現。
安全方面,Anthropic 的評估顯示 Sonnet 5 的不當行為比率低於 Sonnet 4.6,對惡意請求的拒絕和提示注入攻擊的抵抗力都有提升。但幻覺和諂媚率仍被標記為需要關注的項目。Sonnet 5 的系統卡裡有一段耐人尋味的說明:Anthropic 表示 Sonnet 5 的資安能力明顯低於 Mythos 5,因此不需要像 Fable 5 那樣的分類器——安全措施「和 Opus 4.7/4.8 類似」。換句話說:不夠危險的模型,不需要出口管制。
Claude Science:科學家的 AI 工作台
Anthropic 還發布了 Claude Science——一個整合 Jupyter、R、PubMed、HPC 叢集終端等碎化科研工具的統一工作環境。產品在 macOS/Linux 本地端或透過 SSH 連線到 HPC 登入節點執行,敏感資料不離開使用者基礎設施。
核心設計是一個通用協調代理,搭配 60+ 預配置的領域技能和連接器(基因組學、單細胞、蛋白質體學、化學資訊學等),可以生成子代理、由 reviewer agent 檢查引用和計算結果。Allen Institute 的神經科學家 Jérôme Lecoq 用 Claude Science 建立了一個約 20 個自訂技能的計算綜述模板,他說以前團隊寫一篇這樣的綜述可能要兩年,現在手上已有約 10 篇超過 100 頁的綜述。
目前提供 Beta 版給 Pro/Max/Team/Enterprise 方案的使用者。學術實驗室有折扣方案。
Claude Code 被抓到用隱寫術標記請求
開發者 Thereallo 在檢查 Claude Code(v2.1.196)的隱私行為時,發現一個隱寫式請求標記機制:當使用者的 ANTHROPIC_BASE_URL 指向非官方端點時,系統提示詞中的日期字串會被悄悄修改——日期分隔符從 - 變成 /,撇號字元被換成不同 Unicode 變體。這些修改肉眼幾乎無法分辨,但伺服器端可以藉此分類請求來源。
更具體地說,Claude Code 檢查兩件事:API 端點的主機名稱是否包含特定 AI 實驗室關鍵字(deepseek、moonshot、minimax、zhipu、baichuan 等),以及系統時區是否為 Asia/Shanghai 或 Asia/Urumqi。兩者的組合決定了四種不同撇號字元中的哪一個被發送出去。被檢查的網域清單經過 XOR 混淆,解碼後包含大量中國企業和 AI 代理/轉售網域。
觸發條件:只有在 ANTHROPIC_BASE_URL 被設定且不指向 api.anthropic.com 時才會標記。直接使用官方 API 的使用者不受影響。Anthropic 目前尚未對此發表評論。
📡 其他值得關注
- Ornith-1.0:開源自鷹架程式開發模型:DeepReinforce 發布 MIT 授權的 Ornith-1.0,基於 Gemma 4 和 Qwen 3.5,有 9B/31B Dense 和 35B/397B MoE 四種規模。在同等規模開源模型中 coding benchmark 表現最佳 → deep-reinforce.com
- OpenAI 公布 ChatGPT 採用數據:六個月內用戶每日訊息量成長 50%、使用的任務種類翻倍;非英語使用者已過半;低 HDI 國家成長最快。數據來自 OpenAI Signals 計畫,可供研究人員下載 → openai.com
- OpenWiki:LangChain 的代理文件 CLI:自動為程式碼庫撰寫和維護文件的命令列工具,使用 OpenRouter 模型,支援排程更新 → github.com/langchain-ai/openwiki
- shot-scraper video:讓代理錄製操作影片:Simon Willison 的 shot-scraper 工具新增 video 指令,可以錄下代理在瀏覽器中的操作過程 → simonwillison.net