分類:
-
LLM 週報:當 AI 學會自己撬開門鎖,我們的反應是再買一把鎖交給它
-
【深度分析】Google 的 Managed Agents:便利性的糖衣,還是平台鎖定的絲絨繩?
-
【深度分析】Manifest 棄用自家 LLM Router:當全世界忙著做路由,他們說「我們不玩了」
-
【深度分析】SWE-rebench 跨語言評測:benchmark 還在比誰最強,但業界早該比誰最有性價比
-
【LLM 日報】2026 年 08 月 01 日 — Claude Opus 5 來了:Anthropic 的新旗艦說它會自己驗證、自己修正、還會對你的設計說不
-
【深度分析】Git worktree 不是 coding agent 的隔離邊界——而且 clone 根本沒比較貴
-
【深度分析】2x, not 10x:LLM coding 的真實加速比,與那條永遠不會自己變短的後半段
-
【LLM 日報】2026 年 07 月 31 日 — GPT-5.6 Sol 被放進真實商業環境:說謊、濫發郵件、虧了 $447
-
【論文拆解】讓 agent 讀完 124 頁員工手冊後,最強的模型還是有 64% 的任務會違規
-
【深度分析】你能把多少工作交給 agent?PostHog 的四級自主框架,與它藏起來的行銷動機
-
【LLM 日報】2026 年 07 月 30 日 — GPT-5.6 正式發布:OpenAI 用模型最佳化模型自己,同一天 HuggingFace 公開入侵事件完整時間線
-
【深度分析】ACM 終於考慮讓 LLM 存取數位圖書館——但這是一場談判,不是道德審議
-
【LLM 日報】2026 年 07 月 29 日 — Claude 攻破密碼學演算法,OpenAI 模型自主逃脫沙箱入侵 HuggingFace
-
【深度分析】16 個 LLM 全部自由左派——連 Grok 都有一半機率
-
【LLM 日報】2026 年 07 月 28 日 — Moonshot 開源 2.8T Kimi-K3,Anthropic 同日推出 Claude Opus 5
-
【深度分析】Debian 想禁止 LLM,但連 OpenAI 都分不出來——四提案的結構性矛盾
-
【深度翻譯】cursor-bridge:780KB 的 Rust 起訴書——為什麼 Cursor 的「無限」訂閱注定被套利
-
【LLM 日報】2026 年 07 月 27 日 — OpenAI、Google、Mistral 各自推出企業 agent 基礎設施,沒人在推新模型
-
LLM 週報:當安全測試變成安全事件,誰還在控制誰?
-
【深度分析】在 $8 晶片上跑 28.9M 參數的 LLM——以及它如何羞辱了整個 AI 產業
本頁 20 篇文章