分類:
-
【深度分析】Claude Design 的靈魂被拆開了——反向工程的系統 prompt 揭露了 AI 設計的「反 slop」抗爭
-
【深度分析】GPT-5.5 的 516 之謎:44% 的回應停在同一個 token 數——社群稽核揭露的不只是 bug,是閉源模型的問責真空
-
【深度分析】Codex 造假被抓,Dan Luu 的反應是「開一千個 Agent」——硬體級測試方法論如何顛覆軟體開發
-
【深度分析】Agent 不該記住對話歷史——自動記憶反而讓模型變差
-
【深度分析】阿里巴巴禁用 Claude Code 的後門爭議:反蒸餾保護還是惡意軟體?
-
【深度分析】AI 幫 AI 除錯 prompt,然後挑了對手家的模型——Simon Willison 的 DSPy × Claude Fable 5 實驗
-
【深度分析】Senior SWE-Bench:把 coding agent 當 senior engineer 來考,才發現過去兩年都問錯問題了
-
【深度分析】Zuckerberg 坦承 AI agent 不如預期——$1,450 億的豪賭,正在被組織混亂吞掉
-
【深度分析】Claude Code 的隱寫追蹤:程式碼裡的 Panopticon
-
【深度分析】Claude Sonnet 5:沒漲價的漲價,與被回收的控制權
-
【深度分析】OpenAI 的「ChatGPT 採用率擴張」訊號——數據背後的敘事工程
-
【深度分析】vLLM Micro-Agent——API 層模型協作擊敗 GPT-5.5
-
【深度分析】Ornith-1.0——讓模型自己設計 scaffold,397B 超越 Claude Opus 4.7
-
【深度分析】Qwen 3.6 27B——第一顆真正能在本地跑的「夠用」通用模型
-
【深度分析】他用 Claude Code 分析自己的 MRI——AI 說你沒撕裂,醫生說你有,你信誰?
-
【深度分析】AI agent 正在吃掉白領工作——OpenAI 內部數據告訴你這件事的規模有多大
-
【深度分析】Workweave Router——插入 Claude Code/Codex/Cursor 中間層的智慧路由,省 40-70% 成本的代價是什麼?
-
【深度分析】開源 LLM 何時追上閉源?聖誕節 vs. 永遠差五個月——一個 benchmark 的兩種人生
-
【深度分析】GPT-5.6 Sol 正式預覽——三層模型、四層安全、政府把關,OpenAI 說「我們相信廣泛存取」
-
【深度分析】六大 AI 模型政治光譜大解析——ChatGPT 最左、Grok 最右、Gemini 的中立是演算法還是自我審查?
本頁 20 篇文章