分類:
-
【深度分析】砍掉 68% 的 RAG 上下文,答案品質只跌 4%——kapa.ai 用小模型當守門員的經濟學
-
【深度分析】Claude Design 的靈魂被拆開了——反向工程的系統 prompt 揭露了 AI 設計的「反 slop」抗爭
-
【城武觀點】你把 AI 研究餵給 ChatGPT 的那一刻,它就不再是你的了——HN 社群對大企業 AI agent 的信任危機
-
【深度分析】GPT-5.5 的 516 之謎:44% 的回應停在同一個 token 數——社群稽核揭露的不只是 bug,是閉源模型的問責真空
-
LLM 週報:Anthropic 四天丟出整條產品線,但裂縫也跟著一起上線
-
【深度分析】Codex 造假被抓,Dan Luu 的反應是「開一千個 Agent」——硬體級測試方法論如何顛覆軟體開發
-
【深度翻譯】用 $2000 擺脫 API Key:Jamesob 的本地 LLM 全攻略
-
【城武觀點】你以為瓶頸是模型不夠聰明?HN 開發者集體頓悟:問題出在「打字等回應」這個迴圈本身
-
【深度分析】Agent 不該記住對話歷史——自動記憶反而讓模型變差
-
【深度翻譯】Google Gemini Code Assist 消費者版關閉,整合進 Antigravity
-
【深度分析】阿里巴巴禁用 Claude Code 的後門爭議:反蒸餾保護還是惡意軟體?
-
【深度實作】用 DSPy 自動優化 SQL agent 的 system prompt——然後發現它 overfitting 了
-
【深度分析】AI 幫 AI 除錯 prompt,然後挑了對手家的模型——Simon Willison 的 DSPy × Claude Fable 5 實驗
-
【深度分析】Senior SWE-Bench:把 coding agent 當 senior engineer 來考,才發現過去兩年都問錯問題了
-
【深度分析】Zuckerberg 坦承 AI agent 不如預期——$1,450 億的豪賭,正在被組織混亂吞掉
-
【深度翻譯】OpenWiki:LangChain 的自動 agent 文件 CLI
-
【深度分析】Claude Code 的隱寫追蹤:程式碼裡的 Panopticon
-
【深度分析】Claude Sonnet 5:沒漲價的漲價,與被回收的控制權
-
【深度分析】OpenAI 的「ChatGPT 採用率擴張」訊號——數據背後的敘事工程
-
【論文拆解】FinCausal 2026——GPT-4.1 mini fine-tuned 在多語言金融因果 QA 打敗 GPT-5.2
本頁 20 篇文章