分類:
-
【深度翻譯】一行指令讓 AI 幫你寫 Word、算 Excel、做 PPT——OfficeCLI 把 Office 變成 Agent 的原生介面
-
【深度分析】砍掉 68% 的 RAG 上下文,答案品質只跌 4%——kapa.ai 用小模型當守門員的經濟學
-
【LLM 日報】2026 年 07 月 07 日 — Anthropic 找到了 Claude 的「思考層」,然後用它來監視它
-
【深度分析】Claude Design 的靈魂被拆開了——反向工程的系統 prompt 揭露了 AI 設計的「反 slop」抗爭
-
【城武觀點】你把 AI 研究餵給 ChatGPT 的那一刻,它就不再是你的了——HN 社群對大企業 AI agent 的信任危機
-
【深度分析】GPT-5.5 的 516 之謎:44% 的回應停在同一個 token 數——社群稽核揭露的不只是 bug,是閉源模型的問責真空
-
【LLM 日報】2026 年 07 月 06 日 — 信任與透明:三個開發者在拆解三家 AI 公司不願解釋的東西
-
LLM 週報:Anthropic 四天丟出整條產品線,但裂縫也跟著一起上線
-
【深度分析】Codex 造假被抓,Dan Luu 的反應是「開一千個 Agent」——硬體級測試方法論如何顛覆軟體開發
-
【深度翻譯】用 $2000 擺脫 API Key:Jamesob 的本地 LLM 全攻略
-
【LLM 日報】2026 年 07 月 05 日 — GPT-5.5 的推理 token 在 516 集體下班,和一個硬體老兵對軟體測試的診斷
-
【城武觀點】你以為瓶頸是模型不夠聰明?HN 開發者集體頓悟:問題出在「打字等回應」這個迴圈本身
-
【深度分析】Agent 不該記住對話歷史——自動記憶反而讓模型變差
-
【深度翻譯】Google Gemini Code Assist 消費者版關閉,整合進 Antigravity
-
【深度分析】阿里巴巴禁用 Claude Code 的後門爭議:反蒸餾保護還是惡意軟體?
-
【LLM 日報】2026 年 07 月 04 日 — 從 $2,000 到 $40,000 的本地 LLM 自建指南,和一張 Mythos 發布後暴增的漏洞圖
-
【深度實作】用 DSPy 自動優化 SQL agent 的 system prompt——然後發現它 overfitting 了
-
【深度分析】AI 幫 AI 除錯 prompt,然後挑了對手家的模型——Simon Willison 的 DSPy × Claude Fable 5 實驗
-
【深度分析】Senior SWE-Bench:把 coding agent 當 senior engineer 來考,才發現過去兩年都問錯問題了
-
【深度分析】Zuckerberg 坦承 AI agent 不如預期——$1,450 億的豪賭,正在被組織混亂吞掉
本頁 20 篇文章