从使用 AI 到设计 AI 可执行环境:我对 Agent 上下文工程的理解
2026-08-25
模型已经非常强大了,Agent也已经非常强大了。可为什么在有些人手里可以做到几天甚至几小时做出来一个高质量的产品,而在我手里却总是出错?真正拉开差距其实是能否把上下文、规则、流程和验证组织成一套可执行的 AI 工作系统。
3731 字
|
19 分钟
大模型幻觉:从类型、成因到应对
2026-08-08
幻觉分四类,成因有一条从根因到帮凶的因果链,应对则从 Prompt 一直打到工程落地。一张图看懂大模型为什么会一本正经地胡说八道。
2935 字
|
15 分钟
会用 Coding Agent,不等于拥有 AI Native 思维
2026-08-04
从 Sora Android 的 28 天交付案例出发,理解 AI Native 的本质:任务重构、上下文工程、工具编排、评测闭环与结果所有权。
3645 字
|
18 分钟
从 Chat Completions 到 Responses:OpenAI 为什么要重做一次 API
2026-08-02
从无状态推理、上下文重复传输、Prompt Cache 和 Agent Loop 出发,理解 Chat Completions 为什么曾经合理,又为什么不足以承载今天的 Agent。
4710 字
|
24 分钟
当 Agent 拿到 Shell:从路径围栏到纵深防御
2026-07-28
从攻防博弈的角度讨论 Agent 的路径越界、危险命令、间接提示注入、恶意仓库、MCP、网络外传和资源耗尽风险,以及如何用默认拒绝、能力隔离和统一事实构建纵深防御。
7874 字
|
39 分钟