Context Engine

503 字
3 分钟
Context Engine

1.什么是上下文工程(Context Engine)#

上下文工程是为模型构建动态信息环境的系统性方法。它确保 Agent 在执行复杂任务时,能按需获取最相关的信息,包括用户指令、对话历史、外部数据和工具反馈等。

从代码层面看:通过维护一个 messages 数组(列表)来实现上下文。
原理: 每次你想让 AI 继续对话,你不是只发最新的问题,而是把整个历史对话流(或者截取的一部分)重新打包,作为新的 context 发送给模型。
目的: 这样模型才能“看”到之前的对话,知道你在聊什么,从而实现连贯的问答。

2.上下文控制#

2.1 控制上下文长度#

上下文工程的技巧: 当对话太长时,我们不能无脑打包,而是要进行摘要(Summarization)或滑动窗口(Sliding Window)。
例子: 如果对话超过 10 轮,我们可能会先让 AI 把前 5 轮总结成一句话,然后只把总结和后 5 轮发过去,而不是把 10 轮全发过去。

2.2 结构化信息#

除了对话历史,上下文工程还包括注入非对话类的信息。

  • 知识库: 比如你问“公司报销流程”,系统会先去检索手册,把“报销规则”这段文字作为上下文插入到 system prompt 里,再发给 AI。
  • 外部数据: 比如当前的天气、用户画像、数据库查询结果等。这些都不是“对话历史”,但它们是上下文的重要组成部分。

2.3 对话的“编排” (Orchestration)#

有时候我们不希望模型看到所有的中间步骤。

  • 思维链(Chain of Thought): 我们可能先让模型在后台“思考”(这部分作为中间上下文),最后只把“思考后的结论”作为最终上下文的一部分展示给用户。

支持与分享

如果这篇文章对你有帮助,欢迎分享给更多人或赞助支持!

赞助
Context Engine
https://kianzhao.site/posts/Context-Engine/
作者
Kian Zhao
发布于
2026-04-30
许可协议
CC BY-NC-SA 4.0
相关文章 智能推荐
1
一个小实验看懂 CoT 与 ReAct:让大模型"闭卷推理"还是"带工具干活"
AI 本文基于一个可直接运行的 Python 小项目,用两个贴近真实业务的实验,带你彻底搞懂大模型领域两种最经典的提示模式——**CoT(Chain of Thought,思维链)**和 **ReAct(Reasoning + Acting,推理 + 行动)**的区别。不需要任何大模型开发经验,跟着文章走就能看懂。
2
别再跟 AI 的 API 格式较劲了:2026 年开发者生存指南
AI 上个月你还在用 GPT-5.4,这个月 GPT-5.6 就来了。上周 Claude Sonnet 4 还是编码之王,这周 Gemini 3 Pro 就在长上下文上把它按在地上摩擦。
3
Claude Code 多智能体实战指南:Subagents 与 Agent Teams 到底怎么选?
AI 在使用 Claude Code 处理复杂项目时,我们经常会遇到需要“多角色协作”或“处理海量文件”的场景。Claude Code 提供了两种强大的多智能体模式:Subagents(子代理) 和 Agent Teams(智能体团队)。 很多新手在面对这两个概念时会一头雾水:它们有什么区别?我的场景该用哪个?既然 Subagents 是串行执行的,我为什么不直接让主 Agent 自己干? 这篇文章将用最通俗的大白话,帮你彻底理清这些概念,并教你如何通过 Agent View 掌控全局。
4
RAG 文档切割实战指南:从入门到进阶的工程化最佳实践
knowledge base 做 RAG(检索增强生成)项目,很多人把精力花在选大模型、调 Prompt 上,却忽略了一个最基础也最致命的问题:文档切割
5
Agent知识库这些年:从Rag到OKF0.2
AI 本文梳理了 Agent 知识库过去六年的技术路线演进,从 Vector RAG 到 GraphRAG、LightRAG、树形索引、LLM Wiki、OKF,再到 frontmatter + Git 的下半场判断。
随机文章 随机推荐
Profile Image of the Author
Kian Zhao
Hello, I'm Kian Zhao.
公告
欢迎来到我的博客!这是一则示例公告。
音乐
封面

音乐

暂未播放

0:00 0:00
暂无歌词
分类
标签
站点统计
文章
32
分类
8
标签
24
总字数
48,238
运行时长
0
最后活动
0 天前

目录