附录:AI 概念名词速查手册

附录:AI 概念与名词速查手册
本手册整理了入门指南中涉及的所有 AI 相关概念和名词,用大白话解释,方便随时查阅。
一、AI 基础概念
AI Agent(智能体)
想象一个能自己思考、自己做事的"机器人软件"。你给它一个目标,它自己想办法完成。
不光能聊天,还能执行代码、搜网页、操作文件。就像一个会干活的 AI 助手,不只是"动嘴"。
LLM(大语言模型)
就是 ChatGPT、DeepSeek、文心一言这类 AI 的"大脑"。
LLM 是 Large Language Model 的缩写。它本质上是一个"预测下一个词"的模型,但经过海量数据训练后,变得能理解问题、写代码、甚至"推理"。
System Prompt(系统提示词)
在每次对话开始前,先给 AI 一段"说明书",告诉它它是谁、能做什么、不能做什么。
比如:"你是一个代码助手,只能用中文回答,每次回复以代码块结尾。"——这段就是 System Prompt。它不会被用户看到,但会影响 AI 的所有回复。
Token(词元)
AI 处理文本的最小单位。一个中文字约等于 1-2 个 Token,一个英文单词约等于 1-3 个 Token。
Token 就像 AI 的"货币"——大多数 AI 服务按 Token 数量收费,上下文窗口也以 Token 算。
Context Window(上下文窗口)
AI 一次能"记住"的信息量上限,以 Token 为单位。
如果对话太长,超过了上下文窗口,AI 就会"忘记"最早的内容。这就像你只能记住最近 10 分钟说的话——超过 10 分钟的就忘了。
SSE(Server-Sent Events,服务端推送)
一种让服务器"主动推送"数据给浏览器的技术,常用于 AI 的流式输出。
你聊 AI 时,回答是一点一点"蹦"出来的,而不是等半天一次性出来。这就是 SSE 在起作用。
二、AI 交互模式
Tool Calling(工具调用)
AI 不只是"说话",它还能"动手"——调用工具。
比如你问"今天天气",AI 不是自己知道,而是调用一个"查天气 API"工具,把结果拿回来再告诉你。这个过程就是 Tool Calling。
Turn / Step(回合 / 步骤)
一次完整的问答 = 一个 Turn(回合)。一个 Turn 里面 AI 可能调用多次工具,每次调用 = 一个 Step(步骤)。
- Turn:从用户发消息到 AI 最终回复完成
- Step:Turn 内的一轮"AI 思考 → 可能调用工具"
就像你点外卖:Turn 是"下单→收到外卖",Step 是"选菜→确认→支付→等待"。
Plan Mode(计划模式)
AI 先列出执行计划,你确认后,再按计划执行。
就像装修前先出设计图,你确认了再动工。避免 AI 瞎搞,也让你心里有数。
Workflow(工作流)
把一系列操作按顺序串起来,自动执行。
就像 CI/CD 的 pipeline:代码提交 → 自动测试 → 自动部署。定义好步骤,AI 按顺序跑。
Subagent(子 Agent)
主 Agent 太忙了,可以创建"子 Agent"去干具体的活。
就像老板派员工干活——老板(主 Agent)分配任务,员工(子 Agent)去执行,执行完回来汇报。
Goal(目标管理)
给 Agent 设定目标,跟踪进度,完成后标记。
就像 Todo List——创建目标 → 激活 → 执行中 → 完成 → 归档。
三、AI 通信协议
MCP(Model Context Protocol,模型上下文协议)
一个标准协议,让 AI 能连接外部工具和资源。
就像 USB 协议——不管什么设备,只要支持 USB 就能插上。MCP 让 AI 连接各种外部服务,不用每次重新适配。
ACP(Agent Client Protocol,Agent 客户端协议)
一个标准协议,让不同 Agent 之间能互相通信。
就像 HTTP 协议让浏览器和服务器通信,ACP 让 Agent 和 Agent 通信。
JSON-RPC
一种用 JSON 格式做远程过程调用的协议,简单轻量。
就像用 HTTP 调 API,但格式是 JSON-RPC。请求告诉服务器"我要调哪个方法、传什么参数",服务器返回结果。
LSP(Language Server Protocol,语言服务器协议)
一个标准协议,让编辑器和语言服务器通信,实现代码补全、跳转定义等功能。
VSCode 的代码补全、跳转定义、错误提示都靠 LSP。AI 也可以通过 LSP 分析代码。
四、数据存储相关
Event Sourcing(事件溯源)
不存"当前状态",只存"发生了什么"。当前状态从事件"算"出来。
就像 Git——不存文件的最新版本,而是存每次 commit 的变更。任何时候都能回溯到历史状态。
Surface(表面机制)
控制哪些事件"浮出水面"给 AI 看到,哪些藏在底下。
就像数据库的 View(视图)——不是所有字段都暴露,只暴露需要的。内部事件(如"回合开始")不会传给 AI。
Projection(投影)
从原始事件日志中"算出"各种视图。
就像 Vue 的 computed 属性——从 data 算出需要的展示数据。原始日志是 data,消息列表、Token 统计是 computed。
Compaction(会话压缩)
对话太长了,把历史合并成摘要,节省上下文空间。
就像 Git 的 git rebase——把一堆小 commit 合并成一个。用 AI 生成摘要,替代原始事件。
Spill(溢出存储)
文件太大传不上去?先存到外部,给 AI 一个"占位符"。
就像超大附件用网盘链接代替——AI 看到的是链接,需要时再去取。
Persistence(持久化)
把内存中的数据"刷"到硬盘上,关机也不丢。
就像 localStorage 保存数据——重启后还能读到之前的聊天记录。
JSONL(JSON Lines)
一种文件格式,每行一个 JSON 对象,适合追加写入。
就像日志文件,每次在末尾加一行,不修改前面。
SQLite
一个轻量级的嵌入式数据库,不需要单独的数据库服务器。
就像 localStorage 但更强大,支持 SQL 查询。很多桌面应用和移动应用都用它。
五、安全相关
Sandbox(沙箱)
把 AI 执行的代码"关在笼子里",防止它搞破坏。
就像浏览器的 iframe sandbox——iframe 里的页面不能访问父页面的 DOM。沙箱里的代码不能访问宿主机的文件系统。
Landlock
Linux 内核的沙箱机制,限制进程能访问的文件和目录。
不需要 root 权限,普通用户就能用。就像给进程画个圈,只能在圈里活动。
Bubblewrap
用 Linux 的 namespace 技术做轻量级沙箱。
不需要 Docker 这种重量级方案,比 Docker 更轻更快。
E2B Sandbox
一个云端沙箱服务,在远程容器里执行代码。
本地不用装 Docker,也不用担心安全问题——代码在云端跑,隔离得很彻底。
Credential(凭证)
API Key、密码等敏感信息,需要安全存储,不能硬编码。
就像 .env 文件存环境变量——代码里不写死,运行时才注入。
Guard(守卫)
在执行前检查"能不能执行",像门卫一样。
比如:超时检查(超过 5 分钟就停)、重复调用检查(同一个工具连续调了 8 次,提醒 AI 换个方式)。
六、架构与设计模式
Plugin(插件架构)
一切功能都是插件,可以自由组合、替换。就像 Vite 插件或 Chrome 扩展。
不需要的功能就不装,换了实现也不影响其他部分。你也写一个,发到 npm 大家用。
Cordis(插件框架)
Harness 的底层框架,专门用来构建插件化应用。
提供五个核心概念:Context(万能背包)、Service(服务)、Fiber(生命周期)、Events(事件总线)、Registry(插件注册表)。
Dependency Injection(依赖注入)
你不需要自己 new 对象,告诉框架"我需要什么",框架帮你注入。
就像 Vue 的 provide/inject——父组件 provide,子组件 inject,不用层层传递。
Fiber(插件生命周期)
管理插件的"生老病死"——启动、运行、出错、销毁。
就像 React 的 useEffect——注册副作用,卸载时自动清理,防止内存泄漏。
Waterfall(流水线模式)
数据像流水线一样,经过一个又一个处理节点,每个节点可以修改数据。
就像 Express 的中间件——请求经过一个个中间件处理,每个中间件可以修改请求或响应。
Capability Seam(能力缝)
一种设计模式:先定义接口,再实现,最后消费。三层分离,互不干扰。
就像写 TypeScript 的 interface → 写 class 实现 → 调用方只管用 interface。
Scope(作用域)
每个 Agent 有自己的"地盘",子 Agent 继承父 Agent 的能力,但可以有自己的限制。
就像 JS 的作用域链——子函数能访问父函数的变量,但反过来不行。
ScopedLayers(分层注册表)
子作用域能"看到"祖先作用域注册的东西,实现能力继承。
就像 React 组件树——子组件能获取祖先组件 context 里的值。
Branded Types(品牌类型)
给 TypeScript 类型打上"标签",防止不同含义的 ID 互相混用。
比如 SessionId 和 AgentId 虽然都是字符串,但加上品牌类型后,编译器会报错,防止你把 SessionId 传给了需要 AgentId 的函数。
CRDT(无冲突数据类型)
一种数据结构,多个地方同时修改也不会冲突,最终自动合并。
就像 Google Docs 的多人协作——你写你的,我写我的,最后自动合并,不会丢数据。
AsyncLocalStorage
Node.js 的 API,在异步调用链中传递上下文,不需要传参。
就像 console.trace() 打印调用栈——不管函数嵌套多深,都能知道"谁在调用我"。
七、基础工具相关
PTY(伪终端)
模拟一个终端窗口,让 AI 能像人一样操作命令行。
你开的终端窗口就是一个 PTY。AI 通过 PTY 执行命令,能看到输出,还能发送信号(如 Ctrl+C)。
HMR(热模块替换)
改了代码不用重启,页面自动更新。
就像 Vite 的 HMR——你改了 Vue 组件,页面自动刷新,开发体验起飞。
Schemastery(Schema 验证)
验证配置数据的格式是否正确,就像 TypeScript 的类型检查,但更灵活。
比如你定义配置里必须有 apiKey 字段且是字符串,如果用户没传或传错了,直接报错,不会等到运行时才发现。
Typert(类型 RPC 框架)
基于 TypeScript 类型系统做远程调用,自动生成类型安全的调用代码。
就像 tRPC——你定义了接口,它自动生成客户端和服务器端的调用代码,类型安全。
Zstd(Zstandard 压缩)
一种高效的压缩算法,比 gzip 更快更强。
JSONL 文件用 Zstd 压缩后,存得小、读得快。
八、交互相关
Skill(技能系统)
给 Agent 安装"技能包",需要什么技能就加载什么。
就像 VSCode 的扩展市场——需要 Markdown 预览就装一个,需要 Dart 支持就装另一个。
Feedback(消息反馈)
用户对 AI 的回复进行评分和备注,帮助改进。
就像给外卖评分——好吃给五星,难吃给一星,还写个备注。
Interactive Approval(交互式审批)
AI 要做敏感操作时,需要用户确认。
就像手机 App 要发短信,弹窗问"是否允许"——你点"允许"才执行。
Permission Presets(权限预设)
预定义好权限组合,方便快速切换。
比如"安全模式"只能读文件,"开发模式"能读写和执行命令。
要点速查
| 概念 | 一句话解释 |
|---|---|
| Agent | 能自己思考做事的 AI 机器人 |
| LLM | AI 的"大脑" |
| System Prompt | 给 AI 的"说明书" |
| Token | AI 处理文本的"最小单位" |
| Tool Calling | AI 调用工具"动手" |
| Turn/Step | 一次问答(回合)/ 一轮思考(步骤) |
| Event Sourcing | 只存"发生了什么",不存"当前状态" |
| Sandbox | 把 AI 关在"笼子"里 |
| MCP | AI 连接外部工具的标准协议 |
| Waterfall | 流水线处理,像 Express 中间件 |
| Plugin | 一切功能都是插件,自由组合 |
| Cordis | Harness 的底层插件框架 |
| Scope | 作用域,子 Agent 继承父 Agent 的能力 |
| Fiber | 插件生命周期,像 React useEffect |
| ScopedLayers | 分层注册表,实现能力继承 |
| Compaction | 历史太长,压缩成摘要 |
| Spill | 内容太大,存到外部 |
| Guard | 执行前检查,像门卫 |
| Skill | 给 Agent 装"技能包" |
| Plan Mode | AI 先做计划再执行 |
| Subagent | 主 Agent 派子 Agent 干活 |
| Workflow | 自动化流水线,像 CI/CD |