常用术语速查
理解术语的目的是帮助做决定,不必在使用前全部记住。
| 术语 | 含义 | 常见误解 |
|---|---|---|
| 提示词 Prompt | 交给模型的问题、目标或指令 | 不是必须背诵的固定咒语 |
| 上下文 Context | 当前任务可用的消息、材料和其他信息 | 不是无限长,也不保证总能保留所有细节 |
| Token | 模型处理文本等输入时使用的计量单位 | 不是固定等于一个汉字或单词 |
| 模型 Model | 理解输入、生成结果的系统 | 模型名称不代表所有工具权限 |
| 推理 Reasoning | 为复杂任务进行分析与求解的能力 | 花更多时间不保证一定正确 |
| 幻觉 Hallucination | 生成无依据或错误却看似可信的内容 | 语言流畅不能排除幻觉 |
| 工具 Tool | 搜索、文件处理或外部操作等能力 | 回答声称操作不等于实际执行 |
| 引用 Citation | 指向支撑信息的来源 | 有链接不等于来源支持结论 |
| 记忆 Memory | 产品中可保留或引用偏好的机制 | 与当前对话、项目文件不是同一概念 |
| 项目 Project | 组织相关对话、材料与指令的空间 | 不自动拥有电脑上所有文件权限 |
| API | 程序调用服务的接口 | 与 ChatGPT 产品订阅不是同一使用方式 |
| OCR | 从图像或扫描件识别文字 | 识别文字仍可能有错 |
开发与模型资料里常见的术语
| 术语 | 含义 | 阅读时检查什么 |
|---|---|---|
| 上下文窗口 | 单次处理可容纳的信息范围 | 输入、历史消息和输出如何占用额度 |
| 知识截止日期 | 模型资料标注的知识时间边界 | 不能据此推断它查过今天的网页 |
| 流式输出 Streaming | 在响应生成过程中逐步接收内容 | 中途收到文字不代表任务已完成 |
| 函数调用 Function calling | 模型请求应用执行预定义函数 | 应用仍需验证参数与执行权限 |
| 结构化输出 | 按约定结构生成字段 | 格式正确不保证字段中的事实正确 |
| Prompt caching | 对符合条件的重复输入利用缓存 | 是否命中、保留时间及计费规则 |
| 速率限制 Rate limit | 一段时间内的请求或 token 限额 | 与余额不足、单次上下文上限不同 |
| Agent | 围绕目标调用工具并进行多步处理的系统 | 能做哪些动作,谁负责确认结果 |
百分比、百分点与每百万 tokens
阅读评测时,从 60% 到 65% 是增加 5 个百分点,相对提升约 8.3%。如果文章只写“提高 5%”,需要回到数据确认究竟指哪一种。不同任务集合和不同推理设置的分数,也不适合直接拼成一个排名。
价格中的“每百万 tokens”是计价单位,不代表每次请求固定消费一百万。输入、输出、缓存和工具可能分别计费。一个汉字占多少 tokens 也不是固定常数,实际用量应以接口报告或计量工具为准。
一个例子串起来
你上传会议记录作为上下文,用提示词要求提取行动项,模型生成表格。如果需要核对外部资料,可能调用搜索工具并附上引用。你仍要核对姓名和日期,避免把生成的内容误认为原文事实。
继续阅读:认识 ChatGPT · 核心功能地图。