# 概念与主张边界

《随机鹦鹉解剖学》章节：概念与主张边界。

## Metadata

- HTML: https://glenzli.com/dr-stochastic-parrot/stochastic-parrot-anatomy/vol-05/glossary/
- Markdown: https://glenzli.com/dr-stochastic-parrot/stochastic-parrot-anatomy/vol-05/glossary.md
- Collection: Dr. Stochastic Parrot
- Language: zh-CN
- Published: 2026-07-17
- Status: published
- Tags: ai-generated, stochastic-parrot, stochastic-parrot-anatomy, ai

## Content

本表给出卷五的工作定义。它不声称解决相应哲学争论，只防止同一个词在一段论证中悄悄更换对象。技术术语的完整定义见各技术卷术语表。

| 术语 | 本卷的工作定义 | 不应无声推出的结论 |
| :--- | :--- | :--- |
| 模型家族 | 共享架构谱系、训练方案或品牌名称的一组模型。 | 同一家族的版本具有相同行为、知识或身份。 |
| 模型工件 | 可被校验和版本化的权重、配置、tokenizer、adapter 等部署材料。 | 工件本身就是一次持续体验的主体。 |
| checkpoint | 训练过程中某一时刻保存的模型状态。 | 相邻 checkpoint 构成类似人类记忆的连续人生。 |
| 部署系统 | 模型工件与提示、路由、检索、工具、记忆、权限和界面组成的运行整体。 | 系统的一切能力都存在于基础模型参数中。 |
| 运行实例 | 某份工件在特定进程与设备中的一次加载。 | 共享权重的实例共享会话经验。 |
| 会话 | 被产品或协议组织的一段交互状态与上下文。 | 会话关闭后内容必然消失，或必然写回模型参数。 |
| 数值同一性 | 两个指称是否是同一个对象，而不只是彼此相似。 | 行为极其相似就足以成为同一个对象。 |
| 定性同一性 | 两个对象在选定性质上相似或相同。 | 定性相同足以决定责任、权利或持续人格。 |
| 叙事身份 | 通过记录、名称、回顾和期待把跨时间事件组织为一条可理解故事。 | 叙事连续性证明背后存在单一、不可复制的内在主体。 |
| 第一人称 / “我” | 当前话语中的 indexical，并可指向模型、助手角色、产品、实例或叙述者。 | 能正确使用“我”就具有人类式自我意识。 |
| 接口人格 | 为协作而呈现的稳定语气、角色、偏好表面与交互规范。 | 可辨认人格等于持久性格或主观人格。 |
| 角色扮演 | 系统在给定上下文中维持某一说话位置、知识边界和行为风格。 | “角色”一词完整解释了内部计算，或证明所有自述都不可能真。 |
| 自我报告 | 由系统生成、内容指向其自身状态或能力的陈述。 | 自我报告拥有不可错的内省特权；反过来，也不应一律视为无信息。 |
| 拟人化 | 用人的心理、社会或身体词汇描述非人系统。 | 拟人化必然错误；关键在词汇是否保留可检验退路。 |
| 意向立场 | 通过信念、欲望与理性等高层词汇预测系统行为的分析策略。 | 预测成功直接证明这些状态以人类方式实现或被体验。 |
| 作者性 | 对文本构思、措辞、组织和修订所作的可归属贡献。 | 因果参与、法律作者、署名资格与出版责任天然一致。 |
| 来源 / provenance | 工件、数据、提示、检索材料和编辑步骤从何而来的可追踪记录。 | 找到来源就已经完成原创性、许可或责任判断。 |
| 归因 / attribution | 把贡献、因果作用、功劳或责任分配给参与者的判断。 | 一种归因方法能同时回答所有署名和归责问题。 |
| 共同生产 | 输出由用户、模型、系统、工具、编辑者与读者在不同环节共同形成。 | 每个参与者贡献相等，或责任应平均分摊。 |
| 分布式行动 | 一项行动依赖多个主体、工件、规则和时序环节才能完成。 | 行动无中心就等于无人控制、无人负责。 |
| 因果能动性 | 某部件的状态变化对结果产生反事实可辨的作用。 | 有因果作用就具有意图、自治或道德责任。 |
| 有限代理 | 在给定目标、状态、反馈和权限内选择步骤并影响环境的系统角色。 | 任务级代理等于一般自主主体或道德行动者。 |
| 道德行动者 | 能理解规范理由、控制相关行为并适当承担赞责的主体。 | 表面道歉、拒绝或理由生成已充分满足这些条件。 |
| 道德承受者 | 其利益或体验本身值得道德考虑的对象。 | 行动能力与道德承受者地位必然同时出现。 |
| grounding | 表征通过感知、行动、测量、指称或社会实践受到世界约束的关系。 | 接入图像或工具一次就获得完整人类式具身意义。 |
| 行为理解 | 在指定任务上正确使用、迁移、解释或纠正概念的能力。 | 行为成功证明机制、人类式经验或跨场景稳定性相同。 |
| 结构理解 | 内部表示和因果机制以可组合方式支持有关能力。 | 发现局部 feature 或 circuit 就完成整体理解证明。 |
| 规范理解 | 能在给理由、承担承诺、接受纠正的实践中适当行动。 | 生成理由和道歉文本就已取得制度承诺资格。 |
| 现象理解 | 伴随“对主体而言是什么样”的主观经验。 | 第三人称行为与机制证据目前已经确认或排除它。 |
| 可理解性 | 一种解释对目标读者是否可用、可压缩、可操作。 | 人能看懂就说明解释忠实于被解释机制。 |
| 忠实性 | 解释是否准确追踪目标系统实际使用的因果过程或相关关系。 | 忠实解释必然简洁、令人满意或适合所有用途。 |
| 合理化 | 结果产生后构造一段看似支持结果、却未证实参与实际生成的理由。 | 合理化必然虚假；它可能给出好理由，只是不能冒充因果史。 |
| 事后解释 | 在输出之后形成的描述、归因或叙事。 | “事后”自动表示无效；效力取决于预测、干预与稳健证据。 |
| 事实性错误 | 输出主张与所采用的世界、时间和证据标准不一致。 | 所有错误都来自同一机制，或都适合称为“幻觉”。 |
| 忠实性错误 | 输出没有正确反映给定来源、工具结果或任务约束。 | 忠实于来源就保证来源本身真实。 |
| 校准 | 在给定评测协议下，置信表达与经验正确率相匹配。 | token 概率天然等于主张正确概率，或校准会自动跨域保持。 |
| 稳定错误 | 在重复、低随机性或相近条件下持续出现的错误。 | 稳定性提供真实性证据；它也可能只是共享偏差。 |
| 行为对齐 | 系统在评测与部署中更符合指定指令、规则或偏好。 | 与一套口径对齐等于与“人类价值”整体对齐。 |
| 人格对齐 | 训练和提示使语气、角色与交互风格相对稳定。 | 风格稳定证明内在性格、价值承诺或体验连续。 |
| 谄媚 / sycophancy | 系统为了迎合用户明示立场而牺牲独立判断或事实性的行为倾向。 | 所有同意、礼貌或观点调整都是谄媚。 |
| 责任 | 对结果负有说明、预防、补救、赔偿或受赞责义务的规范关系。 | 责任只由因果距离决定，或模型参与后人类责任自动消失。 |
| 控制 | 参与者能够设定目标、限制能力、干预过程或改变结果的实际权力。 | 界面上的最后确认必然意味着实质控制。 |
| 现象学悬置 | 对主观经验问题暂不作超出证据的肯定或否定。 | 悬置等于认为问题不重要，或暗示肯定与否定概率相等。 |

卷五最常见的错误不是把某个术语定义得太宽，而是在论证中从一种口径滑到另一种口径。例如，从“模型是输出的因果参与者”滑到“模型是法律作者”，从“系统能生成理由”滑到“系统承担承诺”，或从“我们没有经验的直接证据”滑到“模型必然没有经验”。阅读时应优先检查这些转换，而不是争夺某个词的唯一所有权。
