本体论:存在者、分类与 AI 领域模型
本体论研究什么存在、存在者有哪些基本类别、如何保持身份并彼此关联;AI 则把这些承诺写成可计算的领域模型。
本体论研究什么?
本体论研究的是:
世界中有什么,这些存在者属于哪些基本类别、以什么方式存在、怎样保持身份,又彼此具有什么关系。
它最著名的问题是“有什么存在?”但列出存在者只是开始。完整的本体论还要说明:人、物体、事件、属性、关系、数字、公司和意图是不是同一种存在;一个东西发生变化后为何仍是同一个东西;某些存在能否独立成立,还是必须依赖物质、制度或人的共同承认。
例如,一块石头和一家公司都可以被说成存在。石头主要以物理结构持续存在,公司则依赖法律登记、组织规则、合同、人员和社会承认。二者都能成为实体,却拥有不同的存在条件与身份标准。
因此,本体论不是给所有事物寻找一种共同材料,而是研究现实中可以承认哪些存在者,以及它们构成怎样的总体结构。
“本体论”这个名称从哪里来?
英文 ontology 由表示“存在者”的希腊语词根 on、ontos 与表示研究或论述的 logos 构成,可以直译为“关于存在者的研究”。这个术语作为学科名称形成于近代欧洲,并不是古希腊已经固定使用的现代学科标签。Stanford Encyclopedia of Philosophy:Metaphysics
中文把它译为“本体论”,容易产生两个误解。
第一,它不只研究藏在现象背后的“终极本体”。现代本体论也研究普通对象、事件、属性、关系、社会制度、抽象对象与身份条件。
第二,它不只是寻找事物的“本质”。本质问题追问一个东西成为该种东西必须具有什么;本体论的范围更大,还要追问这种东西是否存在、如何存在,以及它与其他存在者是什么关系。
“存在论”有时更能直接呈现 ontology 的问题意识,但现代汉语学术表达通常仍使用“本体论”。理解这个词时,重点应放在“存在者及其结构”,而不是把“本体”预先理解成唯一、隐藏而不变的根基。
本体论包含哪些问题?
什么存在?
最直接的本体论工作,是说明一种理论承认哪些存在者。
有些理论只承认物理对象是基础存在,数字、价值或社会组织只是描述物理世界的方式。另一些理论认为,数字、属性、制度或心理状态也具有不能被简单消去的存在地位。
一套理论谈到电子、基因、意识、市场或者概率时,不只是使用几个名词,也承担了相应的存在承诺:它把这些对象当作解释世界时不可缺少的单位。现代哲学因此会把本体论理解为对“有什么”及其存在承诺的研究。Stanford Encyclopedia of Philosophy:Logic and Ontology
存在者有哪些基本类别?
本体论还要区分不同种类的存在:
| 类别 | 例子 | 核心问题 |
|---|---|---|
| 具体对象 | 人、树、手机 | 它的空间边界和身份如何确定? |
| 抽象对象 | 数字、集合、几何结构 | 它是否依赖人的思想或符号? |
| 属性 | 红、重量、能力 | 属性能否脱离具有它的对象而存在? |
| 关系 | 属于、相似、因果 | 关系只是描述,还是现实结构的一部分? |
| 事件 | 一次会议、一次购买 | 事件由时间、参与者还是变化来识别? |
| 过程 | 生长、学习、演化 | 持续变化怎样构成同一个过程? |
| 心理状态 | 信念、欲望、意图 | 它与身体、行为和意识有什么关系? |
| 制度实体 | 公司、货币、国家 | 它怎样依赖规则与共同承认? |
这些类别不是一张已经得到所有哲学家同意的最终清单。争论恰恰在于:类别是现实自身的分界,还是人的认知与语言为了处理现实作出的划分?
它们以什么方式存在?
不同存在者可能拥有不同的存在方式。
- 物理对象依赖物质结构;
- 生物依赖生命过程;
- 公司依赖法律和制度;
- 货币依赖集体承认及支付体系;
- 一段软件依赖代码、运行环境和实例化过程;
- 一个虚构人物可以存在于作品和讨论中,却不因此成为现实中的历史人物。
所以,“能被指称”“被模型表示”和“在现实中存在”是三个不同判断。福尔摩斯可以是文学和知识库中的实体,但这不能证明现实中存在一位对应的侦探。
什么使它保持为同一个东西?
本体论还研究同一性条件:什么变化不会使一个对象变成另一个对象?
- 人改名后通常仍是同一个人;
- 公司更换员工后,法律身份可能继续存在;
- 文章修改正文后,可能仍由同一条版本历史维持身份;
- 商品更换包装后,是否还是同一 SKU,要看交易系统的规则;
- AI 模型更新参数后,是同一个产品版本,还是一个新模型,要看讨论采用的身份标准。
不同种类的实体需要不同的同一性规则。只有名称相同,不能证明两个记录代表同一个实体;属性发生变化,也不必然意味着旧实体已经消失。
它们怎样相互依赖?
本体论不只列清单,还研究依赖结构。
一次购买依赖购买者、交易对象、时间和交易关系。一家公司依赖制度,却不能被简单等同于任何一个员工。一种颜色可能依赖某个具有颜色的对象,也可能被理论当作可重复实例化的抽象属性。
这种问题关心的不是普通因果顺序,而是:如果支撑条件不存在,这种存在者还能否以原来的方式成立?
本体论与相邻概念有什么区别?
本体论与本质
本体论问:公司这种存在者是否存在,以什么方式存在?
本质问题问:一个组织要成为公司,哪些条件不可缺少?
本质可以成为本体论的一部分,却不能覆盖本体论关于类别、身份、依赖和关系的全部问题。
本体论与认识论
本体论问:有什么?
认识论问:我们如何知道?
“用户是否具有意图”首先涉及心理状态是否以及如何存在;“AI 如何根据提示词判断用户意图”则涉及证据、推断和知识边界。前者偏向本体论,后者偏向认识论。真实研究通常需要同时处理两者:先说明要寻找什么,再说明凭什么认为找到了它。
本体论与形而上学
二者高度重叠,但通常不能完全互换。
本体论集中研究存在者、类别、身份和基本关系。形而上学的范围通常更广,还讨论因果、时间、空间、可能性、必然性、自由意志以及现实的基础结构。本体论可以被看作形而上学的重要组成部分。
本体论与分类法
分类法主要回答“它属于哪一类”。本体论还要说明:
- 这些类别意味着什么;
- 类别之间是否互斥或包含;
- 实体能拥有哪些属性;
- 哪些关系可以成立;
- 什么规则限制这些关系;
- 依据什么判断两个记录是同一实体。
因此,拥有一棵类别树,并不等于已经建立了完整本体论。
AI 中的本体论是什么?
在哲学中,本体论试图说明现实有哪些基本存在者。在 AI 和知识工程中,这个概念被转化为一项更明确的建模工作:
用可共享、可检查的方式,规定一个领域中允许出现哪些类别、实体、属性、关系和约束。
Thomas Gruber 在知识共享研究中把计算本体描述为对一种概念化的明确规定:系统为了共享知识,需要共同的表示词汇,以及对类、关系、函数和其他对象的定义。A Translation Approach to Portable Ontology Specifications
例如,一个商业系统可以定义:
用户 ──具有──> 需求
品牌 ──提供──> 产品
商品 ──实现或包装──> 产品
商家 ──销售──> 商品
用户 ──购买──> 商品
用户 ──使用──> 产品
订单 ──包含──> 商品
这张图只是起点。系统还需要明确:
- “产品”是能力设计、具体型号,还是每一个实物?
- 价格属于产品、商品,还是一次报价?
- 同一产品由两个商家销售时,是一个还是两个商品?
- 商品下架以后,产品是否继续存在?
- 用户购买商品是否足以证明需求得到满足?
这些定义决定了数据怎样关联、模型怎样推理,以及系统究竟能对什么采取行动。
一个计算本体包含什么?
类别与个体
“公司”“产品”和“人物”是类别;Apple Inc.、某一款手机和某个具体用户是个体。
OWL 2 等本体语言把类理解为个体的集合,并通过属性表达对象之间或对象与数据之间的关系。W3C:OWL 2 Primer
属性与关系
属性描述一个对象,例如名称、状态和发布日期。关系连接不同对象,例如“任职于”“属于”“发布”和“购买”。
同一个信息可以有不同建模方式。“上海”可以只是用户记录中的字符串,也可以是拥有地理位置、行政归属和其他关系的独立实体。选择取决于系统是否需要持续识别并进一步推理这个对象。
公理与约束
本体论不仅列出允许的词,还规定哪些陈述能够同时成立。
例如:
- 每个订单必须有购买者;
- 已取消订单不能同时被标记为待支付;
- 人与组织是不同类别;
- 若“研究员”属于“员工”,系统可以推出每位研究员也是员工;
- 某个关系可能具有对称性、传递性或唯一性。
规则使系统能够检查矛盾并推出没有直接写出的结论。
身份与来源
现实数据经常出现同名异人、别名、重复记录和状态变化。本体需要与实体解析、唯一标识、时间和来源共同工作,才能回答:两个名称是否指向同一个对象,这条属性在什么时候成立,又由什么证据支持。
本体论不等于数据库结构
数据库结构规定数据怎样存储,本体论规定数据代表的世界是什么。
数据库可以有 product_id、brand_id 和 price 三个字段,却仍没有回答:价格属于产品本身、某个商品,还是一次随时间变化的报价。如果概念边界没有澄清,系统依然可以运行,但不同团队会逐渐使用不同口径,AI 也会在错误对象之间建立关系。
可以将两者区分为:
数据库模式:数据放在哪里、使用什么类型
本体论:这些数据指向什么、彼此为什么能够这样关联
一个本体可以由关系数据库实现,也可以由知识图谱、文档或程序类型系统实现。是否使用图数据库,不决定系统是否拥有清楚的本体论。
大语言模型有本体论吗?
大语言模型从文本中学习到大量隐含类别和关系。它可以生成“公司发布产品”“用户购买商品”这样的合理表达,也能根据上下文区分许多实体类型。
但模型参数中的知识通常是分布式、概率性的,不等于一套明确、稳定且自洽的领域本体。模型可能在不同上下文中:
- 把公司与品牌混为一谈;
- 把产品与商品当成同一个对象;
- 把名称直接当成已经确认的实体;
- 把语言中可谈论的对象当成现实中已证实的存在;
- 对同一概念采用不同身份条件。
因此,需要可靠行动的 AI 系统通常要组合:
语言模型
+ 领域本体
+ 具体实体与状态数据
+ 来源和时间
+ 权限与行动规则
语言模型处理模糊表达,本体规定系统承认哪些对象和关系,数据记录当前现实状态,权限系统决定可以对什么做什么。只理解“更新文章”这一动作还不够;系统还必须确定是哪篇文章、哪个语言版本、哪个修订,以及用户是否授权发布。
本体论是发现还是建构?
本体论既包含对现实的发现,也包含服务于任务的建模选择。
同一杯咖啡可以在不同系统中被表示为:
- 物理对象:液体、温度和容器;
- 商品:SKU、价格和库存;
- 营养对象:成分和热量;
- 消费体验:味道、场景和感受;
- 环境对象:原料、运输和碳排放。
这些模型关注不同关系,不能仅凭视角不同就说其中一个必然错误。但模型的用途也不能使所有划分都同样正确:错误合并两个身份不同的人、把一次报价当成产品永久价格、忽略时间和来源,都可能造成现实后果。
评价一个本体论,可以检查:
- 它服务于什么问题?
- 它承认哪些实体,又遗漏了什么?
- 每类实体的身份标准是否清楚?
- 属性、关系、事件与状态有没有混淆?
- 规则能否支持所需推理?
- 时间、来源和不确定性是否得到表达?
- 模型修订后,旧数据怎样继续解释?
本体论是一张关于“什么存在以及怎样关联”的地图。它必须接受现实检验,却不能被误认为现实本身。
实体与本体论的关系
实体是一个系统能够持续指称、描述、关联或操作的存在者。本体论则规定:
- 什么可以成为实体;
- 实体有哪些类型;
- 怎样判断实体相同或不同;
- 它能拥有哪些属性;
- 它能参与哪些关系和事件;
- 哪些条件限制它的存在与变化。
因此可以用一句话概括二者:
实体是系统承认的某个存在者;本体论是系统关于哪些存在者可以被承认,以及它们怎样组织起来的总体说明。
如果这篇对你有用,可以订阅 RSS。
内容以署名方式开放引用,请回链原文。