本体论:存在者、分类与 AI 领域模型

本体论研究什么存在、存在者有哪些基本类别、如何保持身份并彼此关联;AI 则把这些承诺写成可计算的领域模型。

本体论研究什么?

本体论研究的是:

世界中有什么,这些存在者属于哪些基本类别、以什么方式存在、怎样保持身份,又彼此具有什么关系。

它最著名的问题是“有什么存在?”但列出存在者只是开始。完整的本体论还要说明:人、物体、事件、属性、关系、数字、公司和意图是不是同一种存在;一个东西发生变化后为何仍是同一个东西;某些存在能否独立成立,还是必须依赖物质、制度或人的共同承认。

例如,一块石头和一家公司都可以被说成存在。石头主要以物理结构持续存在,公司则依赖法律登记、组织规则、合同、人员和社会承认。二者都能成为实体,却拥有不同的存在条件与身份标准。

因此,本体论不是给所有事物寻找一种共同材料,而是研究现实中可以承认哪些存在者,以及它们构成怎样的总体结构。

“本体论”这个名称从哪里来?

英文 ontology 由表示“存在者”的希腊语词根 on、ontos 与表示研究或论述的 logos 构成,可以直译为“关于存在者的研究”。这个术语作为学科名称形成于近代欧洲,并不是古希腊已经固定使用的现代学科标签。Stanford Encyclopedia of Philosophy:Metaphysics

中文把它译为“本体论”,容易产生两个误解。

第一,它不只研究藏在现象背后的“终极本体”。现代本体论也研究普通对象、事件、属性、关系、社会制度、抽象对象与身份条件。

第二,它不只是寻找事物的“本质”。本质问题追问一个东西成为该种东西必须具有什么;本体论的范围更大,还要追问这种东西是否存在、如何存在,以及它与其他存在者是什么关系。

“存在论”有时更能直接呈现 ontology 的问题意识,但现代汉语学术表达通常仍使用“本体论”。理解这个词时,重点应放在“存在者及其结构”,而不是把“本体”预先理解成唯一、隐藏而不变的根基。

本体论包含哪些问题?

什么存在?

最直接的本体论工作,是说明一种理论承认哪些存在者。

有些理论只承认物理对象是基础存在,数字、价值或社会组织只是描述物理世界的方式。另一些理论认为,数字、属性、制度或心理状态也具有不能被简单消去的存在地位。

一套理论谈到电子、基因、意识、市场或者概率时,不只是使用几个名词,也承担了相应的存在承诺:它把这些对象当作解释世界时不可缺少的单位。现代哲学因此会把本体论理解为对“有什么”及其存在承诺的研究。Stanford Encyclopedia of Philosophy:Logic and Ontology

存在者有哪些基本类别?

本体论还要区分不同种类的存在:

类别例子核心问题
具体对象人、树、手机它的空间边界和身份如何确定?
抽象对象数字、集合、几何结构它是否依赖人的思想或符号?
属性红、重量、能力属性能否脱离具有它的对象而存在?
关系属于、相似、因果关系只是描述,还是现实结构的一部分?
事件一次会议、一次购买事件由时间、参与者还是变化来识别?
过程生长、学习、演化持续变化怎样构成同一个过程?
心理状态信念、欲望、意图它与身体、行为和意识有什么关系?
制度实体公司、货币、国家它怎样依赖规则与共同承认?

这些类别不是一张已经得到所有哲学家同意的最终清单。争论恰恰在于:类别是现实自身的分界,还是人的认知与语言为了处理现实作出的划分?

它们以什么方式存在?

不同存在者可能拥有不同的存在方式。

  • 物理对象依赖物质结构;
  • 生物依赖生命过程;
  • 公司依赖法律和制度;
  • 货币依赖集体承认及支付体系;
  • 一段软件依赖代码、运行环境和实例化过程;
  • 一个虚构人物可以存在于作品和讨论中,却不因此成为现实中的历史人物。

所以,“能被指称”“被模型表示”和“在现实中存在”是三个不同判断。福尔摩斯可以是文学和知识库中的实体,但这不能证明现实中存在一位对应的侦探。

什么使它保持为同一个东西?

本体论还研究同一性条件:什么变化不会使一个对象变成另一个对象?

  • 人改名后通常仍是同一个人;
  • 公司更换员工后,法律身份可能继续存在;
  • 文章修改正文后,可能仍由同一条版本历史维持身份;
  • 商品更换包装后,是否还是同一 SKU,要看交易系统的规则;
  • AI 模型更新参数后,是同一个产品版本,还是一个新模型,要看讨论采用的身份标准。

不同种类的实体需要不同的同一性规则。只有名称相同,不能证明两个记录代表同一个实体;属性发生变化,也不必然意味着旧实体已经消失。

它们怎样相互依赖?

本体论不只列清单,还研究依赖结构。

一次购买依赖购买者、交易对象、时间和交易关系。一家公司依赖制度,却不能被简单等同于任何一个员工。一种颜色可能依赖某个具有颜色的对象,也可能被理论当作可重复实例化的抽象属性。

这种问题关心的不是普通因果顺序,而是:如果支撑条件不存在,这种存在者还能否以原来的方式成立?

本体论与相邻概念有什么区别?

本体论与本质

本体论问:公司这种存在者是否存在,以什么方式存在?

本质问题问:一个组织要成为公司,哪些条件不可缺少?

本质可以成为本体论的一部分,却不能覆盖本体论关于类别、身份、依赖和关系的全部问题。

本体论与认识论

本体论问:有什么?

认识论问:我们如何知道?

“用户是否具有意图”首先涉及心理状态是否以及如何存在;“AI 如何根据提示词判断用户意图”则涉及证据、推断和知识边界。前者偏向本体论,后者偏向认识论。真实研究通常需要同时处理两者:先说明要寻找什么,再说明凭什么认为找到了它。

本体论与形而上学

二者高度重叠,但通常不能完全互换。

本体论集中研究存在者、类别、身份和基本关系。形而上学的范围通常更广,还讨论因果、时间、空间、可能性、必然性、自由意志以及现实的基础结构。本体论可以被看作形而上学的重要组成部分。

本体论与分类法

分类法主要回答“它属于哪一类”。本体论还要说明:

  • 这些类别意味着什么;
  • 类别之间是否互斥或包含;
  • 实体能拥有哪些属性;
  • 哪些关系可以成立;
  • 什么规则限制这些关系;
  • 依据什么判断两个记录是同一实体。

因此,拥有一棵类别树,并不等于已经建立了完整本体论。

AI 中的本体论是什么?

在哲学中,本体论试图说明现实有哪些基本存在者。在 AI 和知识工程中,这个概念被转化为一项更明确的建模工作:

用可共享、可检查的方式,规定一个领域中允许出现哪些类别、实体、属性、关系和约束。

Thomas Gruber 在知识共享研究中把计算本体描述为对一种概念化的明确规定:系统为了共享知识,需要共同的表示词汇,以及对类、关系、函数和其他对象的定义。A Translation Approach to Portable Ontology Specifications

例如,一个商业系统可以定义:

用户 ──具有──> 需求
品牌 ──提供──> 产品
商品 ──实现或包装──> 产品
商家 ──销售──> 商品
用户 ──购买──> 商品
用户 ──使用──> 产品
订单 ──包含──> 商品

这张图只是起点。系统还需要明确:

  • “产品”是能力设计、具体型号,还是每一个实物?
  • 价格属于产品、商品,还是一次报价?
  • 同一产品由两个商家销售时,是一个还是两个商品?
  • 商品下架以后,产品是否继续存在?
  • 用户购买商品是否足以证明需求得到满足?

这些定义决定了数据怎样关联、模型怎样推理,以及系统究竟能对什么采取行动。

一个计算本体包含什么?

类别与个体

“公司”“产品”和“人物”是类别;Apple Inc.、某一款手机和某个具体用户是个体。

OWL 2 等本体语言把类理解为个体的集合,并通过属性表达对象之间或对象与数据之间的关系。W3C:OWL 2 Primer

属性与关系

属性描述一个对象,例如名称、状态和发布日期。关系连接不同对象,例如“任职于”“属于”“发布”和“购买”。

同一个信息可以有不同建模方式。“上海”可以只是用户记录中的字符串,也可以是拥有地理位置、行政归属和其他关系的独立实体。选择取决于系统是否需要持续识别并进一步推理这个对象。

公理与约束

本体论不仅列出允许的词,还规定哪些陈述能够同时成立。

例如:

  • 每个订单必须有购买者;
  • 已取消订单不能同时被标记为待支付;
  • 人与组织是不同类别;
  • 若“研究员”属于“员工”,系统可以推出每位研究员也是员工;
  • 某个关系可能具有对称性、传递性或唯一性。

规则使系统能够检查矛盾并推出没有直接写出的结论。

身份与来源

现实数据经常出现同名异人、别名、重复记录和状态变化。本体需要与实体解析、唯一标识、时间和来源共同工作,才能回答:两个名称是否指向同一个对象,这条属性在什么时候成立,又由什么证据支持。

本体论不等于数据库结构

数据库结构规定数据怎样存储,本体论规定数据代表的世界是什么。

数据库可以有 product_id、brand_id 和 price 三个字段,却仍没有回答:价格属于产品本身、某个商品,还是一次随时间变化的报价。如果概念边界没有澄清,系统依然可以运行,但不同团队会逐渐使用不同口径,AI 也会在错误对象之间建立关系。

可以将两者区分为:

数据库模式:数据放在哪里、使用什么类型
本体论:这些数据指向什么、彼此为什么能够这样关联

一个本体可以由关系数据库实现,也可以由知识图谱、文档或程序类型系统实现。是否使用图数据库,不决定系统是否拥有清楚的本体论。

大语言模型有本体论吗?

大语言模型从文本中学习到大量隐含类别和关系。它可以生成“公司发布产品”“用户购买商品”这样的合理表达,也能根据上下文区分许多实体类型。

但模型参数中的知识通常是分布式、概率性的,不等于一套明确、稳定且自洽的领域本体。模型可能在不同上下文中:

  • 把公司与品牌混为一谈;
  • 把产品与商品当成同一个对象;
  • 把名称直接当成已经确认的实体;
  • 把语言中可谈论的对象当成现实中已证实的存在;
  • 对同一概念采用不同身份条件。

因此,需要可靠行动的 AI 系统通常要组合:

语言模型
+ 领域本体
+ 具体实体与状态数据
+ 来源和时间
+ 权限与行动规则

语言模型处理模糊表达,本体规定系统承认哪些对象和关系,数据记录当前现实状态,权限系统决定可以对什么做什么。只理解“更新文章”这一动作还不够;系统还必须确定是哪篇文章、哪个语言版本、哪个修订,以及用户是否授权发布。

本体论是发现还是建构?

本体论既包含对现实的发现,也包含服务于任务的建模选择。

同一杯咖啡可以在不同系统中被表示为:

  • 物理对象:液体、温度和容器;
  • 商品:SKU、价格和库存;
  • 营养对象:成分和热量;
  • 消费体验:味道、场景和感受;
  • 环境对象:原料、运输和碳排放。

这些模型关注不同关系,不能仅凭视角不同就说其中一个必然错误。但模型的用途也不能使所有划分都同样正确:错误合并两个身份不同的人、把一次报价当成产品永久价格、忽略时间和来源,都可能造成现实后果。

评价一个本体论,可以检查:

  1. 它服务于什么问题?
  2. 它承认哪些实体,又遗漏了什么?
  3. 每类实体的身份标准是否清楚?
  4. 属性、关系、事件与状态有没有混淆?
  5. 规则能否支持所需推理?
  6. 时间、来源和不确定性是否得到表达?
  7. 模型修订后,旧数据怎样继续解释?

本体论是一张关于“什么存在以及怎样关联”的地图。它必须接受现实检验,却不能被误认为现实本身。

实体与本体论的关系

实体是一个系统能够持续指称、描述、关联或操作的存在者。本体论则规定:

  • 什么可以成为实体;
  • 实体有哪些类型;
  • 怎样判断实体相同或不同;
  • 它能拥有哪些属性;
  • 它能参与哪些关系和事件;
  • 哪些条件限制它的存在与变化。

因此可以用一句话概括二者:

实体是系统承认的某个存在者;本体论是系统关于哪些存在者可以被承认,以及它们怎样组织起来的总体说明。

如果这篇对你有用,可以订阅 RSS。

内容以署名方式开放引用,请回链原文。