关于判别模型的输出空间的问题

于老师,我想向您请教一个关于判别模型的输出空间的问题。一般来说对于任意现象,判别模型的输出空间都是{此概念,非此概念}两种类别的集合,你说实际应用中还有输出有两个以上类别的判别模型称为 多类判别模型,对于“多类判别模型”能举一个具体实际的例子吗?对于任意现象,不是要么为A 要么为非A吗,为啥还有第三种及以上的类别?

1 个赞

1、多类判别模型的例子
例如,输出空间是 {儿童青年、中年、老年},四类。

2、对于任意现象,不是要么为A 要么为非A吗,为啥还有第三种及以上的类别?
要么A,要么非A,是针对「某现象是否是概念A」而言的,就这两个结果,不会是,既是A又不是A。比如,不会既是苹果,又不是苹果。

3、二类判别模型和多类判别模型的关系
多个二类判别模型,可以组合成一个多类判别模型,在效果上等价。

例如,你可以用下面4个「二类判别模型」来实现第一问中的「四类判别模型」的效果:

{儿童,非儿童}
{青年,非青年}
{中年,非中年}
{老年,非老年}

拿这四个模型,连续综合判断,在逻辑上能达到多类判别模型的效果。

(帖子已被作者删除)

二类判别模型 :要么A,要么非A,是针对「某现象是否是概念A」而言的,就这两个结果;那么多类判别模型 是针对什么情况的呢?如果连适用范围都不同,是否应该说明适用范围?而且书中前面也说过 当一个模型被用来从全集中 划分正概念和负概念时,就被我们归为判别模型。你说的 多类判别模型 输出空间不是正负概念,而是 {儿童青年、中年、老年}, 那我觉得这种情况 此模型应该属于其他类型的模型,而非判别模型了。因为此 多类判别模型的性质和用途似乎和判别模型相差甚远,没必要和判别模型硬放一起

{儿童、青年、中年、老年}这里输出空间似乎是在讨论一个概念:人所处年龄阶段,那么对于 儿童,青年,猴子,猫,伞…逐个判别得出{人所处年龄阶段,非人所处年龄阶段},也不会是{儿童、青年、中年、老年}4类,也就是您举的例子,只说了输出空间是{儿童、青年、中年、老年},那么该判别模型是在抽象类化什么概念呢?如果是儿童、青年、中年、老年4个正概念,那就老老实实说 有4个正概念共8个概念需要一个个去判别就行了。这里涉及到概念边界和必要性的讨论了,不知道于老师 保留 多类判别模型 这个概念,是不是为了某个命题或者特殊情形埋下伏笔?

1、「判别模型」是用来干什么的?

「判别模型」是用来给「某现象」归「类」的,然后采用「这个类」的对待方式,去对待该「现象」。

例如,你遇到了一个「东西a(现象)」,你不知道该怎么对待它。这时候,你就需要归类,而归类就要用到「判别模型」:

  • 你给它归类到「食物」,那你就会按照「对待食物的方式」对待「东西a」。为了能归类,你需要有「食物的判别模型」,去判断「东西a」属于「事物」还是「非食物」。
  • 你也可以给他归类到「玩具」,那你就会按照「对待玩具的方式」对待它。
  • 同理,你可以归到「收藏品」「工艺品」「易碎品」等各种「类别」中去。

那为了能归类,你必须有这些类别的判别模型。

你可以用二类判别模型一个个去判别,也可以用一个多类判别模型来一起判别,效果是一致的。

是否属于判别模型,就看这个模型是不是在归类

2、当输出空间都是 {儿童、青年、中年、老年} 时,如何区分判别模型和联结模型

如果是判别模型,则目的是为了给「某现象」归类,然后选择对待「这个现象」的应对方式。

比如,你用判别模型给「某人」被归为了「老年」,于是你给让座(一种应对方式)。

此时,判别模型的输入空间是{所有现象},输出空间是{儿童、青年、中年、老年}。

但如果是联结模型,则目的就不是为了给「某现象」归类来选择应对方式。

比如,你用根据「该人的外貌特征」来推测「该人的年龄段」。这就是一个联结模型。

此时,联结模型的输入空间是{各式各样的外貌特征},输出空间是{儿童、青年、中年、老年}

余老师,感谢您细致的解答,还有两处核心疑问想继续向您请教:

1. 书本最初定义判别模型,是依附于单一概念:针对某一个概念,划分【概念A / 非概念A】。而您举例“将现象归类为食物、玩具、收藏品”,此时讨论主体已经发生偏移:不再是围绕单个概念建立判别规则,转而讨论「任意现象可以匹配多个不同概念」。这是否意味着,多类判别模型在定义上悄悄更换了讨论主语?原本判别模型的载体是【概念】,现在切换成了【独立现象】,二者讨论基底不一致,这里该如何理解?

2. 按照书中设定,判别模型的原生输出空间,是单一概念对应的二元集合{ A,非A }。{儿童、青年、中年、老年}属于多个并列独立概念,不存在单一概念的正负二分。如果判别模型的判定标准从「结构上的二元划分」修改为「功能上只要实现归类就是判别模型」,那么最初提出的“A/非A二元判别模型”,是否只能算作判别模型里面的特例?如果二元判别模型只是特例,书中开篇以“单一概念二分”作为判别模型基础定义,是否需要重新界定?

3. 多类判别模型无法还原为“单一概念的正/负划分”,从形式结构上和基础二元判别模型存在明显差异。理论上将二者归入同一个大类,主要的理论收益是什么?保留“多类判别模型”这个术语,是否是为后续理论命题埋下伏笔?

4. 您区分判别模型与联结模型时提到:同样是输入映射到{儿童、青年、中年、老年}这个输出空间。输入全部现象用来归类决策,属于判别模型;输入外貌特征推测年龄段,则属于联结模型。

两种情况客观映射结构完全一致,仅仅依靠使用者主观目标、用途来划分模型类型。同一个映射结构,能否因为人的意图不同,被划分成两种完全不同的模型?这套划分标准是否会缺少客观边界?

5. 按照您的区分逻辑,当一个现象可以归类到食物、玩具、收藏品等多个类别时,本质是同时启用多个独立概念的二元判别模型。那我们是否可以认为:不存在真正原生的多类判别模型,所谓多类判别模型仅仅是多个二元判别模型的组合封装?

以上困惑是顺着书中定义推导产生的疑问,希望厘清术语边界,更好理解整套理论,期待您的解惑。

1、多类判别模型的主体是否发生变化?

没有。主体始终是类别(概念)。「二类判别模型」的主体是两个类别(概念),「多类判别模型」的主体是多个类别(概念),并非“独立现象”,现象是归类之前的东西。概念是归类之后的东西。

2、二类是否是特例?是否要重新定义判别模型?

并非每次分类都需要多个类别,不应该把多个类别作为基础的定义。

之所以以二类分类开始讲判别模型,是因为它是「最小分类」「最基础的分类」,只要进行分类,所能形成的类别数量,最少就是两个。我们每学习一个「概念A」,都至少会同时学习「A的负概念」,往脑中增加两个概念。

只要哪怕你进行多类分类,你也应该具备多个二类分类的能力:

例如:你建了{儿童、青年、中年、老年}的四类判别模型,不是说这就完了。你应该同时具有四个独立二类判别模型的分类能力:

  • 区分儿童和非儿童
  • 区分青年和非青年
  • 区分中年和非中年
  • 区分老年和非老年

二类判别模型的地位,是无法被多类判别模型所替代的。

3、「多类判别模型」和多个「二类判别模型」,在逻辑上可等价。

例如,来了一个「现象a」,你先归类非儿童,然后归类非少年,然后归类为中年,然后归类为非老年。你最后得到的类别,和四类判别模型的结果一致。

4、凭主观用途区分模型,是否缺少“客观”?

这个问题问得好。你的这个想法,是最典型的误区——认为我们的分类,要基于某个先天存在的客观标准。在书的第9章里,详细解释了这种误区的起因和缺点。

判别模型和联结模型,二者本来都是模型。意味着,二者在模型上,就是映射结构完全相同的。

我们对这两个模型的分类标准,就是「用途」。

举个例子、一片大叶子、被我们用于盛菜时,是盘子;被我们用于扇风时,是扇子;被我们盖身上保暖时,是被子。

你认为主观用途不客观的这种执念,不是三言两语能打消掉的,最起码得看到书的第12章。

5、不存在真正的多类判别模型?

也不是。「多个二类判别模型」和「一个多类判别模型」在逻辑上可以等价,但在技术实现上的建模代价和应用效果并不一样。在人工智能那边,会加以区分。

但为何这本书里没有额外介绍多类判别模型呢?

因为我们采用不了人工智能那边的技术实现方式。我们只要能够描述「目标」,知道我们需要一种什么能力的模型即可。至于这么模型在我们脑中如何实现的,我们不知道。同时为了减少概念的数量,书里就没再介绍多类判别模型,而是只讲了在逻辑上,既能实现基础目标,又能通过组合来形成多分类目标的「二类判别模型」。

(帖子已被作者删除)

感谢于老师耐心完整的回复!