GenAI如何运作?一文拆解AI「思考」方式 与人类有何分别?|教研并进
发布时间:16:30 2026-08-22 HKT
人类与生成式人工智能(GenAI)有着截然不同的运作方式。笔者的研究团队曾运用GenAI分析5万则网上帖文,成功侦测其中的假资讯。这个研究告诉我们,若能理解GenAI的运作机制,便可有效引导它辨别真伪。根据这个研究,我们发现可将字词、文本和语言类别想像为空间中的「物件」,而GenAI则在此空间中穿梭以生成回应。由于AI本质上是在数据地图中寻找路径,我们的指令须明确指出其角色定位,才可将AI引导至正确的专业领域。
创作之别

以绘制婚礼场景为例,人类画家不仅要捕捉画面,还会注入自身记忆,为作品增添社会现实感。社会规范、习俗、赞助者与竞争对手的期望,共同形塑了画家的创作。
GenAI同样运用影像、声音和文化资讯生成作品,但它的训练数据在艺术、建筑、宗教与仪式等面向的覆盖范围,往往超出人类界限。GenAI的作品也能形塑持份者的社会现实,即使GenAI没有信仰或经济考量,其数据往往隐含了人类的价值观。因此,GenAI能否将这些资讯整合为对人类有益的道德回应,仍是关键课题。因此,在AI能够完善处理这些价值观之前,人类必须提供明确的目的与道德指标。
延伸阅读:告别「臭河」!火炭明渠起死回生 学生考察了解生态奥秘|教研并进
AI思维地图
要理解GenAI的运作,须观察它如何组织数据。以「狗舔男孩」(dog licks boy)为例,每个词都是空间维度上的一点:「狗」对应肉食动物类别,「舔」代表触觉/动作,「男孩」则是人类。这三个词相互连结,形成一条「路径」。
词与词之间的相邻关系会影响语义。例如bank在「银行柜员」(bank teller)和「河岸」(river bank)中的意义截然不同。根据2017年的研究《Attention Is All You Need》,模型加入了能令相关词汇互相「吸引」的「磁铁效应」,调整了词汇之间的关系,形成「磁化路径」。
当我们要求GenAI创作故事时,它就会利用路径的「惯性」,以机率逐字挑选下一个词。例如,「狗舔男孩」正是电影《沙地传奇》(The Sandlot)剧本路径的情节核心与中心点。精确的提示能收窄这条路径,确保AI的产出符合预期。
延伸阅读:香港应如何吸引全球博士研究生?即睇过来人有甚么建议!|教研并进
提防虚假 引导输出
所谓「意义」,就是一段句子或电影在空间中所占据的位置。因此,若从数据中删除儿童色情等不当内容,等同于在空间里留下一个「空洞」。
除了内容,我们还须检视GenAI产出的真确性。假设存在一个由事实(如2 + 2 = 4)组成的空间。若训练数据充斥着谎言、夸大或失实,这些「错误资讯磁铁」便会将事实拉离原位,导致语义扭曲。笔者的团队进行侦测假资讯的研究时,发现真实资讯的路径通常稳定且集中,而假资讯则会产生异常的偏移。因此,GenAI需要大量且高品质的数据来对抗这些「错误资讯磁铁」。使用者则要提防那些看似真实的「幻觉」,仅利用AI梳理结构及分析,再真人验证事实。
与人类不同,GenAI并不具备推理能力,其答案往往难以解释。要注意的是,人类训练数据有瑕疵的话,GenAI的产出亦有缺憾。如果将这些错误产出再喂回训练流程,错误将会倍增,形成吞噬一切的黑洞,造成「模型崩溃」(model collapse)。为了防止这种情况,部分公司已不再将GenAI生成的内容纳入后续训练数据中。
此外,若无明确禁忌,GenAI可以展现极致创意,也可能产出恶劣内容。因此,研发公司必须建立防护栏。为了确保AI真正符合人类需求,我们必须明确指定其角色与目的。例如:「你是一位专业物理老师。请向15岁学生解释黑洞。」透过赋予身份与目的,我们才能引导AI的路径,真正为人类提供所需的服务。
撰文:香港教育大学数据分析及评估研究中心、数据分析及多元教育讲座教授赵明明、数据科学家Alex Morakhovski、项目主任黄信盈及行政主任林思明
本栏欢迎院校学者投稿,分享个人学术见解及研究成果,1400字为限,查询及投稿请电邮︰[email protected]。
本文标题原为〈火炭明渠起死回生——透过场域为本的修复科学教育〉。
诚邀大家做问卷调查,话俾我哋知你对《星岛教育》有咩意见!连结:>>按此<<

















