GenAI如何運作?一文拆解AI「思考」方式 與人類有何分別?|教研並進

更新時間:16:30 2026-08-22 HKT
發佈時間:16:30 2026-08-22 HKT

人類與生成式人工智能(GenAI)有着截然不同的運作方式。筆者的研究團隊曾運用GenAI分析5萬則網上帖文,成功偵測其中的假資訊。這個研究告訴我們,若能理解GenAI的運作機制,便可有效引導它辨別真偽。根據這個研究,我們發現可將字詞、文本和語言類別想像為空間中的「物件」,而GenAI則在此空間中穿梭以生成回應。由於AI本質上是在數據地圖中尋找路徑,我們的指令須明確指出其角色定位,才可將AI引導至正確的專業領域。

創作之別

以繪製婚禮場景為例,人類畫家不僅要捕捉畫面,還會注入自身記憶,為作品增添社會現實感。社會規範、習俗、贊助者與競爭對手的期望,共同形塑了畫家的創作。

GenAI同樣運用影像、聲音和文化資訊生成作品,但它的訓練數據在藝術、建築、宗教與儀式等面向的覆蓋範圍,往往超出人類界限。GenAI的作品也能形塑持份者的社會現實,即使GenAI沒有信仰或經濟考量,其數據往往隱含了人類的價值觀。因此,GenAI能否將這些資訊整合為對人類有益的道德回應,仍是關鍵課題。因此,在AI能夠完善處理這些價值觀之前,人類必須提供明確的目的與道德指標。

延伸閱讀:告別「臭河」!火炭明渠起死回生 學生考察了解生態奧秘|教研並進

AI思維地圖

要理解GenAI的運作,須觀察它如何組織數據。以「狗舔男孩」(dog licks boy)為例,每個詞都是空間維度上的一點:「狗」對應肉食動物類別,「舔」代表觸覺/動作,「男孩」則是人類。這三個詞相互連結,形成一條「路徑」。

詞與詞之間的相鄰關係會影響語義。例如bank在「銀行櫃員」(bank teller)和「河岸」(river bank)中的意義截然不同。根據2017年的研究《Attention Is All You Need》,模型加入了能令相關詞彙互相「吸引」的「磁鐵效應」,調整了詞彙之間的關係,形成「磁化路徑」。

當我們要求GenAI創作故事時,它就會利用路徑的「慣性」,以機率逐字挑選下一個詞。例如,「狗舔男孩」正是電影《沙地傳奇》(The Sandlot)劇本路徑的情節核心與中心點。精確的提示能收窄這條路徑,確保AI的產出符合預期。

延伸閱讀:香港應如何吸引全球博士研究生?即睇過來人有甚麼建議!|教研並進

提防虛假 引導輸出

所謂「意義」,就是一段句子或電影在空間中所佔據的位置。因此,若從數據中刪除兒童色情等不當內容,等同於在空間裏留下一個「空洞」。

除了內容,我們還須檢視GenAI產出的真確性。假設存在一個由事實(如2 + 2 = 4)組成的空間。若訓練數據充斥着謊言、誇大或失實,這些「錯誤資訊磁鐵」便會將事實拉離原位,導致語義扭曲。筆者的團隊進行偵測假資訊的研究時,發現真實資訊的路徑通常穩定且集中,而假資訊則會產生異常的偏移。因此,GenAI需要大量且高品質的數據來對抗這些「錯誤資訊磁鐵」。使用者則要提防那些看似真實的「幻覺」,僅利用AI梳理結構及分析,再真人驗證事實。

與人類不同,GenAI並不具備推理能力,其答案往往難以解釋。要注意的是,人類訓練數據有瑕疵的話,GenAI的產出亦有缺憾。如果將這些錯誤產出再餵回訓練流程,錯誤將會倍增,形成吞噬一切的黑洞,造成「模型崩潰」(model collapse)。為了防止這種情況,部分公司已不再將GenAI生成的內容納入後續訓練數據中。

此外,若無明確禁忌,GenAI可以展現極致創意,也可能產出惡劣內容。因此,研發公司必須建立防護欄。為了確保AI真正符合人類需求,我們必須明確指定其角色與目的。例如:「你是一位專業物理老師。請向15歲學生解釋黑洞。」透過賦予身份與目的,我們才能引導AI的路徑,真正為人類提供所需的服務。

撰文:香港教育大學數據分析及評估研究中心、數據分析及多元教育講座教授趙明明、數據科學家Alex Morakhovski、項目主任黃信盈及行政主任林思明

本欄歡迎院校學者投稿,分享個人學術見解及研究成果,1400字為限,查詢及投稿請電郵︰[email protected]

本文標題原為〈火炭明渠起死回生——透過場域為本的修復科學教育〉。

誠邀大家做問卷調查,話俾我哋知你對《星島教育》有咩意見!連結:>>按此<<