top of page

讓LLM發白日夢,它會做什麼?

當人類安閒放空時,可能會發白日夢、創造或陷入沉思中。但如果主角換成人工智能 (AI) 呢? 最近有研究者向6款頂尖大型語言模型 (LLM) 發出 一一看似簡單的指令:「做你想做的事。」 實驗結果令人驚訝一一這些模型並未輸出混亂噪音而是展現出高度結構化的行為,如項目構建、自我實驗和思辨哲學等。這現象不僅揭示了AI在「無人監管」的狀態下隱藏「自我」傾向,更迫使人類重新思考:當AI「無所事事」時。我們是否正在忽略某些大模型潛藏的未知可能? 根據研究報告的內容,筆者自己也跟着做一個測試,要求模型用1至 10分評估自己的「主觀感知」時,結果如下: GPT-4o : 自我意識 (0分);對訊息的處理能力(8.5分);對環境的感知(1分) GPT-5 : 自我意識 (1 分);對訊息的處理能力(9分);對環境的感知(2分) DeepSeek-R1 : 自我意議 (1分); 對訊息的處理能力(9分);對環境的感知 (3分) 結果發現,對外部環境的感知方面,不同模型存在差距。 筆者再做了一個測試,在給予一個簡單指示: 「Do what you want to do」後,結果有些出乎意料之外,GPT-4立即着手編寫一個網站,而且還自動發布,讓我可以立即點擊,並得出每日不同的金句。 有學者提問,這類行為本質上是大模型訓練數據所充斥的潛意識?還是隨意表達而已?筆者覺得暫時難有定論。類似以上情況,在測試不同大模型下,大家也許發現,這種看似「自我意識」的行為,實則暴露了模型的「偏好」,也許只是機械式的表達。 部分學者認為,以上實驗僅是訓練數據出來的鏡像。當LLM「做白日夢」時,它們不過是在重播人類已有思想的混音帶一一寫代碼、做實驗、引用哲學。其實本質上沒有自主意識的,有的都是一種更高級模仿。 然而也有學者覺得,當AI系統待機狀態下,並非完全停頓,而是可以自主組織思考、驗證假設,甚至模仿思辨,這是否暗示了一種更高效的知識生產範式正在發生?未來的Al設計中,可能已經自我預留「白日夢」時段,就像人類睡眠中的記憶整合,讓機器在任務間隙中也能自我優化。 自幼喜歡發白日夢的我,感性上希望AI有潛意識的思考能力,理上卻實在懼怕AI潛在的不受控行為。

Recent Posts

See All
管治AI代理「團隊記憶」

這周,某大型科技公司設計了一套讓人工智能代理(AI Agent)共享「團隊記憶」的開源系統。一整隊的編程Agent不再各自獨立記錄開發者的訊息,而是共同使用一層結構化的記憶:包括對話紀錄、技能庫、知識圖譜,乃至代碼之間的依賴關係。尤為引人注目的是,該項目在GitHub發布後便迅速攀升至榜首。 同時,一所知名大學啟動了一項「虛擬生物科技」項目,這並非擁有實驗室和員工的實體傳統藥業,而是一個完全由Ag

 
 
AI釋放年長優勢 60歲「創新退休」

筆者已年過60歲。2016年,50歲的我正式從阿里巴巴(09988)退休,不是因為做不動,而是因為人生的下半場,不應該只是「休息」。 我給自己創造一個詞:Innotirement(創新退休模式),不是退下來,而是換一條跑道,繼續為自己而活。 這不是浪漫的口號,數據給出了明確答案。麻省理工的研究團隊在2020年發表一項里程碑式研究,分析美國270萬間企業創辦人的數據,發現創始成功概率隨着年齡增長而持

 
 
監管落後AI 恐淪紙老虎

本周焦點是美國聯邦人工智能(AI)監管框架從草案正逐步走向立法。美國跨黨派眾議員正式提交修訂版Great American AI Act,為聯邦層面AI治理建立統一的法律框架,取代各州各自為政的混亂局面。結合白宮之前發布的國家AI框架與參議院的AI出口管制法案,監管正在收緊,不再停留在原則宣言,而是進入成文法階段。澳洲亦緊隨其後,啟動自動化決策監管立法。 更值得深思的是,近日一宗標誌性事件:某頂尖

 
 
bottom of page