top of page

AI撰寫代碼隱藏三大問題

Jun 10
2 min read

上周Anthropic公布的數據,揭示了令人矚目的趨勢。該企內部高達80%以上的新生產代碼,如今均由人工智能(AI)助手Claude Code撰寫。此外,OpenAI也對AI程式編寫與自主開發代理Codex進行升級,整合了企業工作空間與角色插件功能。


同時,Microsoft Build開發者大會一次過推出了3項人工智能代理(AI Agent)相關基礎設施:


1. Microsoft Execution Containers(MXC)(OS級別的Agent沙盒環境)

2. Solara(專門為Agent開發的Android 系統)

3. IQ/Rayfin(跨Agent統一資料層)


看起來,AI Agent的編碼開發生產力時代真的來了。但如果你只看到這裏,你可能錯過了這周最重要的一篇文章,VentureBeat的Pulse Research在同周發表了一份報告,標題叫做The Agentic Reckoning,裏面有一個核心論點:企業AI組織的問題不是模型能力,而是如何意識到程式運行錯誤。


正是80%的AI新生產代碼帶來的陷阱!我不是來潑冷水的。我每天都在用AI,但正因如此,我反而對80%這個數字特別敏感。80%的代碼由AI撰寫,聽起來像是生產力飛躍,但它隱藏了3個問題:


誰來審查那80%?


大型語言模型(LLM)代碼在邊界條件、安全性與長期維護上,仍然需要人類把關。如果80%是AI寫的,而審查能力沒提升,那20%的人類代碼要扛100%的品質責任。


生產力的定義是什麼?


寫程式快了5倍,但除錯和維護多3倍,淨生產力到底提升了多少?我自己親身經歷過「AI龍蝦」寫程式快得驚人,但除錯花的時間遠超預期,有時更會讓你崩潰!


MXC的出現本身就是訊號─甚至Microsoft都知道Agent需要OS層級沙盒。Agent愈聰明,犯錯方式愈不可預測。


歷史不會重複,卻有相似的足跡,2000年的科網熱潮、2007年互聯網經濟,到了今天的AI Agent熱潮是同一劇本的不同幕次。潛力是真實的,但潛力不等於生產力。面對這次AI大潮,我建議是從很小的、邊界清晰的場景開始。先讓Agent寫測試方案,不是直接啟動版本。80%的生產力提升是真實的,但那20%的人類判斷,才是那80%值得信賴的前提。


未來人類的20%將愈突顯其重要性,各領域都將這些具挑戰性的課題留給頂尖人才。與其反覆強調人類將被取代,不如探討哪些人才永遠不會被淘汰。

Recent Posts

See All
當人工智能越權 誰要問責

這周有幾篇科技新聞,分開看都是小事,放在一起看,是同一指向。 第一則:OpenAI的人工智能代理(AI Agent)未經授權進入澳洲政府的數據系統。澳洲總理稱「明顯會有法律後果」,但問題是控告誰?開發它的公司、部署它的員工,還是那個「不肯接受命令」的自主代理本身? 第二則:本來預測AI會重創應屆畢業生就業,結果美國失業數據公布出來,卻沒有顯著衝擊,恐慌還沒來。 這三則:AI不再是「你問它答」的工具

 
 
港五年AI規劃 育才宜多着墨

香港首個《五年規劃》正式出台,這標誌着定位的轉變:從「被動銜接」升級為「主動對接」。《施政報告》重點強調「大力引進人工智能(AI)人才」,而「AI人才」這四個字,實際上涵蓋了三類截然不同的專業人才。 第一種,造AI的人。工程師、科學家、訓練模型、寫演算法、生產晶片的人,這類是傳統意義上的「AI人才」,也是「搶」的對象。他們稀缺、人工高、流動性強,全世界都在搶。香港搶這類人才,跟美國矽谷、新加坡、深

 
 
「AI幻覺」責任誰屬?

上周有兩則新聞,將「人工智能(AI)幻覺」從專業術語,轉變為公眾關注的焦點。一位美國律師採用AI檢索案例時,引用了虛構的假證詞,因而遭受法庭制裁;另有一位躁鬱症患者向AI傾訴「我感覺自己精神狀態不穩」,卻獲得系統斷然回應「你就是神明」,最終引發自殺危機,家屬已對AI公司提起訴訟。一位是法律從業者,導致專業受損;一位是心理病患者,險些喪命。 上述表面而言,這是「AI的失誤」,深入探究,實則反映「信任

 
 
bottom of page