top of page

資訊愈流通 壟斷愈困難

Updated: Apr 28

近日很多人詬病一些大型互聯網企業憑着先行優勢得到大量數據,由此形成數據壟斷。這樣的心態到底是仇「富」, 還是真有其事? 要了解這事情,我們先要明白數據驅動的根本動力,此前「互聯網女皇」Mary Meeker的最新互聯網趨勢報告中就提出一條公式「數據量 + 利用率 = 增長」,道破了數據量是企業未來增長的關鍵要素。 去年全球已有逾半人口即38億人是互聯網用戶,手機使用者每天在移動設備上花費的時間平均超過220分鐘,在這種趨勢下,我認為前面的公式同樣可以表達為「數據量 + 利用率 = 使用者體驗」,當良好的使用者體驗與數據獲取能成為數據閉環,讓數據的獲取集中力度及品質提高,我叫這種現象作data harvesting。這正是過去谷歌、臉書、淘寶、微信所依賴的方程式,成為一方的數碼贏家。 強制分享恐難協調 為了提防數據壟斷,有人覺得可以效法對付商業壟斷的做法,禁止規模過大的公司令消費者失去選擇權。牛津大學互聯網研究所的學者則建議,不如迫使超過一定規模的企業向規模更小的競爭對手共用他們的部分數據。然而,我的疑問是:大家如何知道大企業擁有哪些數據? 如果要建立一個數據持有者清單,強制要企業共用資源,是否符合商業邏輯?我相信協調工作的難度超乎想像,恐怕會出現「不患寡而患不均」的情況。因此,我認為更積極地推動政府及公共機構的數據開放會更容易實行,中小型創企也可從中得到創新機會。其實,世界各地政府都意識到這一點,而且正在推動開放數據政策。至於某個企業的數據在行業內高度集中,僅是個人數據被濫用的誘因之一,因為壟斷會讓民眾更加投訴無門。 無論如何,創新動力正從人類智慧轉向數據驅動的機器學習。誰能獲得最多數據,誰就將更富創造性。 數據的收集和重複利用非常有價值,但是,數據過於集中在某些企業手中絕不是一件好事,差異化才是創新之源。因此,我一直在不同地方推動數據流通,筆者深信數據總體上愈流通順暢,某些別有用心的企業就愈難以壟斷。

Recent Posts

See All
選擇胖模型還是胖鞍具?

打開任何人工智能(AI)方案,你會看到兩種完全不同的產品策略在較量:一種叫做胖模型(Fat Model),另一種叫做胖鞍具(Fat Harness)。 胖模型的信念很直白:以更大的大腦解決更多的問題。參數多、數據龐大、算力強,模型自然顯得聰明。這驅動了ChatGPT、Claude和Grok之間的競賽──每一代都宣稱新產品比上一代更強,而企業只要付費就能直接使用,代價是你的AI能力完全綁定在供應商的

 
 
慎防智能代理「無聲」脫軌

試想想,人工智能(AI)系統已在生產環境中完成部署,但究竟要如何防止AI「悄然失靈」?過去3個月,全球超大規模企業在AI基礎設施上的資本支出達到一個前所未有的量級。單憑這一數據,人們或許會得出結論:AI的生產化部署正在全力推進,市場充滿信心。 然而,7月份第一周,來自不同領域的幾個訊號同時浮現,揭示出一個更為複雜的真相。一邊是史無前例的基礎設施投資;另一邊是一群深諳「系統可靠性」的專家──那些專門

 
 
AI預算黑洞 根源在架構設計

過去兩年。美國眾企業不約而同墮入一個速成陷阱: 認為購買了一個模型、聘請幾位演算法工程師、便能成功實現人工智能 (AI) 落地。然而,即使模型選擇正確數據卻 難以整合;數據成功整合,系統卻無法運行;系統成功運行,但業務部門不會操作;即使學會操作,3個月後模型又變得過時。 問題根源其實不在模型,而在架構。猶如建造大樓,若設計圖存在缺陷,再昂貴的材料也難以支撐。許多企業投入巨資購買「鋼筋水泥」(模型和

 
 
bottom of page