top of page

利用人工智能實踐數據驅動

Updated: Apr 28

大家都知道,想要充分發揮人工智能的作用,數據的數量和品質是重要條件,因此數據建構的方式會直接影響投入產出的效率。 考慮到企業面對的大量複雜數據來源,如果你的企業還停留於主要使用人手作數據分析的階段,就可能會被視為「傳統數據」公司。所以我一直提倡,人工智能要走入數據生產的過程中,讓數據驅動無後顧之憂。 早於2013年,我在阿里開展兩個重要專案,包括數據驅動能力如何泛化到業務方每一個角落,以及數據分析怎樣趨向自動化。當時團隊中有不少人懷疑這是吃力不討好的工作,但後來事實證明,把分析能力交付到業務前線的好處是巨大的。我在多年推動大數據的工作經驗中理解到,真正的數據驅動必須來自群策群力。 近年來,機器學習無疑已成為了企業使用大數據時的必備技術,大數據經過約10年發展,今天大家都為了數據收集、治理、訓練、產品化自動化而努力。MIT有一個研究項目Data to AI,正是希望借助人工智能,有效洞察資訊中的有用數據規則,並減少噪音和偏見,為大數據帶來更大的未來發展空間,可見敏捷的數據生產環境是人工智能的先決條件。 至於企業如何選擇人工智能的切入點,我提議優先關注兩個場景——(1)人工智能如何能幫助業務過程中的決策變得更有效率;(2)人工智能是否可幫助業務人員對複雜問題有更細緻敏銳的理解。 前者的切入點就好比你問Siri:附近有沒有茶餐廳。對Siri來說,這是頻繁發生的問題,在數據足夠的情況下毫無難度。正如日常中,有經驗的人也可在幾秒鐘內答覆這類問題,關鍵是要有大量具品質的數據。 後者的挑戰在於人機交互的困難,業務人員並不習慣與人工智能一起探索問題。在這過程中,不僅機器在進步,人類的思維方式也同時被提升。 上周幾天都在聽王東岳(著名作家、哲學學者)的演講,他提出人類不要輕視資訊密集時代所產生的影響力,個人感覺這是一個很有深度的哲學性問題。

Recent Posts

See All
慎防智能代理「無聲」脫軌

試想想,人工智能(AI)系統已在生產環境中完成部署,但究竟要如何防止AI「悄然失靈」?過去3個月,全球超大規模企業在AI基礎設施上的資本支出達到一個前所未有的量級。單憑這一數據,人們或許會得出結論:AI的生產化部署正在全力推進,市場充滿信心。 然而,7月份第一周,來自不同領域的幾個訊號同時浮現,揭示出一個更為複雜的真相。一邊是史無前例的基礎設施投資;另一邊是一群深諳「系統可靠性」的專家──那些專門

 
 
AI預算黑洞 根源在架構設計

過去兩年。美國眾企業不約而同墮入一個速成陷阱: 認為購買了一個模型、聘請幾位演算法工程師、便能成功實現人工智能 (AI) 落地。然而,即使模型選擇正確數據卻 難以整合;數據成功整合,系統卻無法運行;系統成功運行,但業務部門不會操作;即使學會操作,3個月後模型又變得過時。 問題根源其實不在模型,而在架構。猶如建造大樓,若設計圖存在缺陷,再昂貴的材料也難以支撐。許多企業投入巨資購買「鋼筋水泥」(模型和

 
 
智能代理編程戰 懂人機協作致勝

上周把兩個消息放在一起看,很有意思。 第一個,Anthropic宣布Claude Code推出Artifacts,讓軟件工程師在寫程式的過程中,業務主管能同時打開網頁儀表板,就能看到軟件即時更新及開發的狀態。 第二個,中國人民大學和微軟亞洲研究院聯合推出一個叫Arbor開源自主人工智能體的新框架,系統能自動提出假設、修改代碼,運行真實實驗並從結果中學習,自動優化解決問題。 過去一年大家比併的是模型

 
 
bottom of page