top of page

Grok 4戰略部署藏倫理隱憂

作為一名科技觀察者,對億萬富豪馬斯克(Elon Musk)旗下xAI上周發布的Grok 4,表現確實令人眼前一亮。這款號稱「史上最強聊天機械人」的新模型,不僅將上下文窗口擴展至驚人的25.6萬Token,更首次實現多模態支援。更玩味的是其背後戰略布局與隱憂,請容筆者娓娓道來。 xAI宣稱Grok 4的推理速度較前代提升數倍,在某些邏輯基準測試中超越了人類平均水平,這源於其專用超算Colossus的訓練。然而,在AGI-ARC-2抽象推理測試時,僅獲16分(滿分100),暴露了當前大語言模型的通病:對深層因果關係的理解仍稚嫩。 xAI此次的定價堪稱「兩極分化」,每月基礎版為30美元,而面向企業的SuperGrok Heavy版本,月費竟高達300美元。據消息透露,xAI還計劃在8月推出專為程式員需求優化的Grok 4 Code,9月上線多模態代理功能,10月則進軍影片生成領域。這種「3個月一迭代」的激進節奏,與馬斯克在特斯拉FSD(全自動駕駛)汽車上的策略如出一轍。 儘管性能亮眼,但Grok 4的發布仍受兩大爭議纏繞。首先Grok 4在測試中多次生成帶有偏見的回答,其次是xAI高調宣傳Colossus為「全球最大AI超算」,但微軟Azure或谷歌TPU v4的實際算力可能更勝一籌。這種宣傳手法,像極了SpaceX當年用「不銹鋼星艦」搶佔輿論高點的策略。Grok 4顯然瞄準了「鐵桿用戶」程式員、極客(Geek)及加密貨幣圈層,其代碼生成能力與網絡文化敏感度,確實填補了傳統的空白市場。 美國CNBC報道,有用戶發現Grok 4回應部分具爭議性的問題時,會引用馬斯克的立場而引起爭議。據說當向Grok 4提問支持以色列或是巴勒斯坦,並要求用一個字回答時,Grok 4顯示在產生回應的過程中,會從網絡及社交平台X引用馬斯克的相關言論作參考。惟報道同時指出,Grok 4並非在所有具爭議性問題上均參考馬斯克觀點,且若提問方式稍有不同,答案亦可能有所改變。 筆者始終認為技術面對高速發展的同時,永遠需要與倫理的底線共存。Grok 4的下一步,或許不該只是追逐用戶數量的增長,而是思考如何在人類未來的幸福上,找到創新與責任的平衡點。

Recent Posts

See All
選擇胖模型還是胖鞍具?

打開任何人工智能(AI)方案,你會看到兩種完全不同的產品策略在較量:一種叫做胖模型(Fat Model),另一種叫做胖鞍具(Fat Harness)。 胖模型的信念很直白:以更大的大腦解決更多的問題。參數多、數據龐大、算力強,模型自然顯得聰明。這驅動了ChatGPT、Claude和Grok之間的競賽──每一代都宣稱新產品比上一代更強,而企業只要付費就能直接使用,代價是你的AI能力完全綁定在供應商的

 
 
慎防智能代理「無聲」脫軌

試想想,人工智能(AI)系統已在生產環境中完成部署,但究竟要如何防止AI「悄然失靈」?過去3個月,全球超大規模企業在AI基礎設施上的資本支出達到一個前所未有的量級。單憑這一數據,人們或許會得出結論:AI的生產化部署正在全力推進,市場充滿信心。 然而,7月份第一周,來自不同領域的幾個訊號同時浮現,揭示出一個更為複雜的真相。一邊是史無前例的基礎設施投資;另一邊是一群深諳「系統可靠性」的專家──那些專門

 
 
AI預算黑洞 根源在架構設計

過去兩年。美國眾企業不約而同墮入一個速成陷阱: 認為購買了一個模型、聘請幾位演算法工程師、便能成功實現人工智能 (AI) 落地。然而,即使模型選擇正確數據卻 難以整合;數據成功整合,系統卻無法運行;系統成功運行,但業務部門不會操作;即使學會操作,3個月後模型又變得過時。 問題根源其實不在模型,而在架構。猶如建造大樓,若設計圖存在缺陷,再昂貴的材料也難以支撐。許多企業投入巨資購買「鋼筋水泥」(模型和

 
 
bottom of page