top of page

Kimi掀長文本比併潮

近日內地知名人工智能(AI)公司「月之暗面」(Moonshot AI)推出Kimi智能助手,能支援200萬字連續無損超長上下文功能。Kimi智能助手又稱Kimi Chat,是「月之暗面」自研千億參數大模型打造的對話式AI助手產品,擁有長上下文處理能力,可應用於很多新的使用場景,包括專業學術論文的理解和翻譯、輔助分析法律問題、一次性整理幾十張發票等。 據說有用戶上傳了一份完整近百萬字的中醫診療手冊,讓Kimi針對用戶問題給予診療建議。以往由於模型訓練結構所限,大模型的文本範圍都不能太長,若遇上一些複雜任務或面對大量文字資料,只能分拆文本輸入提問,但這可能會導致輸出結果上下不連貫及邏輯不通順。有了Kimi特長文本功能之後,AI可以連貫地去理解全篇上下文,更能充分理解和回答問題。相比GPT-4 Turbo支持128K上下文的功能,約相當於10萬漢字,Kimi可支援200萬漢字的上下文長度,是目前一眾大模型產品裏的長度冠軍。 Kimi今年1月下旬才突破40萬人次訪問量,但自春節開始訪問量迅速攀升,2月的訪問量超過160萬人次,僅遜於百度(09888)的文心一言與阿里巴巴(09988)的通義千問。「月之暗面」成立於2023年4月,截至目前已完成三筆融資,最新一輪融資超過10億美元,投資者包括阿里巴巴、紅杉中國、小紅書、美團(03690)等,估值達25億美元(約195億港元),是內地主要大模型獨角獸之一。 專家表示,根據內部評估,Kimi中英文生成能力已接近OpenAI的GPT-4,但邏輯推理方面仍有差距,主打文字生成,目前沒多模態圖片功能。至於Anthropic的Claude 3,不論是中英文生成、理解和推理、多模態圖片理解能力均與GPT-4接近,效果優於谷歌的Gemini,實際使用中其生成速度比GPT-4和Gemini更快。 隨着「月之暗面」Kimi的熱度高漲,互聯網大廠們進入了「卷」長文本比併的階段。最近阿里的通義千問宣布升級,免費開放長文檔處理功能,幫助用戶快速閱讀科研論文及研究報告、分析財務報告、研究判案、審閱醫療報告、解讀法律條文、分析考試成績、總結深度文章。 360智腦也宣布內測長文本處理功能,該功能即將入駐360AI瀏覽器,後者目前已向用戶免費開放100萬字長文本閱讀功能,一分鐘可讀完《三體》,並就文本外的「超綱」問題進行問答和延伸學習。 據悉百度下月亦會進行升級,屆時將開放長文本能力,文本範圍在200萬至500萬,大模型領域競爭霎時熾熱起來。

Recent Posts

See All
選擇胖模型還是胖鞍具?

打開任何人工智能(AI)方案,你會看到兩種完全不同的產品策略在較量:一種叫做胖模型(Fat Model),另一種叫做胖鞍具(Fat Harness)。 胖模型的信念很直白:以更大的大腦解決更多的問題。參數多、數據龐大、算力強,模型自然顯得聰明。這驅動了ChatGPT、Claude和Grok之間的競賽──每一代都宣稱新產品比上一代更強,而企業只要付費就能直接使用,代價是你的AI能力完全綁定在供應商的

 
 
慎防智能代理「無聲」脫軌

試想想,人工智能(AI)系統已在生產環境中完成部署,但究竟要如何防止AI「悄然失靈」?過去3個月,全球超大規模企業在AI基礎設施上的資本支出達到一個前所未有的量級。單憑這一數據,人們或許會得出結論:AI的生產化部署正在全力推進,市場充滿信心。 然而,7月份第一周,來自不同領域的幾個訊號同時浮現,揭示出一個更為複雜的真相。一邊是史無前例的基礎設施投資;另一邊是一群深諳「系統可靠性」的專家──那些專門

 
 
AI預算黑洞 根源在架構設計

過去兩年。美國眾企業不約而同墮入一個速成陷阱: 認為購買了一個模型、聘請幾位演算法工程師、便能成功實現人工智能 (AI) 落地。然而,即使模型選擇正確數據卻 難以整合;數據成功整合,系統卻無法運行;系統成功運行,但業務部門不會操作;即使學會操作,3個月後模型又變得過時。 問題根源其實不在模型,而在架構。猶如建造大樓,若設計圖存在缺陷,再昂貴的材料也難以支撐。許多企業投入巨資購買「鋼筋水泥」(模型和

 
 
bottom of page