前OpenAI CTO的首款AI大模型:架構借鑑DeepSeek-V3,使用Kimi K2.5改進

華爾街見聞
07/16

前OpenAI首席技術官Mira Murati創立的AI初創公司Thinking Machines Lab發布了首款通用AI模型,其架構直接借鑑中國AI實驗室的技術成果。

7月15日,據英國《金融時報》報道,這款名為Inkling的基礎模型在架構層面參考了DeepSeek的DeepSeek-V3,並在訓練後階段使用了月之暗面(Moonshot AI)旗下Kimi K2.5生成的數據加以優化。Inkling將以開放權重(open-weight)形式發布,用戶可在自有服務器上部署並針對特定場景進行微調。

此次發布正值中國AI模型在全球市場加速追趕之際。數據平台OpenRouter的數據顯示,中國AI模型在整體使用量上已於今年超越美國同類產品。

Inkling定位:開放權重,主打可定製化

根據Thinking Machines公司分享的基準測試數據,Inkling的綜合性能目前低於Anthropic的Claude和OpenAI的旗艦產品,也落後於部分中國頭部模型。然而,該公司選擇以開放權重模式發布,與ChatGPT和Claude等閉源產品形成差異化競爭。

開放權重意味着企業和開發者可以將模型部署在自有服務器上,並根據具體業務需求進行深度定製和微調。Thinking Machines在博客中表示,當前大多數AI工具"在少數幾個地方完成訓練後便被固化",而非由用戶塑造。"擴展人類意志與判斷,需要像人本身一樣多元和分佈式的AI,"公司表示。

該公司還推出了Tinker平台,專門面向企業客戶,允許其對大型語言模型進行微調和定製,以適配特定業務應用場景。值得注意的是,OpenAI等競爭對手同樣提供可定製的開放權重模型,亞馬遜微軟等雲平台也提供基於用戶自有數據集的模型微調服務,Thinking Machines在這一賽道面臨不小的競爭壓力。

技術路線:借力中國AI生態

Inkling在技術構建上對中國AI成果的借鑑,是此次發布最受關注的細節之一。DeepSeek-V3自今年初發布以來,憑藉低成本、高性能的特點在全球AI社區引發廣泛討論,其架構設計已成為多個新興模型的參考藍本。Kimi K2.5則是月之暗面推出的推理增強模型,被用於Inkling的訓練後優化階段。

Thinking Machines表示,Inkling是"從零開始訓練"的模型,並提供完整權重供用戶使用。"今天,我們通過發布一款由我們從頭訓練、提供完整權重的模型來推進我們的使命,讓人們能夠將其據為己用,"公司表示。

Thinking Machines的市場關注度,在很大程度上源於Murati在AI行業的特殊地位。她曾主導OpenAI多款核心產品的開發,包括ChatGPT、圖像生成工具Dall-E以及語音模式功能,並在2023年11月OpenAI董事會短暫罷免CEO Sam Altman事件中扮演了重要角色。Murati於2024年9月離開OpenAI,並於去年2月創立Thinking Machines。

公司成立約一年後,已完成一輪20億美元的種子輪孖展,投後估值達120億美元,投資方包括風險投資機構Andreessen Horowitz、芯片製造商英偉達AMD,以及對沖基金Jane Street。

除Inkling基礎模型外,Thinking Machines還在積極拓展產品線,尋求在差異化方向上建立競爭優勢。今年5月,公司預覽了首款"交互模型",該模型能夠基於用戶的音頻和視頻輸入執行操作,而不僅限於文本理解,顯示出公司向多模態、日常生活場景滲透的戰略意圖。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10