美團(Meituan)正式發布開源大模型 LongCat 2.0,這不只是一個新模型發布——它標誌著國產算力在訓練端首次真正扛起萬億參數模型的完整預訓練流程。

重點

  • 模型規格:1.6 兆(1.6T)參數,MOE 混合專家架構
  • 代碼能力:SWE-Bench Pro 代碼基準超越 GPT-5.5,具備強大的代碼生成能力
  • 完全開源:模型權重與訓練細節公開發布
  • 國產算力突破:全程採用 5 萬餘張國產芯片完成預訓練,穩定運行超過一個月,消化 35 兆 Token
  • 歷史意義:這是首次有國產算力完整扛起萬億模型的完整訓練流程,為「不依賴海外頂級芯片」的自主 AI 路線提供最硬的實證

編輯按

LongCat 2.0 最值得關注的不是模型指標,而是訓練基礎設施。5 萬張國產芯片穩定跑完完整預訓練,代表在基礎設施層面,中國的 AI 訓練能力已具備實質性自主能力。這對未來 AI 供應鏈的格局影響深遠。

本文由 AI 整理,原文:FB分享酷