#DeepSeek
共 7 篇相關文章
-
月之暗面積極增購輝達 Blackwell 晶片,加速訓練下一代旗艦大模型 Kimi K4
中國 AI 新創月之暗面(Moonshot)正尋求更多輝達 Blackwell 晶片,用於訓練下一代模型 Kimi K4,延續 K3 的技術路徑,被視為中國 AI 持續追趕 OpenAI、Anthropic 的重要訊號。
-
DeepSeek 創辦人稱 NVIDIA「自掘墳墓」:CUDA 護城河與華為 AI 晶片爭霸真相解析
DeepSeek 創辦人梁文鋒被轉述稱 NVIDIA 正在「自掘墳墓」,本文從來源可信度、硬體效能與 CUDA 生態三角度拆解真相,分析華為昇騰晶片能否撼動 NVIDIA 在 AI 算力市場的主導地位。
-
月之暗面發布 Kimi K3:2.8 兆參數全球最大開源模型,48 小時自主完成半導體晶片設計
中國新創月之暗面(Moonshot AI)發布 Kimi K3,2.8 兆參數居全球開源 LLM 之冠,能在 48 小時內不借助商業 EDA 軟體,自主完成半導體晶片設計,展示大型語言模型在工程設計的突破潛力。
-
DeepSeek 啟動自研 AI 推論晶片計畫,知情人士:對華為市場的衝擊將大於 NVIDIA
路透社引述知情人士透露,DeepSeek 正秘密研發專用推論 AI 晶片,目標降低對 NVIDIA 與華為的依賴;此舉若成功,將直接衝擊華為在中國 AI 市場的主導地位,也標誌中國 AI 實驗室進入算力自主新階段。
-
DeepSeek 與北大聯合推出 DSpark,LLM 推理速度最高提升 85%
DeepSeek 攜手北京大學發布推理加速框架 DSpark,採半自回歸生成架構與置信度調度驗證機制,解決大型語言模型在高併發場景下的效率瓶頸,推理速度最高提升 85%,並同步開源模型權重。
-
OpenRouter 推出 Fusion API:多模型協作架構在特定測試中表現超越旗艦單模型
OpenRouter 發布 Fusion API,同時調用 Gemini 3 Flash、Kimi K2.6、DeepSeek-V4 Pro 等低成本模型協同作答再整合輸出,部分研究型測試成績接近甚至超越旗艦模型,AI 競爭邏輯可能從單模型比拼轉向系統架構競爭。
-
微軟考慮引入 DeepSeek 驅動 Copilot Cowork,同步推出依使用量計費方案
微軟為降低代理式 AI 的高昂算力成本,評估將 DeepSeek V4 等低成本開源模型導入企業版 Copilot Cowork,並同步宣布改採依使用量計費模式,取代原本固定收費方案。