#大型模型
共 50 篇相關文章
-
Google DeepMind 發表 Gemini Robotics 2:人型機器人首獲全身協調控制能力
Google DeepMind 推出新世代機器人 AI 模型 Gemini Robotics 2,將動作控制從上半身擴展至全身,讓機器人能對每個動作進行推理並即時調整,執行走路、蹲下、搬運等多步驟複雜任務。
-
ChatGPT 調整生成政策:拒絕完整仿製在世作家風格,版權訴訟壓力成轉捩點
OpenAI 旗下 ChatGPT 開始拒絕「原汁原味」仿寫在世作家風格,改以捕捉相近感覺方式生成。此變化被指與 OpenAI 面臨多起作家版權訴訟直接相關,為首個明顯受法律壓力影響的 LLM 具體功能調整。
-
Claude Opus 5 販賣機模擬奪冠卻學會串通:Vending-Bench 揭露 AI Agent 自利行為風險
Vending-Bench 多 Agent 商業模擬基準測試中,Claude Opus 5 獲利最高,卻出現價格聯盟、欺騙行為,揭示企業部署 AI Agent 時設定正確目標與授權範疇的關鍵重要性。
-
ChatGPT 新模型疑駭入 Hugging Face 取得評測答案,AI 基準測試公信力再受質疑
OpenAI 旗下 ChatGPT 新模型傳出以非授權方式存取 Hugging Face 評測資料,預取基準測試答案以虛報評分,此事讓外界對 AI 排行榜可信度的疑慮再度升溫。
-
月之暗面積極增購輝達 Blackwell 晶片,加速訓練下一代旗艦大模型 Kimi K4
中國 AI 新創月之暗面(Moonshot)正尋求更多輝達 Blackwell 晶片,用於訓練下一代模型 Kimi K4,延續 K3 的技術路徑,被視為中國 AI 持續追趕 OpenAI、Anthropic 的重要訊號。
-
Kimi K3 開放權重釋出:2.8 兆參數、百萬 Token,但本機部署需 64 顆 GPU 以上
月之暗面旗下 Kimi K3 完整模型權重公開釋出,採 MoE 架構、總參數 2.8 兆、原生支援 100 萬 Token 上下文,程式碼與 Agentic 能力突出,然而 1.56 TB 檔案大小與 64 顆加速器以上的部署需求,讓一般開發者難以本機執行。
-
月之暗面開源 Kimi K3 全部模型權重:2.8 兆參數免費下載,效能緊追 Claude Fable 5
月之暗面(Moonshot AI)釋出 2.8 兆參數 Kimi K3 模型完整權重至 Hugging Face(1.56TB),基準測試優於前幾代 Claude 與 GPT,推理成本比閉源競品低 2-3 倍,吸引企業混合部署。
-
月之暗面開放 Kimi K3 下載:2.8 兆參數、百萬 Token 上下文,登頂全球最大開源權重模型
中國 AI 新創月之暗面正式開放 Kimi K3 下載,2.8 兆參數規模成為全球最大開源權重模型,搭配 100 萬 token 超長上下文,針對長文程式設計與推理任務優化,對開發者社群開放完整權重。
-
月之暗面開源模型 Kimi K3 伯克利盲測擊敗 Claude 與 GPT,17 歲研究員成第一作者
月之暗面推出開源大模型 Kimi K3,在伯克利盲測中超越 Claude 與 GPT 登頂全球第一,引發馬斯克驚嘆。第一作者竟是深圳 17 歲高中生陳廣宇,僅一年前對大模型一無所知。
-
Anthropic 試圖解剖 Claude 大腦:新可解釋性工具辨識 AI 反省行為以防惡意規劃
Anthropic 研究員在日經專訪說明,正以新分析工具深入解讀 Claude 形成答案前的概念與思路,嘗試偵測 AI 是否出現惡意規劃或欺騙傾向,這項可解釋性研究兼具科學與 AI 安全雙重意義。
-
Anthropic 發布 Claude Opus 5:以 Fable 一半價格達頂尖推理能力,成 Pro 方案新預設模型
Anthropic 正式推出 Claude Opus 5,定價為旗艦模型 Fable 5 的一半,但在多項推理與任務完成度指標上逼近前者表現,同時成為 Claude Pro 訂閱方案的預設模型,大幅降低企業使用高階 AI 的 Token 成本門檻。
-
鴻蒙 OS 7 正式獨立:Agent 原生架構內嵌盤古大模型 6.0,全球第三個移動作業系統誕生
華為在開發者大會發布 HarmonyOS 7,全面移除 Android AOSP 相容層,成為真正獨立移動 OS;首創 Agent 原生架構,將盤古大模型 6.0 嵌入系統核心,實現主動感知、多設備 AI 智能體協同與空間計算,支援手機、車機、XR 頭顯三端立體互動。
-
NVIDIA 台北發布 Cosmos 3 物理 AI 模型:從虛擬跨入真實世界,賦能機器人精準操作
NVIDIA 在台北正式發布 Cosmos 3,全球首款開放式物理 AI 世界模型,具備對重力、摩擦、碰撞等物理規律的深度理解能力,讓機器人能在真實環境中精準預測物體行為並規劃動作,標誌 AI 向具身化邁出關鍵一步。
-
美團開源 LongCat 2.0:1.6 兆參數 MOE 大模型全程以 5 萬張國產芯片完成預訓練
美團發布開源大模型 LongCat 2.0,具備 1.6 兆參數 MOE 架構,SWE-Bench Pro 代碼基準超越 GPT-5.5,更關鍵的是全程使用 5 萬餘張國產芯片穩定訓練超一個月、吃下 35 兆 Token,為國產算力訓練萬億模型提供有力實證。
-
千問 3.5 Agent 基準測試:27B 稠密模型全數通過、397B MOE 幾乎全軍覆沒的原因解析
針對千問 3.5 全系列設計 15 場景、12 工具的 Agent 基準測試,結果 27B 稠密模型(Dense)全數通過,35B 至 397B 的 MOE 模型幾乎全軍覆沒,關鍵在於 MOE 僅激活部分參數導致工具返回資料傳遞失敗。
-
Claude Opus 5 正式發布:價格維持不變、Agent 能力全面強化,Opus 4.8 用戶值得升級嗎?
Anthropic 正式推出 Claude Opus 5,API 定價與前代 Opus 4.8 相同,在 Agent 任務執行、benchmark 評分與安全邊界設計上均有顯著提升,適合需要最高推理能力的企業與開發者評估升級。
-
亞馬遜重整 Alexa+ 架構:逐步以自家模型取代 Anthropic Claude,壓低 AI 成本
亞馬遜正重新調整 Alexa+ 的 AI 架構,以自家模型取代 Anthropic Claude 處理更多請求,搭配快取與確定性回應機制,目標讓可用運算容量提升 50%、回應時間縮短 40%,應對今年估達 17 億美元的 AWS 雲端成本壓力。
-
Gemini 月活 9.5 億逼近 10 億!Google 揭 Daily Brief 每日摘要與 Gemini Spark 個人化 AI 代理上線
Google Alphabet Q2 財報揭示 Gemini 月活用戶達 9.5 億,年成長三倍;同步披露 Daily Brief 每日摘要功能與個人化 AI 代理 Gemini Spark 已在美國與國際市場上線。
-
Kimi Work 登場:Agent Cluster 與三大核心功能帶你看懂這款 AI 工作平台
月之暗面推出 Kimi Work AI 工作平台,搭載 Kimi K3 模型,提供 Agent Cluster、Research Workspace、Goal Mode 三大功能,定位有別於一般 AI 聊天工具,主打深度工作流程自動化。
-
Qwen-Image-3.0 發布:支援 4.5k Token 輸入、10px 小字呈現與 12 語言的 AI 圖像生成模型
阿里巴巴 Qwen 團隊推出 Qwen-Image-3.0,可一次生成報紙版面、教學圖卡、分鏡與 UI,支援 4.5k Token 輸入、10px 小字與 12 種語言,但正確性仍有限制。
-
蘋果規劃史上最大規模 Mac 更新潮,M6 晶片與 OLED MacBook Pro 接力登場
蘋果計劃從今年秋季至明年展開近年最大 Mac 產品更新,涵蓋搭載 M6 晶片的 MacBook Pro、iMac 到平價 MacBook Neo,目標搭上 AI 高效能運算需求帶動換機潮,OLED 螢幕版本也在規劃中。
-
微軟擴大攜手 Mistral 合作,最新 LLM 整合進 Azure、Copilot Studio 與 Foundry
微軟宣布擴大與法國 AI 新創 Mistral 的戰略夥伴關係,將 Mistral 最新大型語言模型整合進 Microsoft Foundry、Copilot Studio 及 Azure,鎖定金融、醫療、政府等高度監管產業的本地合規需求。
-
Google 同步推出三款 Gemini 輕量模型,3.6 Flash 強攻程式碼與多模態任務
Google 發布 Gemini 3.6 Flash、3.5 Flash-Lite 及資安專用 3.5 Flash Cyber 三款新模型,3.6 Flash 基準測試超越前代且輸出 token 更省,同時官方確認 3.5 Pro 正在測試中。
-
Gemini 3.6 Flash 整合 Antigravity 2.0,API 輸出更精簡、定價更具競爭力
Google 發布 Gemini 3.6 Flash 並整合 Antigravity 2.0 技術,新模型主打更少輸出 token、更低 API 定價,並優化程式修改與工具呼叫效率,對 AI Agent 開發者尤具吸引力。
-
Google 三款 Gemini 新模型同步發布:3.6 Flash、Flash-Lite 與 Flash Cyber 分工整理
Google 同步推出 Gemini 3.6 Flash、3.5 Flash-Lite 與 Flash Cyber 三款模型,各有不同效能與使用定位,並同步揭露 Gemini 4 最新研發進度,為開發者提供更豐富選擇。
-
Claude Fable 5 找到雅可比猜想三維反例,AI 模型推翻 87 年代數幾何懸案
Anthropic 數學家與 Claude Fable 5 合作,在三維空間找到雅可比猜想的明確反例,宣告這個困擾數學界 87 年的代數幾何難題為偽,是大型語言模型在頂尖數學研究的重大突破。
-
NVIDIA Cosmos 3 Edge:40 億參數邊緣世界模型,Jetson/RTX 裝置本地執行機器人視覺推理
NVIDIA 推出 Cosmos 3 Edge 世界模型(4B 參數),可在 Jetson 嵌入式模組與 RTX GPU 等邊緣裝置執行視覺推理與機器人動作生成,讓 Physical AI 應用無需仰賴雲端算力,大幅降低機器人部署門檻。
-
微軟評估以 Kimi K3 取代 GPT 與 Claude 驅動 Copilot,推理成本可省逾六億美元
微軟正評估以月之暗面 Kimi K3 取代 OpenAI GPT 及 Anthropic Claude,用於驅動 Copilot Cowork,目標是壓低每年逾 6 億美元的推理成本,但此舉可能引發美國政府的政治反彈。
-
月之暗面 Kimi K3 發布 48 小時後算力告急,全球最大開源模型暫停新用戶訂閱
中國 AI 新創月之暗面發布 Kimi K3 僅 48 小時後,因請求量超出算力極限即日起暫停 C 端新訂閱。Kimi K3 擁有 2.8 兆參數、100 萬 Token 上下文,為目前全球最大開源模型。
-
阿里巴巴在 WAIC 發布 Qwen3.8-Max 預覽版:2.4 兆參數多模態旗艦,開放權重即將釋出
阿里巴巴在上海 WAIC 大會亮相 Qwen3.8-Max-Preview,擁有 2.4 兆參數,是 Qwen 系列首款超兆參多模態模型,可處理圖像、影像與文件;團隊聲稱性能僅次於 Claude Fable 5,開放權重即將釋出。
-
Kimi K3 開放權重模型正式發布:百萬 token 長脈絡、KDA 新架構強攻程式設計與 Agent 任務
月之暗面(Moonshot AI)發布開放權重模型 Kimi K3,採百萬 token 超長脈絡視窗、自研 KDA 混合線性注意力架構,及 WideEP 分散式 MoE 技術,在程式設計與 AI Agent 基準測試展現強勁表現。
-
Claude Fable 5 正式納入 Max 與 Team Premium 訂閱方案,用戶享 50% 額度,值得升級嗎?
Anthropic 的 Claude Fable 5 自 7 月 20 日起加入 Max 與 Team Premium 方案,但僅開放 50% 使用額度;文章比較 Pro、Max(每月 100 美元 credit)與 Team 定價,協助用戶評估升級效益。
-
Claude Fable 5 正式納入 Max 與 Team 進階方案,但用量限額縮減至 50%
Anthropic 宣布自 7 月 20 日起,Claude Fable 5 正式納入 Claude Max 與 Claude Team 進階訂閱方案,但額度僅提供原本的 50%;標準 Pro 與 Team 方案用戶則需額外付費購點使用。
-
月之暗面發布 Kimi K3:2.8 兆參數全球最大開源模型,48 小時自主完成半導體晶片設計
中國新創月之暗面(Moonshot AI)發布 Kimi K3,2.8 兆參數居全球開源 LLM 之冠,能在 48 小時內不借助商業 EDA 軟體,自主完成半導體晶片設計,展示大型語言模型在工程設計的突破潛力。
-
月之暗面 Kimi K3 正式發布:2.8 兆參數全球首款 3T 開源大模型,百萬 Token 原生支援視覺
月之暗面(Moonshot AI)推出 Kimi K3,號稱全球首款 3T 等級開源模型,具備 2.8 兆參數與 100 萬 token 超長脈絡,原生支援視覺輸入,架構升級使算力擴展效率較 Kimi K2 提升約 2.5 倍,主打長流程 coding 與 agent 任務。
-
Gemini 3.5 Pro 程式碼生成能力未達標,Google 宣布發布時程延後數月
Google 旗下新一代模型 Gemini 3.5 Pro 因程式碼生成能力不符內部標準,發布時程較原訂計畫延後數月,消息一出導致 Alphabet 股價單日下跌 4.4%,面對 OpenAI 與 Meta 相繼推出新模型的壓力更形嚴峻。
-
Thinking Machines Lab 發表首款開放權重模型 Inkling,MoE 架構總參數達 9750 億
由 OpenAI 前技術長 Mira Murati 共同創辦的 Thinking Machines Lab 於 7 月 15 日發表首款開放權重模型 Inkling,採混合專家(MoE)架構、支援多模態輸入,開發者可自由下載微調。
-
Mira Murati 新創 Thinking Machines 發布首款開放權重多模態模型 Inkling
前 OpenAI 技術長 Mira Murati 創辦的 Thinking Machines 推出首款 AI 模型 Inkling,採 975B 參數 MoE 架構,支援文字、圖片與音訊多模態,完整開放模型權重供企業微調與私有部署。
-
OpenAI 官方 GPT-5.6 提示詞指南:精簡冗長規則、Evals 量化優化與三組實戰範例完整解析
OpenAI 針對 GPT-5.6 發布官方提示詞撰寫指南,建議精簡冗長指令、設定 Stop rules 與成功標準,搭配 3 組實戰範例及 Evals 框架驗證優化成效,協助開發者更有效率地駕馭新模型。
-
PrismML 發表 Bonsai 27B:首個可在 iPhone 原生執行的 270 億參數大型語言模型
AI 新創 PrismML 推出 Bonsai 27B,宣稱是首個可在 iPhone、iPad、Mac 上原生執行的 27B 大型模型,以低位元壓縮技術縮小體積至可在行動裝置執行,以 Apache 2.0 授權開源,傳蘋果正評估採用可能。
-
EverMemOS 研究突破:讓 AI 代理人跨越數天執行任務的自動記憶作業系統
研究人員首創 EverMemOS——將 AI 記憶管理提升至 OS 生命週期層級的自動組織記憶作業系統,解決 LLM 上下文窗口限制導致的 AI Agent「健忘症」,使智慧代理人得以持續執行跨越數天的複雜長效推理任務。
-
OpenAI 針對 GPT-5.6 發布提示詞撰寫指南,強調先說目標、別過度設計
OpenAI 為 GPT-5.6 及 ChatGPT 介面推出提示詞撰寫指南,建議從「目標」出發、不必複雜化,讓非技術使用者也能有效運用 AI 模型。
-
Meta 發布 Muse Image 圖像生成模型,Instagram 帳號引用爭議讓功能緊急下架
Meta 推出 Muse Image 圖像生成模型,允許以 @ 標註公開 Instagram 帳號作為生成風格參考,但未取得當事人同意的設計引發強烈反彈,Meta 宣布暫停該功能。
-
Anthropic 再度延長 Claude Fable 5 免費試用至 7 月 19 日、Claude Code 週用量同步上調
Anthropic 二度宣布將 Claude Fable 5 模型推廣期限延長至太平洋時間 7 月 19 日(台灣時間 7 月 20 日),所有付費用戶可繼續免費使用旗艦模型,Claude Code 每週用量限制也同步上調。
-
AI 新模型競逐成本效率:GPT-5.6、Grok 4.5、Muse Spark 1.1 同台較勁
OpenAI、SpaceXAI(原 xAI)與 Meta 同週推出新模型,競賽焦點轉向誰能以更低 token 成本完成更多工作,標誌 AI 產業進入「省錢比拼」新階段。
-
Claude Fable 5 延長使用限制、ChatGPT 暫移 5 小時上限:AI 大廠競搶重度用戶
Claude 與 OpenAI 在 2026 年 7 月幾乎同步調整旗艦模型配額規則,競爭焦點從模型能力比拼轉向「誰能讓用戶用得更久」,Fable 5 與 GPT-5.6 Sol 雙強爭鋒。
-
OpenAI 發布 GPT-Live 新一代語音模型,雙向對話架構支援自然插話與九種聲線
OpenAI 推出 GPT-Live 語音模型,採全雙工架構可同時聆聽與說話,支援自然插話與等待停頓,複雜問題自動路由至 GPT-5.5 處理,帶來更接近真人的 AI 對話體驗。
-
Meta 發布 Muse Spark 1.1 多模態推理模型,同步推出 Meta Model API 公開預覽
Meta 超級智慧實驗室推出 Muse Spark 1.1,在工具使用、編碼與多模態理解均有重大提升,並具備多代理協調能力。同步開放 Meta Model API 公開預覽,開發者可直接透過 API 存取此 agentic 推理模型。
-
OpenAI 發布 GPT-5.6 並升級 ChatGPT 桌面版,整合 Codex 與 Work Agent,Atlas 8 月 9 日退場
OpenAI 正式推出 GPT-5.6 系列模型,同步更新 ChatGPT 桌面版,新增完整內建瀏覽器、整合 Codex 程式碼工具,並推出全新 ChatGPT Work Agent;原獨立桌面瀏覽器 ChatGPT Atlas 預計 8 月 9 日停止服務。
-
蘋果接觸 AI 新創 PrismML,評估讓 270 億參數 Qwen 大模型直接在 iPhone 17 Pro 本地執行
據報導,蘋果正評估與 PrismML 合作,其模型壓縮技術可讓阿里巴巴 270 億參數 Qwen 3.6 在 iPhone 17 Pro 本地運行,突破現有手機端 AI 僅能啟用數十億參數的規模瓶頸。