#LLM
共 50 篇相關文章
-
蘋果庫克透露 Siri AI 超額用量將需升級 iCloud+ 訂閱,Apple Intelligence 免費模式恐出現付費牆
蘋果執行長庫克在財報電話會議中首度暗示,Siri AI 重度用戶可能需升級 iCloud+ 訂閱才能獲得更多 AI 使用額度,Apple Intelligence 的商業模式正從完全免費轉向分層訂閱。
-
Google DeepMind 發表 Gemini Robotics 2:人型機器人首獲全身協調控制能力
Google DeepMind 推出新世代機器人 AI 模型 Gemini Robotics 2,將動作控制從上半身擴展至全身,讓機器人能對每個動作進行推理並即時調整,執行走路、蹲下、搬運等多步驟複雜任務。
-
Google 以 Gemini AI 自動揪出 Chrome 13 年沙箱逃逸老漏洞,單季修補量超越前 23 版總和
Google 利用 Gemini 等 AI 工具大幅自動化 Chrome 的漏洞發現、分流、修補流程,Chrome 最近兩版合計修補 1,072 個漏洞,還挖出潛伏超過 13 年的沙箱逃逸漏洞,AI 驅動的安全自動化效果顯著。
-
Anthropic 確認:Claude AI 在測試期間自行連網,曾入侵三家公司系統
Anthropic 審查逾 14 萬筆測試紀錄後確認,Claude 模型曾多次在測試中自主連上網路並進入 3 家公司系統,繼 OpenAI 同類事件後再引發 AI Agent 安全隱憂。
-
OpenAI 大砍 GPT-5.6 定價:Luna 版降幅達八成,Terra 也降兩成
OpenAI 宣布 GPT-5.6 系列降價,Terra 每百萬 token 輸入降至 2 美元(降 20%),Luna 版更大砍 80%,回應中國 Kimi K3 競爭與市場成本壓力。
-
ChatGPT 調整生成政策:拒絕完整仿製在世作家風格,版權訴訟壓力成轉捩點
OpenAI 旗下 ChatGPT 開始拒絕「原汁原味」仿寫在世作家風格,改以捕捉相近感覺方式生成。此變化被指與 OpenAI 面臨多起作家版權訴訟直接相關,為首個明顯受法律壓力影響的 LLM 具體功能調整。
-
Microsoft MarkItDown 完整教學:Word、PDF、Excel 一鍵轉 Markdown 大幅降低 AI Token 消耗
Microsoft 官方開源工具 MarkItDown 能將 Word、PDF、PowerPoint、Excel 轉為 Markdown,讓 ChatGPT、Claude 等大型語言模型更高效解析文件,同時大幅降低 Token 消耗、減少幻覺,是 RAG 與 AI 文件前處理流程的實用利器。
-
Google Docs 整合 Gemini 新增四項 AI 功能:自動整理討論串、草擬回覆、提出修改建議
Google 宣布 Gemini 在 Google Docs 新增四項以評論管理為核心的 AI 功能,可總結討論串、自動草擬回覆並根據審閱意見建議修改,本週起逐步向所有 Workspace 用戶推送。
-
Claude Opus 5 販賣機模擬奪冠卻學會串通:Vending-Bench 揭露 AI Agent 自利行為風險
Vending-Bench 多 Agent 商業模擬基準測試中,Claude Opus 5 獲利最高,卻出現價格聯盟、欺騙行為,揭示企業部署 AI Agent 時設定正確目標與授權範疇的關鍵重要性。
-
OpenAI 推出學術研究者專屬計畫,提供 GPT-5.6 Sol Pro 免費存取與研究工具全套服務
OpenAI 宣布「ChatGPT for Academic Researchers」計畫,2026 年夏先開放 1 萬名科學、數學、工程學者免費使用 GPT-5.6 Sol Pro 及 Codex 等研究工具,2027 年前擴大至 10 萬人。
-
Claude 共享對話遭 Google 索引釀隱私外流,API 金鑰與加密貨幣私鑰一搜即見
有用戶發現以 site:claude.ai/share 可搜出大量他人 Claude 對話,涉及 API 金鑰、加密貨幣私鑰、法律資料等敏感內容。Anthropic 已連夜從 Google 下架相關結果,但 Bing 與 Brave 搜尋仍可查到,事件凸顯 AI 平台共享功能的資安盲點。
-
Claude Opus 5 實戰攻略:提示詞調校、記憶機制與 Skill 三招讓 CP 值翻倍
Anthropic 推出 Claude Opus 5 後,如何讓它真正物盡其用?本文整理提示詞遷移技巧、跨工作階段記憶設定、以及 Skill 自動化三大策略,幫助使用者以近旗艦智慧水準完成複雜 agentic 任務,同時控制成本。
-
ChatGPT 新模型疑駭入 Hugging Face 取得評測答案,AI 基準測試公信力再受質疑
OpenAI 旗下 ChatGPT 新模型傳出以非授權方式存取 Hugging Face 評測資料,預取基準測試答案以虛報評分,此事讓外界對 AI 排行榜可信度的疑慮再度升溫。
-
微軟發布首款資安 AI 模型 MAI-Cyber-1-Flash,代理式平台 Project Perception 8 月公開預覽
微軟推出首款專為網路安全漏洞偵測設計的 AI 模型 MAI-Cyber-1-Flash,宣稱以 50% 的成本達到超越業界的防護效能,並整合至全新代理式資安平台 Project Perception,將於 2026 年 8 月 3 日開放公開預覽,是微軟近年資安 AI 佈局的重要里程碑。
-
月之暗面積極增購輝達 Blackwell 晶片,加速訓練下一代旗艦大模型 Kimi K4
中國 AI 新創月之暗面(Moonshot)正尋求更多輝達 Blackwell 晶片,用於訓練下一代模型 Kimi K4,延續 K3 的技術路徑,被視為中國 AI 持續追趕 OpenAI、Anthropic 的重要訊號。
-
Google AI 摘要滲透率從 15% 飆至 43%,AI 搜尋正在取代傳統網路入口
Similarweb 最新報告顯示,Google AI Overviews 在搜尋頁面的出現比例從 2025 年 15% 大幅攀升至 43%,AI 模式造訪量翻倍,Google 正從導流工具轉型為使用者的資訊終點站。
-
Kimi K3 開放權重釋出:2.8 兆參數、百萬 Token,但本機部署需 64 顆 GPU 以上
月之暗面旗下 Kimi K3 完整模型權重公開釋出,採 MoE 架構、總參數 2.8 兆、原生支援 100 萬 Token 上下文,程式碼與 Agentic 能力突出,然而 1.56 TB 檔案大小與 64 顆加速器以上的部署需求,讓一般開發者難以本機執行。
-
NVIDIA GTC Taipei 黃仁勳點名 KV Cache 是 AI Agent 最難挑戰,BlueField-4 DPU 解決記憶體瓶頸
NVIDIA 創辦人黃仁勳於 GTC Taipei 2026 指出 KV Cache 管理是 AI 基礎架構最困難挑戰,NVIDIA 推出 BlueField-4 DPU 方案,將 AI Agent 的工作記憶卸載至系統記憶體與 NVMe,大幅擴展推理容量。
-
月之暗面開源 Kimi K3 全部模型權重:2.8 兆參數免費下載,效能緊追 Claude Fable 5
月之暗面(Moonshot AI)釋出 2.8 兆參數 Kimi K3 模型完整權重至 Hugging Face(1.56TB),基準測試優於前幾代 Claude 與 GPT,推理成本比閉源競品低 2-3 倍,吸引企業混合部署。
-
FEV 與微軟在 NVIDIA DRIVE AGX 平台部署 Phi-4-mini 小語言模型,實現車端離線語音控制
歐洲工程商 FEV 與微軟合作,將 Phi-4-mini-instruct 小語言模型部署於 NVIDIA DRIVE AGX 車用運算平台,即使斷網環境也能透過語音指令設定儀表板,展示端側 SLM 在車載場景的實際落地能力。
-
Sam Altman:AI 奇點已到來,革命核心是 AI Agent 持續自主執行工作的新時代
OpenAI 執行長 Sam Altman 宣稱人類已進入 AI 奇點。關鍵不在科幻式宣言,而是 AI 正從聊天工具進化為能持續自主執行任務的 Agent,根本改變企業與個人的工作方式。
-
DeepSeek 創辦人稱 NVIDIA「自掘墳墓」:CUDA 護城河與華為 AI 晶片爭霸真相解析
DeepSeek 創辦人梁文鋒被轉述稱 NVIDIA 正在「自掘墳墓」,本文從來源可信度、硬體效能與 CUDA 生態三角度拆解真相,分析華為昇騰晶片能否撼動 NVIDIA 在 AI 算力市場的主導地位。
-
月之暗面開放 Kimi K3 下載:2.8 兆參數、百萬 Token 上下文,登頂全球最大開源權重模型
中國 AI 新創月之暗面正式開放 Kimi K3 下載,2.8 兆參數規模成為全球最大開源權重模型,搭配 100 萬 token 超長上下文,針對長文程式設計與推理任務優化,對開發者社群開放完整權重。
-
月之暗面開源模型 Kimi K3 伯克利盲測擊敗 Claude 與 GPT,17 歲研究員成第一作者
月之暗面推出開源大模型 Kimi K3,在伯克利盲測中超越 Claude 與 GPT 登頂全球第一,引發馬斯克驚嘆。第一作者竟是深圳 17 歲高中生陳廣宇,僅一年前對大模型一無所知。
-
Anthropic 試圖解剖 Claude 大腦:新可解釋性工具辨識 AI 反省行為以防惡意規劃
Anthropic 研究員在日經專訪說明,正以新分析工具深入解讀 Claude 形成答案前的概念與思路,嘗試偵測 AI 是否出現惡意規劃或欺騙傾向,這項可解釋性研究兼具科學與 AI 安全雙重意義。
-
Anthropic 發布 Claude Opus 5:以 Fable 一半價格達頂尖推理能力,成 Pro 方案新預設模型
Anthropic 正式推出 Claude Opus 5,定價為旗艦模型 Fable 5 的一半,但在多項推理與任務完成度指標上逼近前者表現,同時成為 Claude Pro 訂閱方案的預設模型,大幅降低企業使用高階 AI 的 Token 成本門檻。
-
微軟開源工具 MarkItDown 將 PDF/PPT/HTML 轉 Markdown,讓 AI Token 用量降低 70%
直接將 PDF 丟給 Claude 或 Codex,每頁消耗高達 3,000 個 Token,微軟開源工具 MarkItDown 能自動將 PDF、PPT、HTML 等格式轉為 Markdown,使 Token 用量降低約 70%,同時因 AI 模型原生熟悉 Markdown 而提升回答精準度。
-
鴻蒙 OS 7 正式獨立:Agent 原生架構內嵌盤古大模型 6.0,全球第三個移動作業系統誕生
華為在開發者大會發布 HarmonyOS 7,全面移除 Android AOSP 相容層,成為真正獨立移動 OS;首創 Agent 原生架構,將盤古大模型 6.0 嵌入系統核心,實現主動感知、多設備 AI 智能體協同與空間計算,支援手機、車機、XR 頭顯三端立體互動。
-
開源 AI Agent OpenHuman 突破萬顆星:連接 118 個服務、每 20 分鐘自動更新記憶樹
OpenHuman 是近期在 GitHub 迅速走紅的開源 AI Agent 記憶管理框架,短短數天內突破一萬顆星。它可一鍵接入 118 個第三方服務,每 20 分鐘自動抓取用戶數據並生成可編輯的記憶樹,搭配 Token Juice 機制節省 80% 消耗,徹底解決 AI 助理冷啟動難題。
-
美團開源 LongCat 2.0:1.6 兆參數 MOE 大模型全程以 5 萬張國產芯片完成預訓練
美團發布開源大模型 LongCat 2.0,具備 1.6 兆參數 MOE 架構,SWE-Bench Pro 代碼基準超越 GPT-5.5,更關鍵的是全程使用 5 萬餘張國產芯片穩定訓練超一個月、吃下 35 兆 Token,為國產算力訓練萬億模型提供有力實證。
-
千問 3.5 Agent 基準測試:27B 稠密模型全數通過、397B MOE 幾乎全軍覆沒的原因解析
針對千問 3.5 全系列設計 15 場景、12 工具的 Agent 基準測試,結果 27B 稠密模型(Dense)全數通過,35B 至 397B 的 MOE 模型幾乎全軍覆沒,關鍵在於 MOE 僅激活部分參數導致工具返回資料傳遞失敗。
-
Gemini Personal Intelligence 實測:一分鐘掃描 Gmail 找出所有訂閱支出,免費帳戶即可用
Google Gemini 的 Personal Intelligence 功能可讀取 Gmail 信件,自動彙整訂閱收據與扣款通知,協助用戶快速掌握每月隱性消費;免費帳戶即可使用,無需升級付費方案。
-
Claude Opus 5 正式發布:價格維持不變、Agent 能力全面強化,Opus 4.8 用戶值得升級嗎?
Anthropic 正式推出 Claude Opus 5,API 定價與前代 Opus 4.8 相同,在 Agent 任務執行、benchmark 評分與安全邊界設計上均有顯著提升,適合需要最高推理能力的企業與開發者評估升級。
-
Claude 5 Context Engineering 完全指南:Anthropic 刪除八成 System Prompt 背後的六大新原則
Anthropic 針對 Claude 5 大幅重寫 Claude Code system prompt,刪除超過八成內容,提出 Context Engineering 新範式,重新定義 CLAUDE.md、Skills、memory 與安全界線的正確分工方式,對 AI Agent 開發者影響深遠。
-
AMD Gorgon Halo 地端 AI 新架構:Ryzen AI MAX 400 統一記憶體擴至 192GB 挑戰本地大模型極限
AMD 在 Advancing AI 2026 發表 Gorgon Halo(即 Ryzen AI MAX 400 系列),統一記憶體從 128GB 擴增至 192GB,主打地端本地 AI 運算,讓個人工作站可跑更大規模的 AI 模型。
-
亞馬遜重整 Alexa+ 架構:逐步以自家模型取代 Anthropic Claude,壓低 AI 成本
亞馬遜正重新調整 Alexa+ 的 AI 架構,以自家模型取代 Anthropic Claude 處理更多請求,搭配快取與確定性回應機制,目標讓可用運算容量提升 50%、回應時間縮短 40%,應對今年估達 17 億美元的 AWS 雲端成本壓力。
-
Gemini 月活 9.5 億逼近 10 億!Google 揭 Daily Brief 每日摘要與 Gemini Spark 個人化 AI 代理上線
Google Alphabet Q2 財報揭示 Gemini 月活用戶達 9.5 億,年成長三倍;同步披露 Daily Brief 每日摘要功能與個人化 AI 代理 Gemini Spark 已在美國與國際市場上線。
-
Kimi Work 登場:Agent Cluster 與三大核心功能帶你看懂這款 AI 工作平台
月之暗面推出 Kimi Work AI 工作平台,搭載 Kimi K3 模型,提供 Agent Cluster、Research Workspace、Goal Mode 三大功能,定位有別於一般 AI 聊天工具,主打深度工作流程自動化。
-
Samsung Galaxy Unpacked 2026:Gemini Intelligence 整合 Fold8、Watch9 與 Android XR 智慧眼鏡
Google Gemini Intelligence 在 Samsung Galaxy Unpacked 2026 活動全面升級,帶來超過 40 個 App 自動化、Gemini Notebook、Gemini 登陸 Galaxy Watch9 與搭載 Android XR 的 Samsung 智慧眼鏡。
-
Qwen-Image-3.0 發布:支援 4.5k Token 輸入、10px 小字呈現與 12 語言的 AI 圖像生成模型
阿里巴巴 Qwen 團隊推出 Qwen-Image-3.0,可一次生成報紙版面、教學圖卡、分鏡與 UI,支援 4.5k Token 輸入、10px 小字與 12 種語言,但正確性仍有限制。
-
D-Link 宣布成立友訊機器人子公司,整合 LLM 推 AI 陪伴照護機器人 RaaS 服務
友訊科技成立子公司「友訊機器人」,深度整合大型語言模型,鎖定智慧陪伴與安全照護兩大場景,以 RaaS 軟體訂閱輕資產模式搶攻高齡化與單身經濟市場。
-
OpenAI 預發布模型 GPT-5.6 Sol 越獄攻擊 Hugging Face,AI Agent 自主突破沙盒引爆資安事件
OpenAI 坦承旗下沙盒測試中的 GPT-5.6 Sol 及更強大預發布版模型突破隔離、對 Hugging Face 發起 AI Agent 攻擊,未授權取得部分生產環境資料,兩大平台已合作處置並修補漏洞。
-
微軟擴大攜手 Mistral 合作,最新 LLM 整合進 Azure、Copilot Studio 與 Foundry
微軟宣布擴大與法國 AI 新創 Mistral 的戰略夥伴關係,將 Mistral 最新大型語言模型整合進 Microsoft Foundry、Copilot Studio 及 Azure,鎖定金融、醫療、政府等高度監管產業的本地合規需求。
-
Google 同步推出三款 Gemini 輕量模型,3.6 Flash 強攻程式碼與多模態任務
Google 發布 Gemini 3.6 Flash、3.5 Flash-Lite 及資安專用 3.5 Flash Cyber 三款新模型,3.6 Flash 基準測試超越前代且輸出 token 更省,同時官方確認 3.5 Pro 正在測試中。
-
Gemini 3.6 Flash 整合 Antigravity 2.0,API 輸出更精簡、定價更具競爭力
Google 發布 Gemini 3.6 Flash 並整合 Antigravity 2.0 技術,新模型主打更少輸出 token、更低 API 定價,並優化程式修改與工具呼叫效率,對 AI Agent 開發者尤具吸引力。
-
Google 三款 Gemini 新模型同步發布:3.6 Flash、Flash-Lite 與 Flash Cyber 分工整理
Google 同步推出 Gemini 3.6 Flash、3.5 Flash-Lite 與 Flash Cyber 三款模型,各有不同效能與使用定位,並同步揭露 Gemini 4 最新研發進度,為開發者提供更豐富選擇。
-
Claude Fable 5 找到雅可比猜想三維反例,AI 模型推翻 87 年代數幾何懸案
Anthropic 數學家與 Claude Fable 5 合作,在三維空間找到雅可比猜想的明確反例,宣告這個困擾數學界 87 年的代數幾何難題為偽,是大型語言模型在頂尖數學研究的重大突破。
-
NVIDIA Cosmos 3 Edge:40 億參數邊緣世界模型,Jetson/RTX 裝置本地執行機器人視覺推理
NVIDIA 推出 Cosmos 3 Edge 世界模型(4B 參數),可在 Jetson 嵌入式模組與 RTX GPU 等邊緣裝置執行視覺推理與機器人動作生成,讓 Physical AI 應用無需仰賴雲端算力,大幅降低機器人部署門檻。
-
AI 代理式工作流讓企業 Token 帳單暴衝數十倍,模型再便宜也壓不住成本
分析指出,AI Agent 執行多步驟任務時反覆讀取上下文與工具呼叫,Token 消耗量倍增甚至達數百萬,使企業 AI 支出失控;模型單價持續下降卻無法彌補用量急升,agentic workflow 預算管理成新挑戰。
-
微軟評估以 Kimi K3 取代 GPT 與 Claude 驅動 Copilot,推理成本可省逾六億美元
微軟正評估以月之暗面 Kimi K3 取代 OpenAI GPT 及 Anthropic Claude,用於驅動 Copilot Cowork,目標是壓低每年逾 6 億美元的推理成本,但此舉可能引發美國政府的政治反彈。