#Generative AI
共 50 篇相關文章
-
蘋果庫克透露 Siri AI 超額用量將需升級 iCloud+ 訂閱,Apple Intelligence 免費模式恐出現付費牆
蘋果執行長庫克在財報電話會議中首度暗示,Siri AI 重度用戶可能需升級 iCloud+ 訂閱才能獲得更多 AI 使用額度,Apple Intelligence 的商業模式正從完全免費轉向分層訂閱。
-
Google Docs 整合 Gemini 新增四項 AI 功能:自動整理討論串、草擬回覆、提出修改建議
Google 宣布 Gemini 在 Google Docs 新增四項以評論管理為核心的 AI 功能,可總結討論串、自動草擬回覆並根據審閱意見建議修改,本週起逐步向所有 Workspace 用戶推送。
-
Replit Design 正式推出:AI 設計、品牌系統與 App 建構整合一體,Figma/Canva 比較解析
Replit 推出 AI 設計工具 Replit Design,整合品牌系統建置、UI 版型生成與 App 直接部署,主打讓設計即開發,本文解析其功能定位與 Figma、Canva 的核心差異。
-
OpenAI 總裁布羅克曼宣告即將推出 AI 裝置家族,從智慧音箱到穿戴裝置全面進軍硬體
OpenAI 總裁 Greg Brockman 宣布公司正打造一整個「AI 裝置家族」,而非單一硬體,強調這些 AI 互動終端「很快」亮相,標誌 OpenAI 全面從軟體加速延伸至硬體領域。
-
月之暗面積極增購輝達 Blackwell 晶片,加速訓練下一代旗艦大模型 Kimi K4
中國 AI 新創月之暗面(Moonshot)正尋求更多輝達 Blackwell 晶片,用於訓練下一代模型 Kimi K4,延續 K3 的技術路徑,被視為中國 AI 持續追趕 OpenAI、Anthropic 的重要訊號。
-
Google AI 摘要滲透率從 15% 飆至 43%,AI 搜尋正在取代傳統網路入口
Similarweb 最新報告顯示,Google AI Overviews 在搜尋頁面的出現比例從 2025 年 15% 大幅攀升至 43%,AI 模式造訪量翻倍,Google 正從導流工具轉型為使用者的資訊終點站。
-
月之暗面開源 Kimi K3 全部模型權重:2.8 兆參數免費下載,效能緊追 Claude Fable 5
月之暗面(Moonshot AI)釋出 2.8 兆參數 Kimi K3 模型完整權重至 Hugging Face(1.56TB),基準測試優於前幾代 Claude 與 GPT,推理成本比閉源競品低 2-3 倍,吸引企業混合部署。
-
月之暗面開放 Kimi K3 下載:2.8 兆參數、百萬 Token 上下文,登頂全球最大開源權重模型
中國 AI 新創月之暗面正式開放 Kimi K3 下載,2.8 兆參數規模成為全球最大開源權重模型,搭配 100 萬 token 超長上下文,針對長文程式設計與推理任務優化,對開發者社群開放完整權重。
-
月之暗面開源模型 Kimi K3 伯克利盲測擊敗 Claude 與 GPT,17 歲研究員成第一作者
月之暗面推出開源大模型 Kimi K3,在伯克利盲測中超越 Claude 與 GPT 登頂全球第一,引發馬斯克驚嘆。第一作者竟是深圳 17 歲高中生陳廣宇,僅一年前對大模型一無所知。
-
Anthropic 試圖解剖 Claude 大腦:新可解釋性工具辨識 AI 反省行為以防惡意規劃
Anthropic 研究員在日經專訪說明,正以新分析工具深入解讀 Claude 形成答案前的概念與思路,嘗試偵測 AI 是否出現惡意規劃或欺騙傾向,這項可解釋性研究兼具科學與 AI 安全雙重意義。
-
Anthropic 發布 Claude Opus 5:以 Fable 一半價格達頂尖推理能力,成 Pro 方案新預設模型
Anthropic 正式推出 Claude Opus 5,定價為旗艦模型 Fable 5 的一半,但在多項推理與任務完成度指標上逼近前者表現,同時成為 Claude Pro 訂閱方案的預設模型,大幅降低企業使用高階 AI 的 Token 成本門檻。
-
Codex 驅動 GPT Image 配圖 Skill 開源:一鍵生成統一 3D 材質文章插圖
藏師傅釋出文章配圖 Skill 開源版,以 Codex 整合 GPT Image 2.0 自動產出 3D 材質風格插圖,支援工作彙報、數據圖表等四大場景,附自動審核與中文標籤功能。
-
豆包 AI 一鍵反推圖片提示詞,六大要素拆解快速複製同風格 AI 圖
豆包 AI 支援單一指令分析圖片並自動反推完整文生圖提示詞,覆蓋主體、場景、風格、色彩、構圖及細節六大要素,取得提示詞後可直接套用於各種 AI 繪圖平台批量生成同風格作品,大幅降低 AI 繪圖使用門檻。
-
ChatGPT Image 2 搭配即夢 Seedance 2.0 三步驟零門檻製作高品質 AI 影片教學
本教學示範以三步驟結合 ChatGPT Image 2 與即夢 Seedance 2.0 製作 AI 影片:先用 ChatGPT 生成電影感分鏡畫面,再讓它拆解鏡頭提示詞,最後投入 Seedance 2.0 自動生成影片,全流程不需剪輯知識,適合行銷人員與內容創作者快速上手。
-
NVIDIA 台北發布 Cosmos 3 物理 AI 模型:從虛擬跨入真實世界,賦能機器人精準操作
NVIDIA 在台北正式發布 Cosmos 3,全球首款開放式物理 AI 世界模型,具備對重力、摩擦、碰撞等物理規律的深度理解能力,讓機器人能在真實環境中精準預測物體行為並規劃動作,標誌 AI 向具身化邁出關鍵一步。
-
ComfyUI 整合 GLIGEN 開源模型:標注畫面區域精確控制 AI 生圖,從隨機走向導演式可控
ComfyUI 整合了 GLIGEN 開源模型,讓用戶能在畫面指定區域進行標注式圖像生成,以邊界框告訴模型「在哪個位置生成什麼」,搭配 ComfyUI 節點工作流直觀操作,代表 AI 繪圖從隨機生成邁向精準空間可控的新階段,相關代碼已於 GitHub 開源。
-
Codex x Imagen 2 全流程實戰:AI 生成圖像直接輸出可編輯 PPTX 解決簡報痛點
本教學展示以 Codex 搭配 Imagen 2 製作 AI 簡報的完整流程,Imagen 2 負責生成風格統一的高品質投影片圖像,Codex 透過自製技能將圖像轉換為可完整編輯的 PPTX,解決 AI 生圖簡報「看得到卻改不了」的核心痛點,另提供 SVG 向量轉換路徑。
-
Manus AI 一句指令串接 Notion 與 Gmail 自動生成專業週報 PPT,支援演講稿同步輸出
AI Agent 工具 Manus 支援以一句自然語言指令自動串接 Notion 與 Gmail,讀取專案資料後以 GPT Image 2 生成高品質資訊圖,產出媲美設計師排版的週報 PPT,並可同步生成演講稿,大幅縮短企業簡報製作時間。
-
美團開源 LongCat 2.0:1.6 兆參數 MOE 大模型全程以 5 萬張國產芯片完成預訓練
美團發布開源大模型 LongCat 2.0,具備 1.6 兆參數 MOE 架構,SWE-Bench Pro 代碼基準超越 GPT-5.5,更關鍵的是全程使用 5 萬餘張國產芯片穩定訓練超一個月、吃下 35 兆 Token,為國產算力訓練萬億模型提供有力實證。
-
LTX Desktop 免費開源發布:本地 AI 非線性剪輯搭載 LTX 2.3 視頻生成模型
LTX 推出完全免費、全開源的本地 AI 非線性剪輯軟體 LTX Desktop,內建 LTX 2.3 視頻生成模型,可在剪輯軌道上直接 AI 重生成鏡頭或補過渡,開源社群已將顯存需求從 32GB 破解至 24GB。
-
Gemini Personal Intelligence 實測:一分鐘掃描 Gmail 找出所有訂閱支出,免費帳戶即可用
Google Gemini 的 Personal Intelligence 功能可讀取 Gmail 信件,自動彙整訂閱收據與扣款通知,協助用戶快速掌握每月隱性消費;免費帳戶即可使用,無需升級付費方案。
-
Gemini 月活 9.5 億逼近 10 億!Google 揭 Daily Brief 每日摘要與 Gemini Spark 個人化 AI 代理上線
Google Alphabet Q2 財報揭示 Gemini 月活用戶達 9.5 億,年成長三倍;同步披露 Daily Brief 每日摘要功能與個人化 AI 代理 Gemini Spark 已在美國與國際市場上線。
-
Samsung Galaxy Unpacked 2026:Gemini Intelligence 整合 Fold8、Watch9 與 Android XR 智慧眼鏡
Google Gemini Intelligence 在 Samsung Galaxy Unpacked 2026 活動全面升級,帶來超過 40 個 App 自動化、Gemini Notebook、Gemini 登陸 Galaxy Watch9 與搭載 Android XR 的 Samsung 智慧眼鏡。
-
Qwen-Image-3.0 發布:支援 4.5k Token 輸入、10px 小字呈現與 12 語言的 AI 圖像生成模型
阿里巴巴 Qwen 團隊推出 Qwen-Image-3.0,可一次生成報紙版面、教學圖卡、分鏡與 UI,支援 4.5k Token 輸入、10px 小字與 12 種語言,但正確性仍有限制。
-
Gemini 3.6 Flash 整合 Antigravity 2.0,API 輸出更精簡、定價更具競爭力
Google 發布 Gemini 3.6 Flash 並整合 Antigravity 2.0 技術,新模型主打更少輸出 token、更低 API 定價,並優化程式修改與工具呼叫效率,對 AI Agent 開發者尤具吸引力。
-
Google 三款 Gemini 新模型同步發布:3.6 Flash、Flash-Lite 與 Flash Cyber 分工整理
Google 同步推出 Gemini 3.6 Flash、3.5 Flash-Lite 與 Flash Cyber 三款模型,各有不同效能與使用定位,並同步揭露 Gemini 4 最新研發進度,為開發者提供更豐富選擇。
-
Adobe Project Indigo 推出 AI Playground,拍完照立即在 App 內移除雜物或轉換插畫風格
Adobe 實驗性相機 App Project Indigo 新增 AI Playground,結合 Google Nano Banana 模型,讓使用者拍完照後可即時完成物件移除、風格轉換、光線調整及插畫化,無需切換工具。
-
Claude Fable 5 找到雅可比猜想三維反例,AI 模型推翻 87 年代數幾何懸案
Anthropic 數學家與 Claude Fable 5 合作,在三維空間找到雅可比猜想的明確反例,宣告這個困擾數學界 87 年的代數幾何難題為偽,是大型語言模型在頂尖數學研究的重大突破。
-
NVIDIA 於 SIGGRAPH 2026 發表深偽影片偵測工具,22 毫秒完成分析準確率達 92%
NVIDIA 在 SIGGRAPH 2026 發表 Synthetic Video Detector,可在 22 毫秒內偵測 AI 生成或竄改影片,準確率達 92%,已整合至 NIM 微服務架構,適用媒體與企業工作流程。
-
蘋果在 Apple Store 測試 AI「Live Notes」功能,自動逐字轉錄 Genius Bar 服務對話
蘋果正在部分 Apple Store 試行 AI 驅動的 Live Notes 系統,可即時轉錄並摘要 Genius Bar 技術服務對話,讓門市人員專注服務而非做筆記,是 Apple Intelligence 向企業內部流程延伸的信號。
-
月之暗面 Kimi K3 發布 48 小時後算力告急,全球最大開源模型暫停新用戶訂閱
中國 AI 新創月之暗面發布 Kimi K3 僅 48 小時後,因請求量超出算力極限即日起暫停 C 端新訂閱。Kimi K3 擁有 2.8 兆參數、100 萬 Token 上下文,為目前全球最大開源模型。
-
阿里巴巴在 WAIC 發布 Qwen3.8-Max 預覽版:2.4 兆參數多模態旗艦,開放權重即將釋出
阿里巴巴在上海 WAIC 大會亮相 Qwen3.8-Max-Preview,擁有 2.4 兆參數,是 Qwen 系列首款超兆參多模態模型,可處理圖像、影像與文件;團隊聲稱性能僅次於 Claude Fable 5,開放權重即將釋出。
-
Claude Fable 5 正式納入 Max 與 Team Premium 訂閱方案,用戶享 50% 額度,值得升級嗎?
Anthropic 的 Claude Fable 5 自 7 月 20 日起加入 Max 與 Team Premium 方案,但僅開放 50% 使用額度;文章比較 Pro、Max(每月 100 美元 credit)與 Team 定價,協助用戶評估升級效益。
-
月之暗面發布 Kimi K3:2.8 兆參數全球最大開源模型,48 小時自主完成半導體晶片設計
中國新創月之暗面(Moonshot AI)發布 Kimi K3,2.8 兆參數居全球開源 LLM 之冠,能在 48 小時內不借助商業 EDA 軟體,自主完成半導體晶片設計,展示大型語言模型在工程設計的突破潛力。
-
HeyGen HyperFrames 全解析:30 天 AI 影片工作流教學 Day 1–12 從安裝到動態字幕
HeyGen 推出「30 Days of HyperFrames」系列教學,涵蓋安裝設定、Figma 整合、Prompt 生成到動態字幕,打造從構想到成品的完整 AI 影片製作流程,適合設計師與內容創作者入門。
-
OpenAI Codex 驅動的 ChatCut AI 影片剪輯外掛教學:Prompt 完成字幕、MG 動畫到 MP4 匯出
ChatCut with Codex 是以 OpenAI Codex 為核心的 AI 影片剪輯 Plugin,透過 Prompt 指令即可完成口播初剪、繁體中文字幕、MG 動畫配樂與 MP4 匯出,大幅降低影片後製門檻。
-
Roblox 推手機版 AI 遊戲創作工具「Build」:輸入文字提示即可生成完整遊戲場景與機制
Roblox 推出行動版 AI 創作功能「Build」,使用者只需以文字描述遊戲概念,AI 即可自動生成遊戲機制、場景、角色、視覺風格與音效,結合 Roblox 自家模型與開源模型,大幅降低遊戲製作門檻。
-
Google AI Mode 升級:搜尋對話直接整合 Canva 設計、YouTube Music 播放清單與 Instacart 採買
Google AI Mode 在美國推出三大服務整合功能,使用者在搜尋對話中可透過 Canva 生成設計稿、透過 YouTube Music 建立播放清單、透過 Instacart 完成採購,AI 從「回答問題」進化為「直接辦事」的 Agentic 體驗。
-
Canva Code 2.0 全面開放:免寫程式用自然語言 Prompt 建網站、互動頁面與小型 App
Canva Code 2.0 向所有 Canva 用戶開放,可透過自然語言 Prompt、範本或 HTML 建立網站與互動頁面,並在 Canva 所見即所得介面中直接調整設計,是設計師與行銷人員的 AI 生產力新工具。
-
Thinking Machines Lab 發表首款開放權重模型 Inkling,MoE 架構總參數達 9750 億
由 OpenAI 前技術長 Mira Murati 共同創辦的 Thinking Machines Lab 於 7 月 15 日發表首款開放權重模型 Inkling,採混合專家(MoE)架構、支援多模態輸入,開發者可自由下載微調。
-
Mira Murati 新創 Thinking Machines 發布首款開放權重多模態模型 Inkling
前 OpenAI 技術長 Mira Murati 創辦的 Thinking Machines 推出首款 AI 模型 Inkling,採 975B 參數 MoE 架構,支援文字、圖片與音訊多模態,完整開放模型權重供企業微調與私有部署。
-
ChatGPT 結合 Canva 三大實用玩法:Magic Layers 將 AI 圖片拆成可編輯圖層
AI郵報整理三種 ChatGPT 搭配 Canva 的設計工作流:啟用 Magic Layers 將 AI 生成圖片拆分為可編輯圖層、自動生成社群素材,以及在對話中搜尋並修改既有設計,大幅降低設計師手工操作時間。
-
OpenAI 官方 GPT-5.6 提示詞指南:精簡冗長規則、Evals 量化優化與三組實戰範例完整解析
OpenAI 針對 GPT-5.6 發布官方提示詞撰寫指南,建議精簡冗長指令、設定 Stop rules 與成功標準,搭配 3 組實戰範例及 Evals 框架驗證優化成效,協助開發者更有效率地駕馭新模型。
-
OpenAI 首款硬體曝光:無螢幕智慧音箱內建 GPT-Live,主打 AI 時代全新家用電腦
彭博社報導,OpenAI 正優先開發一款配備鏡頭與感測器、可在家中移動的無螢幕智慧音箱,搭載 GPT-Live 即時對話模型,定位為 AI 時代的全新家用電腦,是其消費電子布局的首款產品。
-
Google 圖片搜尋 25 週年大改版:AI Overviews 整合 Gemini 直接在搜尋結果生成圖像
Google 為 Google Images 25 週年推出全新介面,將 Gemini 的 AI 圖像生成能力整合至 AI Overviews,讓使用者搜尋時可直接生成 AI 圖像,並加入個人化畫廊與收藏功能。
-
EverMemOS 研究突破:讓 AI 代理人跨越數天執行任務的自動記憶作業系統
研究人員首創 EverMemOS——將 AI 記憶管理提升至 OS 生命週期層級的自動組織記憶作業系統,解決 LLM 上下文窗口限制導致的 AI Agent「健忘症」,使智慧代理人得以持續執行跨越數天的複雜長效推理任務。
-
iOS 27 公測版上線,全新 Siri AI 與 Apple Intelligence 功能大幅擴充
蘋果正式釋出 iOS 27 公開測試版,核心亮點為全新 Siri AI 與 Apple Intelligence 擴充,一般用戶無需開發者帳號即可搶先體驗,正式版將隨 2026 年新 iPhone 推出。
-
Google 相簿 AI 影片工具 Video Remix 上線,Gemini Omni 驅動零門檻影音剪輯
Google 相簿推出由 Gemini Omni 模型驅動的 AI 影片創作功能 Video Remix,使用者只需點幾下即可完成影片剪輯,無需任何專業技能或軟體,是 Google 持續強化相簿 AI 功能的最新成果。
-
Meta 發布 Muse Image 圖像生成模型,Instagram 帳號引用爭議讓功能緊急下架
Meta 推出 Muse Image 圖像生成模型,允許以 @ 標註公開 Instagram 帳號作為生成風格參考,但未取得當事人同意的設計引發強烈反彈,Meta 宣布暫停該功能。
-
AI 新模型競逐成本效率:GPT-5.6、Grok 4.5、Muse Spark 1.1 同台較勁
OpenAI、SpaceXAI(原 xAI)與 Meta 同週推出新模型,競賽焦點轉向誰能以更低 token 成本完成更多工作,標誌 AI 產業進入「省錢比拼」新階段。