#AI 圖像生成
共 11 篇相關文章
-
Codex 驅動 GPT Image 配圖 Skill 開源:一鍵生成統一 3D 材質文章插圖
藏師傅釋出文章配圖 Skill 開源版,以 Codex 整合 GPT Image 2.0 自動產出 3D 材質風格插圖,支援工作彙報、數據圖表等四大場景,附自動審核與中文標籤功能。
-
豆包 AI 一鍵反推圖片提示詞,六大要素拆解快速複製同風格 AI 圖
豆包 AI 支援單一指令分析圖片並自動反推完整文生圖提示詞,覆蓋主體、場景、風格、色彩、構圖及細節六大要素,取得提示詞後可直接套用於各種 AI 繪圖平台批量生成同風格作品,大幅降低 AI 繪圖使用門檻。
-
ComfyUI 整合 GLIGEN 開源模型:標注畫面區域精確控制 AI 生圖,從隨機走向導演式可控
ComfyUI 整合了 GLIGEN 開源模型,讓用戶能在畫面指定區域進行標注式圖像生成,以邊界框告訴模型「在哪個位置生成什麼」,搭配 ComfyUI 節點工作流直觀操作,代表 AI 繪圖從隨機生成邁向精準空間可控的新階段,相關代碼已於 GitHub 開源。
-
Codex x Imagen 2 全流程實戰:AI 生成圖像直接輸出可編輯 PPTX 解決簡報痛點
本教學展示以 Codex 搭配 Imagen 2 製作 AI 簡報的完整流程,Imagen 2 負責生成風格統一的高品質投影片圖像,Codex 透過自製技能將圖像轉換為可完整編輯的 PPTX,解決 AI 生圖簡報「看得到卻改不了」的核心痛點,另提供 SVG 向量轉換路徑。
-
LTX Desktop 免費開源發布:本地 AI 非線性剪輯搭載 LTX 2.3 視頻生成模型
LTX 推出完全免費、全開源的本地 AI 非線性剪輯軟體 LTX Desktop,內建 LTX 2.3 視頻生成模型,可在剪輯軌道上直接 AI 重生成鏡頭或補過渡,開源社群已將顯存需求從 32GB 破解至 24GB。
-
Qwen-Image-3.0 發布:支援 4.5k Token 輸入、10px 小字呈現與 12 語言的 AI 圖像生成模型
阿里巴巴 Qwen 團隊推出 Qwen-Image-3.0,可一次生成報紙版面、教學圖卡、分鏡與 UI,支援 4.5k Token 輸入、10px 小字與 12 種語言,但正確性仍有限制。
-
Adobe Project Indigo 推出 AI Playground,拍完照立即在 App 內移除雜物或轉換插畫風格
Adobe 實驗性相機 App Project Indigo 新增 AI Playground,結合 Google Nano Banana 模型,讓使用者拍完照後可即時完成物件移除、風格轉換、光線調整及插畫化,無需切換工具。
-
HeyGen HyperFrames 全解析:30 天 AI 影片工作流教學 Day 1–12 從安裝到動態字幕
HeyGen 推出「30 Days of HyperFrames」系列教學,涵蓋安裝設定、Figma 整合、Prompt 生成到動態字幕,打造從構想到成品的完整 AI 影片製作流程,適合設計師與內容創作者入門。
-
開源 AI 衣櫥 Wardrobe:結合 GPT-5.6 Sol 從生活照辨識服裝,gpt-image 生成個人穿搭照
Wardrobe 是一款開源 AI 專案,利用 GPT-5.6 Sol 視覺模型從手機生活照辨識衣物並建立數位衣櫥,再透過 gpt-image 生成個人穿搭建議圖,支援本機部署以保護隱私。
-
Google 圖片搜尋 25 週年大改版:AI Overviews 整合 Gemini 直接在搜尋結果生成圖像
Google 為 Google Images 25 週年推出全新介面,將 Gemini 的 AI 圖像生成能力整合至 AI Overviews,讓使用者搜尋時可直接生成 AI 圖像,並加入個人化畫廊與收藏功能。
-
Meta 發布 Muse Image 圖像生成模型,Instagram 帳號引用爭議讓功能緊急下架
Meta 推出 Muse Image 圖像生成模型,允許以 @ 標註公開 Instagram 帳號作為生成風格參考,但未取得當事人同意的設計引發強烈反彈,Meta 宣布暫停該功能。