烏克蘭開發者 slvDev 近日在 GitHub 發表開源專案「ESP32-AI」,成功讓 2,890 萬參數的語言模型,完全離線運行在售價約 10 美元(約新台幣 300 元)的 ESP32-S3 微控制器上,以每秒約 9.5 個詞元的速度即時輸出文字,整個過程完全不需連線伺服器。
重點
- 極限硬體挑戰:ESP32-S3 僅有 512KB SRAM 與 8MB PSRAM,遠低於一般推論所需資源
- 記憶體分層技術:借鑑 Google 的分層技術,將模型分層存放於不同速度的記憶體空間,實現超低資源推論
- 完全離線運作:模型推論全程不需連線伺服器,適合 IoT、嵌入式與隱私敏感場景
- 開源可複現:專案已公開在 GitHub,開發者社群高度關注並可自行嘗試部署
編輯按
ESP32-AI 展示的不是最強的 AI 能力,而是「用最少資源做到多少」的工程極限。這種邊緣 AI 技術對 IoT 設備的離線應用、智慧感測器、嵌入式系統都有直接啟發意義,是值得追蹤的開源里程碑。
本文由 AI 整理,原文:TechNews 科技新報