#RAG
共 6 篇相關文章
-
Microsoft MarkItDown 完整教學:Word、PDF、Excel 一鍵轉 Markdown 大幅降低 AI Token 消耗
Microsoft 官方開源工具 MarkItDown 能將 Word、PDF、PowerPoint、Excel 轉為 Markdown,讓 ChatGPT、Claude 等大型語言模型更高效解析文件,同時大幅降低 Token 消耗、減少幻覺,是 RAG 與 AI 文件前處理流程的實用利器。
-
DeepSeek 與北大聯合推出 DSpark,LLM 推理速度最高提升 85%
DeepSeek 攜手北京大學發布推理加速框架 DSpark,採半自回歸生成架構與置信度調度驗證機制,解決大型語言模型在高併發場景下的效率瓶頸,推理速度最高提升 85%,並同步開源模型權重。
-
逐鹿數位推出 HyperGrid:從 VMware 替代方案到支援 AI Agent、RAG 的企業 AI-Ready 基礎架構
台灣逐鹿數位推出新一代企業 AI 平台 HyperGrid,在 VMware 授權費大漲引發遷移潮之際,提供同時涵蓋虛擬化替代與 AI Agent、RAG 工作負載支援的整合方案,協助企業直接在同一套基礎架構完成虛擬化遷移並部署 Agentic AI。
-
開源 RAG 專案整合 Qdrant 混合搜尋與章節樹索引,大幅提升文件問答精準度
GitHub 開源專案 Hybride_pageindex_RAG 以 MiniU 解析 PDF 等文件,結合 Qdrant 混合搜尋與 Pageindex 章節樹索引,讓 RAG 系統能依文件層次精準定位段落,改善傳統 chunk 切割的上下文斷裂問題。
-
TurboVec 開源向量索引:Rust 實作 TurboQuant、附 Python 綁定,加速 AI 相似度搜索
RyanCodrai 在 GitHub 發布 turbovec,一個基於 TurboQuant 量化技術的向量索引,以 Rust 撰寫並提供 Python 綁定,可用於高效能近似最近鄰搜索(ANN)工作負載。
-
Karpathy 提出 LLM Wiki:讓 AI 主動維護知識庫,打造會自我演化的第二大腦
OpenAI 創始成員 Andrej Karpathy 提出 LLM Wiki 概念,讓 LLM 持續整理並更新知識庫,與 RAG 的靜態查詢不同,是知識系統能自我演化的新玩法,可搭配 Obsidian 等工具實作。