AI 硬體名詞庫GLOSSARY

先把 AI 硬體名詞查清楚

NPU、TOPS、VRAM、unified memory、token、RAG 這些字常被混在一起講。名詞庫會先給一句話定義,再拆用途與常見誤解。

01
名詞解釋更新 2026-08-02

Edge AI

Edge AI 是把 AI 應用或推論放在靠近資料產生地的裝置、機器、手機、工廠、車輛、門市或邊緣伺服器上執行,而不是完全依賴雲端資料中心。

02
名詞解釋更新 2026-08-12

NPU

NPU 是 Neural Processing Unit,通常指用來加速 AI 推論、降低功耗,並支援系統或應用 AI 功能的專用處理單元。

03
名詞解釋更新 2026-08-10

RAG

RAG 是 Retrieval-Augmented Generation,中文常翻成檢索增強生成;意思是模型回答前先檢索外部資料,再用查到的內容輔助生成回答。

04
名詞解釋更新 2026-09-19

TOPS

TOPS 是 Trillions of Operations Per Second,表示每秒兆次運算;它通常描述 NPU、GPU 或 AI 加速器在特定資料精度與條件下的理論運算能力。

05
名詞解釋更新 2026-08-20

Unified Memory

Unified Memory 中文常譯為統一記憶體或統一記憶體架構,指 CPU、GPU 共享同一個實體記憶體池;它能減少重複資料與搬移,但不等於傳統獨立 VRAM。

06
名詞解釋更新 2026-08-26

VRAM

VRAM 是 Video Random Access Memory,中文常稱顯示記憶體或顯存。獨立顯卡上的 VRAM 是 GPU 可直接使用的高速工作空間;在 AI 工作中,它常決定模型權重、context 與中間狀態能不能留在 GPU 裡跑。