Layer detail|層級說明
Layer
說明
這一層在做什麼
-
畫面上發生什麼事
-
Operation|數學操作
-
載入 Three.js r184 WebGPU build、建立 VGG16 層級隧道與池化顯微動畫。
VGG16 Observatory
上傳圖片後,觀察 Input → Convolution → ReLU → Max Pooling → Flatten → Dense 的 3D 資料流。按下播放或點選任一層後,這裡會切換成 Layer Inspector。
Layer inspector
輸入圖片會被標準化成 224×224×3 tensor,接著流入第一個卷積區塊。
Operation
Layer detail|層級說明
說明
-
-
-
VGG16 是經典深度 CNN,iPAS 影像考點(中級科目一與三)。重點:16 層、全部用 3x3 小卷積堆疊,結構簡單規整,是影像分類里程碑與常用骨幹。易混點:多個 3x3 堆疊可達大卷積核的感受野但參數更少;VGG 參數量大(尤其全連接層)、運算重,後來 ResNet 用殘差以更少參數達更好效果。情境:遷移學習的特徵抽取器、理解深層 CNN 結構。
想練情境題與詳解 → AI 學習與考證地圖
2014 年提出的經典 CNN,16 層、全部用 3x3 小卷積堆疊;結構簡單規整,是影像分類的里程碑與常用骨幹。
多個 3x3 堆疊能達到大卷積核的感受野,但參數更少、非線性更多;成為日後架構的常見設計。
數個卷積加卷積加池化的區塊逐步縮小空間、加深通道,最後接全連接層分類;越深特徵越抽象。
參數量大(尤其全連接層)、運算重、記憶體吃緊;後來 ResNet 等用更少參數達到更好效果。
結構清楚、適合教學與視覺化、常作遷移學習的特徵抽取器;是理解深層 CNN 的好起點。