AI 主題集合

電腦視覺 術語大全

完整收錄 158 個 電腦視覺 相關 AI 術語,每個術語提供中英文定義、深度解說與 iPAS 考試重點分析。

機器人視覺(Computer Vision in Robotics)

機器人視覺是指機器人使用攝像頭和深度傳感器配合計算機視覺算法,感知和理解視覺世界,完成抓取、組裝、檢測等任務。它使機器人能在動態環境中自主操作,廣泛應用於製造、物流和醫療。

查看術語

紅綠藍色彩模型(RGB)

以紅(Red)、綠(Green)、藍(Blue)三原色疊加表示顏色的加法混色模型,是數位影像與電腦視覺任務中圖像表示的基礎格式。

查看術語

自駕車(Autonomous Vehicles)

自駕車是指無需人類駕駛員干預,能自主感知環境、做出決策和控制行駛的車輛。自駕系統整合了計算機視覺、傳感器融合、路徑規劃和深度學習,是 AI 應用中最複雜的系統。

查看術語

焦點損失函數(Focal Loss)

焦點損失函數 (Focal Loss) 是一種用於解決物件偵測中類別不平衡問題的損失函數,它通過降低易分類樣本的權重,使模型更關注難分類樣本。

查看術語

資料擴增術(Data Augmentation)

資料擴增術是一種增加訓練資料多樣性的技術,透過對現有資料進行微小的修改,創造出新的、但仍然代表相同類別的資料點,以提升模型泛化能力。

查看術語

控制網路(ControlNet)

ControlNet 是一種神經網路結構,用於控制大型擴散模型,例如 Stable Diffusion,以實現更精確的圖像生成控制,例如基於草圖或邊緣圖生成圖像。

查看術語

影像描述生成(Image Captioning)

影像描述生成(Image Captioning)是電腦視覺與自然語言處理的交叉任務,旨在讓模型自動為輸入影像產生自然語言描述,是多模態 AI 的核心應用之一,評估指標常用 BLEU、CIDEr、SPI

查看術語

移動網路(MobileNet)

MobileNet是一種針對移動和嵌入式設備設計的輕量級深度神經網路架構,旨在實現高效的資源利用和快速的推論速度。

查看術語

機器人學(Robotics)

機器人學是設計、建造、操作和應用機器人的科學和工程學科,涉及機械工程、電子工程、電腦科學等多個領域。

查看術語

膠囊網路(Capsule Network)

膠囊網路是一種神經網路架構,旨在解決卷積神經網路在處理物件方向和空間關係上的不足,透過膠囊和路由機制,更有效地捕捉物件的層次結構。

查看術語

特徵圖(Feature Map)

特徵圖是卷積神經網絡中,經過卷積層運算後所產生的多維陣列,用於呈現輸入資料的特定局部特徵與空間結構。

查看術語

光達資料處理(LiDAR Processing)

光達資料處理是指對雷射雷達感測器採集的三維點雲資料進行清理、分析與解釋的過程,旨在從中提取有意義的空間資訊,廣泛應用於自動駕駛、測繪與環境監測等領域。

查看術語

你只看一次(YOLO)

YOLO (You Only Look Once) 是一種即時物件偵測演算法,它將物件偵測視為一個迴歸問題,直接從完整圖像預測邊界框和類別機率。

查看術語

殘差網路(ResNet)

ResNet是一種深度學習模型,透過引入殘差連接解決深度神經網路訓練時的梯度消失問題,允許網路學習殘差映射而非直接映射。

查看術語

推論(Inference)

推論是指利用已訓練好的機器學習模型,對新的、未曾見過的資料進行預測或判斷的過程。是模型部署後的核心環節。

查看術語

抓取規劃(Grasp Planning)

抓取規劃是機器人學中的核心技術,旨在為機器人手臂規劃出有效且穩定的抓取動作,以成功拾取、移動或操作物體,確保任務執行效率與安全性。

查看術語

圖形處理器(GPU)

圖形處理器(GPU)是一種專為並行處理設計的電子電路,最初用於加速圖像渲染,現廣泛應用於深度學習等需要大量計算的領域。

查看術語

光學字元辨識(OCR)

光學字元辨識(OCR)是一種技術,能將圖像中的文字轉換為機器可讀的文字格式,例如將掃描文件轉換為可編輯的文字。

查看術語

卷積層(Convolutional Layer)

神經網路中利用卷積運算自動提取局部特徵的層級,通過多個小尺寸濾波器滑動掃描輸入數據,能有效減少參數數量並增強空間特徵學習能力。

查看術語

圖像識別(Image Recognition)

圖像識別是電腦視覺領域的一項任務,旨在識別圖像中的對象、人物、地點或事件。它比圖像分類更廣泛,可能涉及定位和標記圖像中的多個對象。

查看術語

錨框(Anchor Box)

錨框(Anchor Box)是在目標檢測中預先定義的一系列具有不同大小和長寬比的矩形框,用於在圖像中生成候選區域,以便模型進行目標分類和邊界框回歸。

查看術語

顯著性地圖(Saliency Map)

顯著性地圖是一種圖像處理技術,用於突出顯示圖像中最引人注目的區域。它通過計算每個像素的顯著性得分來實現,得分越高表示該區域越顯著。

查看術語

地理空間AI(Geospatial AI)

地理空間AI結合人工智慧與地理空間資料,分析地球表面現象,從衛星影像、地圖和感測器數據中提取洞察,支援智慧城市、環境監測等應用。

查看術語

U型網路(U-Net)

U-Net是一種用於圖像分割的深度學習模型,其架構呈U型,包含編碼器和解碼器,能有效捕捉圖像的上下文資訊和精確定位分割邊界。

查看術語

常見問題

電腦視覺 是什麼?

本頁依已發布術語的主題標記,整理 158 個 電腦視覺 相關概念。

電腦視覺 有哪些核心術語?

機器人視覺、辨識品質、文字轉圖像生成、文字生成3D模型、光流估計

電腦視覺 相關術語在 iPAS 考試中重要嗎?

本頁有 20 個術語標記為 iPAS 相關。