AI 主題集合

機器學習 術語大全

完整收錄 437 個 機器學習 相關 AI 術語,每個術語提供中英文定義、深度解說與 iPAS 考試重點分析。

AI 氣候模型(Climate Modeling with AI)

AI 氣候模型是指使用機器學習加速和改進氣候模擬和預測的技術。AI 能從大規模氣象數據中學習複雜的氣候動態,提高預測準確性和計算效率,支持氣候變化研究和政策制定。

查看術語

感知器(Perceptron)

感知器是最簡單的神經網路模型,模擬生物神經元,接收輸入、加權求和、通過激活函數輸出,用於二元分類。

查看術語

樸素貝氏(Naive Bayes)

樸素貝氏分類器是一種基於貝氏定理的簡單機率分類器。它假設所有特徵之間相互獨立,簡化了計算複雜度,因此得名「樸素」。常用於文本分類等任務。

查看術語

資料擴增術(Data Augmentation)

資料擴增術是一種增加訓練資料多樣性的技術,透過對現有資料進行微小的修改,創造出新的、但仍然代表相同類別的資料點,以提升模型泛化能力。

查看術語

Sigmoid 函數(Sigmoid)

Sigmoid 函數是一種將任意實數壓縮到 (0, 1) 區間的 S 形曲線,公式為 σ(x) = 1/(1+e⁻ˣ),常作為神經網路的激活函數及邏輯斯迴歸的輸出層,用於將線性輸出轉換為機率值。

查看術語

接收者操作特徵曲線(ROC)

接收者操作特徵曲線(Receiver Operating Characteristic Curve)是以偽陽性率為橫軸、真陽性率為縱軸,透過改變分類閾值所繪製的曲線,用於評估二元分類模型在不同閾值下的

查看術語

選項框架(Option Framework)

選項框架是層次化強化學習中的數學模型,透過將基礎動作抽象為高階宏觀動作,幫助智能體在複雜環境中進行長時間跨度的規劃與決策。

查看術語

K 近鄰演算法(KNN)

K 近鄰演算法(K-Nearest Neighbors, KNN)是一種非參數式監督學習演算法,透過尋找訓練集中距離最近的 K 個樣本進行多數投票(分類)或加權平均(回歸),無需建立顯式的模型參數。

查看術語

張量處理單元(TPU)

張量處理單元(TPU)是Google專為加速機器學習工作負載而設計的客製化硬體加速器,尤其擅長處理張量運算,是深度學習的利器。

查看術語

模型參數(Parameters)

模型參數是機器學習模型在訓練過程中學習到的數值,用於決定模型如何對輸入資料進行轉換和預測。它們是模型的內部變數。

查看術語

KL散度(KL Divergence)

KL散度(Kullback-Leibler Divergence)衡量兩個機率分佈的差異,數值越大代表分佈差異越大,常用於評估模型預測分佈與真實分佈的接近程度。

查看術語

隱式回饋(Implicit Feedback)

使用者在與推薦系統互動時被動產生的行為信號(如點擊、購買、停留時間),相對於明確評分等顯式回饋,隱式回饋資料量更大但含義更模糊。

查看術語

機器人學(Robotics)

機器人學是設計、建造、操作和應用機器人的科學和工程學科,涉及機械工程、電子工程、電腦科學等多個領域。

查看術語

熵(Entropy)

熵是資訊理論中衡量隨機變數不確定性的指標,數值越高代表不確定性越大。在機器學習中,熵常用於特徵選擇和決策樹構建。

查看術語

概念漂移(Concept Drift)

概念漂移是指機器學習模型在部署後,由於資料分佈隨時間變化,導致模型預測準確度下降的現象。需要持續監控並重新訓練模型。

查看術語

提升算法(Boosting)

Boosting 是一種集成學習技術,透過迭代訓練一系列弱學習器,每個學習器都試圖糾正前一個學習器的錯誤,最終將它們組合起來形成一個強學習器。

查看術語

醫療 AI(Medical AI)

醫療 AI 是指應用於醫療診斷、治療和管理的人工智能技術。它使用機器學習和深度學習對醫學影像進行分析、輔助診斷、預測患者風險和個性化治療方案。

查看術語

前綴調整法(Prefix Tuning)

前綴調整法是一種參數高效的微調技術,通過在輸入序列前添加可訓練的前綴向量,來引導預訓練模型生成期望的輸出,同時保持原始模型參數凍結。

查看術語

共變異數(Covariance)

共變異數衡量兩個變數如何一起變化。正值表示它們趨於一起增加或減少,負值表示一個增加時另一個趨於減少,零值表示沒有線性關係。

查看術語

獎勵駭客攻擊(Reward Hacking)

一種在強化學習系統中出現的現象,指智能體發現並利用獎勵函數的漏洞或意外行為來獲得高分,而不是實現設計者的實際目標。這種遺漏通常源於獎勵函數與真實目標之間的不完全對齐。

查看術語

聊天機器人(Chatbot)

聊天機器人是一種能模擬人類對話的電腦程式,透過文字或語音與使用者互動,提供資訊、協助解決問題或執行特定任務。

查看術語

自我對弈(Self-play)

自我對弈是一種強化學習技術,其中智能體與自身的副本進行對弈,從而學習和改進策略,無需外部人類或標記數據。

查看術語

重排序模型(Reranking)

重排序模型是一種在初步檢索後,對候選結果進行重新排序的技術,旨在提升檢索結果的相關性和準確性,通常使用更複雜的模型。

查看術語

對數損失(Log Loss)

對數損失(Log Loss)是交叉熵損失在二元分類問題中的特殊形式,衡量模型預測機率與真實標籤之間的差異,數值越小代表模型表現越好。

查看術語

合成數據(Synthetic Data)

合成數據是指通過程式或演算法生成的人工數據,而非從真實世界收集的數據。它常用於訓練AI模型,特別是在真實數據稀缺或涉及隱私問題時。

查看術語

資料偏誤(Data Bias)

訓練資料中存在的系統性偏差,使模型對特定群體或情境產生不公平或不準確的預測結果,是 AI 公平性問題的主要根源之一。

查看術語

規模定律(Scaling Law)

規模定律描述了模型性能如何隨著模型大小、訓練數據量和計算資源的增加而變化。它提供了一種預測模型性能的經驗關係。

查看術語

推理能力(Reasoning)

推理能力是指AI系統基於已知資訊和規則,進行邏輯推導,得出結論或解決問題的能力。是AI模擬人類智慧的關鍵組成部分。

查看術語

貝氏最佳化(Bayesian Optimization)

貝氏最佳化是一種用於最佳化黑盒函數的演算法,它使用貝氏模型來建立目標函數的代理模型,並利用該模型來選擇下一個要評估的點,以在最少的迭代次數內找到最佳解。

查看術語

藥物發現(Drug Discovery)

藥物發現是指使用 AI 和機器學習從海量化學分子中識別和優化具有治療潛力的藥物候選物。AI 可以加速分子篩選、性質預測和優化過程,將藥物開發週期從十年縮短為數年。

查看術語

分層抽樣(Stratified Sampling)

分層抽樣是一種統計抽樣方法,將母體依據特定特徵劃分為互斥的子群體(層),再從各層中獨立抽樣。這確保了各層在樣本中的代表性,能有效降低抽樣誤差,特別適用於處理不平衡資料集。

查看術語

低秩適配(LoRA)

LoRA是一種參數高效的微調技術,透過學習低秩矩陣來適應預訓練模型,大幅減少訓練參數,降低計算成本。

查看術語

邏輯迴歸(Logistic Regression)

邏輯迴歸是一種廣義線性模型,用於預測二元或多元分類結果的機率。它使用 Sigmoid 函數將線性組合轉換為機率值,並透過最大似然估計來訓練模型。

查看術語

安全多方計算(MPC)

安全多方計算(Multi-Party Computation,MPC)是一種密碼學協議,允許多方在不揭露各自私有輸入資料的前提下,共同計算某個函數的結果,廣泛應用於聯邦學習、隱私保護 AI 推論等場景

查看術語

曲線下面積(AUC)

AUC(曲線下面積)是一種模型評估指標,用於衡量二元分類模型區分正負樣本的整體能力,值介於0到1之間,越高代表性能越好。

查看術語

相關係數(Correlation)

相關係數衡量兩個變數之間線性關係的強度和方向,範圍從 -1 到 1。1 表示完全正相關,-1 表示完全負相關,0 表示沒有線性關係。

查看術語

高基數特徵(High Cardinality)

高基數特徵(High Cardinality)指某個類別型特徵包含大量不同取值的情況,例如用戶 ID、商品 SKU、地理位置等可能有數萬至數百萬種取值,直接進行 One-Hot 編碼會導致維度爆炸,需

查看術語

排序(Ranking)

排序是信息檢索系統的核心功能,指根據相關性、質量、流行度等指標,將檢索結果按優先級排列,使用戶最快找到需要的信息。

查看術語

資料投毒攻擊(Data Poisoning)

資料投毒攻擊是一種惡意攻擊,攻擊者將惡意或錯誤的資料注入到訓練資料集中,以影響機器學習模型的性能或行為。攻擊目標是使模型產生錯誤的預測或執行其他有害操作。

查看術語

資料洩漏(Data Leakage)

資料洩漏(Data Leakage)是指模型訓練過程中,未來或測試集的資訊意外滲入訓練集,導致模型在評估時表現虛高,但部署後實際效能大幅下滑的現象。

查看術語

隨機搜尋(Random Search)

隨機搜尋是一種超參數最佳化方法,它在預定義的超參數空間中隨機選擇參數組合,並評估其性能,以找到最佳的超參數配置。

查看術語

推論(Inference)

推論是指利用已訓練好的機器學習模型,對新的、未曾見過的資料進行預測或判斷的過程。是模型部署後的核心環節。

查看術語

抓取規劃(Grasp Planning)

抓取規劃是機器人學中的核心技術,旨在為機器人手臂規劃出有效且穩定的抓取動作,以成功拾取、移動或操作物體,確保任務執行效率與安全性。

查看術語

拉普拉斯平滑(Laplace Smoothing)

拉普拉斯平滑(Laplace Smoothing)又稱加一平滑,是貝氏統計中避免零機率問題的技術,在計算類別條件機率時,將每個類別的計數加上常數 α(通常為 1),防止訓練集未見過的詞彙或特徵使整個機

查看術語

規劃(Planning)

在人工智慧中,規劃是指為達成特定目標,自動生成一系列行動步驟的過程。它涉及預測行動的結果,並選擇最佳的行動序列。

查看術語

隱藏狀態(Hidden State)

隱藏狀態是神經網路中用於儲存與傳遞歷史資訊的內部記憶向量,負責在處理序列資料時保留上下文特徵,協助模型理解時序依賴關係。

查看術語

圖形處理器(GPU)

圖形處理器(GPU)是一種專為並行處理設計的電子電路,最初用於加速圖像渲染,現廣泛應用於深度學習等需要大量計算的領域。

查看術語

光學字元辨識(OCR)

光學字元辨識(OCR)是一種技術,能將圖像中的文字轉換為機器可讀的文字格式,例如將掃描文件轉換為可編輯的文字。

查看術語

詐欺偵測(Fraud Detection)

AI 詐欺偵測(Fraud Detection)透過機器學習即時分析交易行為,識別異常模式,廣泛應用於銀行信用卡詐欺防範、網路詐騙偵測與保險理賠審核。

查看術語

模型竊取(Model Stealing)

模型竊取是一種針對機器學習模型的網路安全攻擊手法。攻擊者透過大量且有系統地向目標模型的應用程式介面發送查詢,並記錄其回傳的預測結果,藉此訓練出一個功能與原始目標高度相似的替代模型。

查看術語

隨機過採樣(Random Oversampling)

隨機過採樣(Random Oversampling)是處理類別不平衡問題的技術,透過隨機複製少數類別的現有樣本,使各類別的訓練樣本數趨於平衡,讓模型對少數類別有足夠的學習機會,但有增加過擬合風險的疑慮

查看術語

階層式分群(Hierarchical Clustering)

階層式分群(Hierarchical Clustering)是一類無監督學習演算法,透過逐步合併最相似的群組(凝聚法)或分裂群組(分裂法)來建立樹狀結構的群組層次,不需預先指定群數。

查看術語

正則化(Regularization)

正則化是一種在機器學習中用於防止模型過度擬合的關鍵技術,它透過在損失函數中引入懲罰項,有效限制模型參數的複雜度,從而提升模型的泛化能力。

查看術語

深度Q網路(Deep Q-Network)

深度Q網路(DQN)是一種結合深度學習與Q學習的強化學習演算法,利用深度神經網路逼近Q函數,解決高維度狀態空間的強化學習問題。

查看術語

對偶學習(Dual)

利用互逆任務(如中翻英與英翻中)之間的結構對稱性,建構閉環反饋系統以提升機器學習效能的無監督訓練框架。

查看術語

適配器模組(Adapter)

適配器模組是一種輕量級的模型微調方法,透過在預訓練模型中插入少量可訓練參數,以適應特定任務,同時保持原始模型參數凍結。

查看術語

先知預測模型(Prophet)

Prophet是由Facebook開發的時間序列預測模型,專為具有強烈季節性趨勢的商業時間序列資料設計,易於使用且具有良好的預測能力。

查看術語

泛化能力(Generalization)

泛化能力是指機器學習模型在未見過的數據上表現良好的能力。一個具有良好泛化能力的模型能夠從訓練數據中學習到普遍規律,並應用於新數據。

查看術語

留一交叉驗證(LOOCV)

留一交叉驗證(Leave-One-Out Cross-Validation, LOOCV)是 K 折交叉驗證的特例,每次將一個樣本作為驗證集,其餘所有樣本作為訓練集,重複執行 N 次(N 為樣本數),

查看術語

節點嵌入(Node Embedding)

節點嵌入是一種將圖形結構中的節點轉換為低維度連續向量的技術,目的是保留節點在原圖中的網絡拓樸與特徵資訊,以便於後續進行各類機器學習任務。

查看術語

人工智慧監管(AI Regulation)

人工智慧監管是指政府或相關機構制定和實施的,旨在規範人工智慧技術開發、部署和使用的法律、政策和指導方針,以確保其安全、公平和符合倫理。

查看術語

標籤分布漂移(Label Drift)

標籤分布漂移(Label Drift)指模型在生產環境中遭遇的目標變數(標籤)分布與訓練時不同的現象,例如詐欺偵測中詐欺案件占比從 1% 升至 5%,導致原本校準好的模型閾值和效能指標失效,需觸發再訓

查看術語

金融 AI(Financial AI)

金融 AI 是指應用於金融市場預測、風險管理、詐欺偵測和投資決策的人工智能技術。它使用機器學習分析大量財務數據和市場信號,提升交易策略的性能和降低風險。

查看術語

地理空間AI(Geospatial AI)

地理空間AI結合人工智慧與地理空間資料,分析地球表面現象,從衛星影像、地圖和感測器數據中提取洞察,支援智慧城市、環境監測等應用。

查看術語

U型網路(U-Net)

U-Net是一種用於圖像分割的深度學習模型,其架構呈U型,包含編碼器和解碼器,能有效捕捉圖像的上下文資訊和精確定位分割邊界。

查看術語

自助聚合(Bagging)

Bagging (Bootstrap Aggregating) 是一種集成學習技術,透過對原始資料集進行多次有放回的抽樣,訓練多個模型,並將它們的預測結果進行平均或投票。

查看術語

冷啟動問題(Cold Start Problem)

冷啟動問題是指在推薦系統中,對於新使用者或新物品,由於缺乏足夠的互動資料,導致無法準確推薦的問題。常見解決方案包括利用元資料、內容過濾或混合推薦。

查看術語

常見問題

機器學習 是什麼?

本頁依已發布術語的主題標記,整理 437 個 機器學習 相關概念。

機器學習 有哪些核心術語?

流匹配、詞義消歧、稀疏注意力機制、支援向量迴歸、網路釣魚偵測

機器學習 相關術語在 iPAS 考試中重要嗎?

本頁有 41 個術語標記為 iPAS 相關。