提前終止 Early Stopping
提前終止是一種機器學習訓練技巧,藉由監控驗證損失,在模型過度擬合前及早停止訓練,以提高泛化能力。
查詢 Transformer、RAG、AI Agent 等 AI 術語,包含定義、iPAS 考點分析、常見問題與 Markdown 版本。
提前終止是一種機器學習訓練技巧,藉由監控驗證損失,在模型過度擬合前及早停止訓練,以提高泛化能力。
邊緣人工智慧是指在靠近資料來源的邊緣設備上執行AI運算,而非在雲端伺服器上。可降低延遲、節省頻寬、保護隱私。
將計算與資料處理從中心化雲端移至靠近資料來源的終端裝置或區域節點,以降低延遲並減少頻寬需求。
邊緣運算AI是在終端裝置直接執行人工智慧模型的技術,具備低延遲、省頻寬與強化隱私保護等核心優勢。
識別影像中的邊界與輪廓線,通常輸出二值圖像或邊界概率圖,是許多高級視覺任務的前置步驟。
邊緣裝置指位於網路邊緣、靠近資料生成源頭的硬體設備,能在本地端直接執行資料處理與 AI 模型推論任務。
邊緣推理是在邊緣設備(如手機、物聯網設備、智能硬體)本地執行機器學習模型推理,而不是發送請求到遠端伺服器。它具有低延遲、隱私保護、離線可用等優勢。
高效神經架構搜尋(Efficient NAS)旨在降低NAS的計算成本,通過架構共享、代理模型等技術加速搜尋過程,找到高性能的神經網路架構。
針對計算、內存、功耗等資源約束進行優化的神經網路,在保持性能的同時減少參數量和計算複雜度。
EfficientNet 是一系列由 Google 開發的卷積神經網路架構,旨在透過複合縮放方法,在準確度和效率之間取得最佳平衡。
特徵值是線性變換作用於向量後,該向量長度縮放的比例。它描述了變換對特定方向向量的影響程度。
特徵向量是指在線性變換下,方向保持不變或僅反向的非零向量。它對應於特定的特徵值,代表變換的主要作用方向。
電子病歷人工智慧 (EHR AI) 指的是利用人工智慧技術分析電子病歷 (EHR) 數據,以改善醫療照護、研究和管理的應用。
嵌入表示將離散的文字或類別映射為連續稠密向量,讓模型能捕捉語義相似性並進行數學運算
嵌入矩陣是深度學習中將離散變數映射為連續稠密向量的權重矩陣,能有效捕捉詞彙或特徵間的語意與結構關聯性。
將文字、圖像、音頻等高維度輸入轉換為低維稠密向量表示的模型,使語義相近的內容在向量空間中距離相近。
具身人工智慧是指讓AI系統擁有物理軀體,透過與環境互動來學習和解決問題,強調感知、行動和環境之間的循環。
湧現能力是指大型語言模型在達到一定規模後,突然展現出在較小模型中未曾觀察到的複雜能力,例如推理、翻譯和程式碼生成。
編碼器將輸入資料轉換為固定長度的向量表示,提取其語義特徵,以供解碼器或下游任務使用。
端到端自動駕駛是一種深度學習架構,直接將感測器資料轉換為駕駛控制指令,無需人工設計中間模組。
集成學習透過結合多個弱學習器,建立一個強學習器,以提高模型的準確性和泛化能力,常見方法包括Bagging、Boosting和Stacking。
實體鏈接是將文本中的實體提及項,連結到知識庫中對應實體的過程,以消除歧義並豐富文本的語義資訊。
實體解析是一種資料處理技術,旨在識別並連結來自不同資料來源中指涉相同真實世界實體的記錄,以建立統一且一致的實體視圖。
熵是資訊理論中衡量隨機變數不確定性的指標,數值越高代表不確定性越大。在機器學習中,熵常用於特徵選擇和決策樹構建。
Epoch(訓練輪次)是模型完整遍歷一次訓練資料集的過程;訓練輪次數量影響模型效果,過多會造成過擬合,過少會導致欠擬合。
將連續型數值特徵依等距區間分割成有限個離散類別的資料前處理技術。
AI 公平性指標,要求模型對不同群體(如不同性別或族群)的真陽性率與假陽性率均相等。
資料工程核心流程,將原始資料從來源系統擷取(Extract)、清洗轉換(Transform)後,載入(Load)至目標資料倉儲或 AI 訓練管線的三段式架構。
歐盟於 2024 年 5 月正式生效的全球首部綜合 AI 監管法規,對 AI 系統的開發、部署和使用設定強制性要求。
在貝氏推論中,證據指觀測資料的邊際機率。因計算困難,實務上常透過最大化證據下界來最佳化生成模型。
期望最大化 (EM) 算法是一種迭代算法,用於在存在隱變量的情況下,估計機率模型的參數。它交替執行期望 (E) 步驟和最大化 (M) 步驟。
機器學習模型決策過程的透明度與可理解性,使用戶與利益相關者能理解模型為何做出特定預測。
可解釋 AI 透過視覺化或簡化模型,讓複雜的黑箱模型預測決策過程能被人類理解、信任與稽核。
降維後每個主成分解釋原始資料總變異量的比例,用於評估降維結果保留了多少資訊。
梯度爆炸是指在深度學習模型訓練中,梯度在反向傳播時變得異常巨大,導致權重更新過大,模型訓練不穩定甚至崩潰。
探索與利用是強化學習中的權衡,探索是指嘗試新動作以發現潛在的更好策略,利用是指使用已知最佳策略以獲得最大獎勵。
在機器學習建模前,透過視覺化與統計方法理解資料特徵、發現模式並檢驗假設的關鍵資料處理步驟。
當使用者對領域不熟悉、目標模糊時,透過反覆查詢與學習來釐清資訊需求並獲取新知的資訊檢索過程。
描述隨機事件發生的等待時間或相鄰事件間隔的連續機率分佈,具備無記憶性。
指數平滑法是一系列時序預測方法,使用加權平均數,其中權重隨著時間的推移呈指數衰減,更重視近期觀測值。
萃取、轉換、載入(ETL)是資料工程的核心流程,指從多個來源提取數據,經過清洗與格式轉換,最終載入至目標資料倉儲的過程
提取式摘要技術從原文中選擇重要句子組成摘要,簡單直接,易於實現,但可能缺乏連貫性,且無法進行語義概括。
GBDT 的進化版,加入正則化防過擬合,支援缺失值和並行化,是比賽和業界的常勝軍