判定係數 R-squared
判定係數(R-squared)衡量模型解釋目標變數變異的比例,數值介於 0 到 1 之間
瀏覽 AITerms.tw 中標籤為「模型評估」的 AI 術語,快速找到定義、FAQ 與 iPAS 考試重點。
判定係數(R-squared)衡量模型解釋目標變數變異的比例,數值介於 0 到 1 之間
放射醫學AI利用人工智慧技術分析醫學影像,輔助醫生診斷疾病,提高診斷效率和準確性,並減少人為錯誤。
召回率衡量模型在所有實際正例中,成功識別出多少正例的能力,反映其查找完整性的指標
衡量AI系統在理解和識別輸入資料(如圖像、語音、文本)時的準確性與可靠性。高辨識品質是確保模型效能和應用成功的關鍵。
推薦系統是一種利用演算法預測使用者對物品偏好的資訊過濾系統,旨在幫助使用者發現感興趣的內容,並提升平台互動與銷售。
紅隊演練是一種模擬攻擊的測試方法,通過模擬真實攻擊者的行為,評估AI系統的安全性,找出潛在的漏洞和弱點。
重排序模型是一種在初步檢索後,對候選結果進行重新排序的技術,旨在提升檢索結果的相關性和準確性,通常使用更複雜的模型。
ResNet是一種深度學習模型,透過引入殘差連接解決深度神經網路訓練時的梯度消失問題,允許網路學習殘差映射而非直接映射。
負責任AI是一種全面性的框架,旨在確保人工智慧系統的開發、部署與使用過程,能嚴格遵守倫理原則、社會價值觀和法律規範,以促進公平、透明且可信賴的AI發展。
穩健性是指模型在面對輸入數據的微小擾動、對抗性攻擊或分布偏移時,仍能維持其性能表現的能力。
接收者操作特徵曲線(Receiver Operating Characteristic Curve)是以偽陽性率為橫軸、真陽性率為縱軸,透過改變分類閾值所繪製的曲線,用於評估二元分類模型在不同閾值下的
透過改變分類閾值,以真陽性率(召回率)為縱軸、假陽性率為橫軸繪製的曲線,用於評估二元分類模型在各閾值下的辨別能力。
均方根誤差是均方誤差開根號後的數值,代表模型預測值與實際值之間差值的集中程度,單位與原始資料相同
ROUGE評分是一種用於評估自動文本摘要或機器翻譯品質的指標,通過比較生成文本與參考文本的n-gram重疊程度來衡量。
規則提取是從機器學習模型中提取人類可理解的規則的過程,旨在提高模型的可解釋性和可信度。