金絲雀部署 Canary Deployment
金絲雀部署是將新版本軟體或模型逐步發布給少數使用者,以便在全面推廣前偵測問題,有效降低風險並確保系統穩定性。
查詢 Transformer、RAG、AI Agent 等 AI 術語,包含定義、iPAS 考點分析、常見問題與 Markdown 版本。
金絲雀部署是將新版本軟體或模型逐步發布給少數使用者,以便在全面推廣前偵測問題,有效降低風險並確保系統穩定性。
膠囊網路是一種神經網路架構,旨在解決卷積神經網路在處理物件方向和空間關係上的不足,透過膠囊和路由機制,更有效地捕捉物件的層次結構。
神經網路在學習新知識時快速遺忘舊知識的現象,導致之前習得的能力消失。
機器學習中取值為有限離散類別的特徵,如性別(男/女)、顏色(紅/綠/藍)、地區等,需要特殊編碼才能用於模型訓練
因果推論是從觀察數據中推斷因果關係的方法,旨在確定一個變數的變化是否直接導致另一個變數的變化。
因果語言模型是一種語言模型,它基於序列中先前詞彙預測下一個詞彙,並明確建模詞彙之間的因果關係,以提升生成文本的連貫性和可控性。
思維鏈提示是一種Prompt工程技術,透過引導模型逐步推理,提升複雜問題的解答品質與可解釋性。
聊天機器人是一種能模擬人類對話的電腦程式,透過文字或語音與使用者互動,提供資訊、協助解決問題或執行特定任務。
金吉拉縮放是一種模型縮放法則,旨在透過調整模型大小和訓練資料量,以達到最佳的計算效率,避免過度訓練或訓練不足。
分塊處理是指將大型資料集或文本分割成更小、更易於管理的部分,以便於模型處理和分析,提升效率。
引文網路是將文獻作為節點、引用關係作為有向邊的圖結構,用於分析學術影響力與知識傳承脈絡。
一種條件生成技術,不依賴外部分類器,通過在無條件生成過程中注入條件信息來控制生成結果,常用於文本到圖像等多模態任務。
點擊率預測旨在預估使用者點擊特定廣告或連結的可能性,是數位廣告和推薦系統的核心技術。
AI 氣候模型是指使用機器學習加速和改進氣候模擬和預測的技術。AI 能從大規模氣象數據中學習複雜的氣候動態,提高預測準確性和計算效率,支持氣候變化研究和政策制定。
CLIP (Contrastive Language-Image Pre-training) 是一種透過對比學習,將圖像與文字描述連結的模型,能進行零樣本圖像分類,無需針對特定任務重新訓練。
協同過濾是一種推薦系統技術,透過分析使用者行為或偏好,預測使用者可能感興趣的項目,例如商品、電影或音樂。
利用強化學習演算法來解決複雜組合最佳化問題的技術,透過與環境互動學習最佳決策策略以尋求近似最佳解。
計算生物學結合電腦科學、統計學與生物學,利用演算法分析生物數據,以理解複雜的生物系統與過程。
電腦視覺(Computer Vision)讓 AI 從圖像與影片中辨識物件、文字、人臉,廣泛用於自駕車、人臉辨識、醫療影像分析、工廠瑕疵檢測。
機器人視覺是指機器人使用攝像頭和深度傳感器配合計算機視覺算法,感知和理解視覺世界,完成抓取、組裝、檢測等任務。它使機器人能在動態環境中自主操作,廣泛應用於製造、物流和醫療。
概念瓶頸模型是一種深度學習模型,它強制模型通過人類可理解的概念來進行預測,從而提高模型的可解釋性和可控性。
概念漂移是指機器學習模型在部署後,由於資料分佈隨時間變化,導致模型預測準確度下降的現象。需要持續監控並重新訓練模型。
衡量數學問題或演算法對輸入微小變化的敏感程度。
評估語言模型輸出一致性的研究方法,透過對同一問題的多次詢問分析模型回答的穩定性與可靠性。
將句子分解為層級詞組結構,建構樹形解析樹以顯示詞語與詞組的組成與支配關係。
一種對齐大型語言模型的方法,透過編制一份「憲法」(一組原則和價值準則),指導 AI 系統自我批評和改進行為,無需依賴大量人類反饋,實現更可控且價值對齐的 AI 系統。
內容生成是指使用人工智慧技術自動創建文字、圖像、音訊或影片等內容的過程,旨在降低內容創作成本並提高效率。
內容過濾推薦是一種推薦系統方法,它基於用戶過去互動過的項目內容特徵,向用戶推薦相似的項目。它分析項目描述,並匹配用戶偏好。
AI 模型在生成回應或進行預測時,所能參考與記憶的輸入資訊範圍及歷史對話內容。
上下文窗口是指,大型語言模型一次性能處理的最大 Token 數量,超過此限制模型便會遺忘先前的內容
有效利用 LLM 的上下文窗口(模型能處理的最大序列長度),在有限的空間內優先放置最重要的信息,避免超長內容丟失或品質下降。
持續學習旨在使AI模型能夠在不遺忘先前知識的情況下,逐步學習新的任務和資料,模擬人類終身學習的能力。
自動化將通過測試的程式碼變更直接部署到生產環境的軟體工程實踐。
持續整合設計是規劃自動化流程,頻繁整合程式碼、建構與測試,旨在提升軟體開發效率與品質。
對比學習是一種自監督學習方法,通過學習區分相似和不相似的樣本,從而提取資料的有效表示,無需人工標註。
ControlNet 是一種神經網路結構,用於控制大型擴散模型,例如 Stable Diffusion,以實現更精確的圖像生成控制,例如基於草圖或邊緣圖生成圖像。
對話式人工智慧是指能透過自然語言與人類進行互動的AI系統,例如聊天機器人或語音助理,旨在提供更自然、直觀的互動體驗。
卷積運算是提取特徵的數學操作,透過濾波器在資料上滑動捕捉邊緣與紋理,廣泛應用於電腦視覺領域。
Copilot 是一個 AI 程式碼助手,透過分析程式碼上下文,提供程式碼建議、自動完成和程式碼生成,提升開發效率。
自動識別文本中指稱相同實體的不同表達式(如代詞、定指表達式),並將其分組聚集的任務。
共指解析是自然語言處理中的一項任務,旨在識別文本中指向同一個實體的不同提及(mentions),例如代詞、名詞短語等。
語料庫是大量結構化的文本集合,用於語言研究和自然語言處理,提供真實語言使用的範例,用於訓練和評估模型。
量化多個變數兩兩之間線性相關程度的方陣,矩陣中每個元素為對應兩變數的皮爾森相關係數。
餘弦相似度是一種衡量兩個非零向量之間夾角餘弦值的度量方法,常用於評估文本或資料點之間的相似程度。
代價函數是所有訓練樣本損失函數的平均值,用於評估模型在整個訓練集上的表現,並作為優化算法的目標。
共變異數衡量兩個變數如何一起變化。正值表示它們趨於一起增加或減少,負值表示一個增加時另一個趨於減少,零值表示沒有線性關係。
描述多個隨機變數兩兩之間線性相關程度與各自變異數的對稱方陣。
共變數偏移是指機器學習模型在訓練與推論階段,輸入特徵的資料分佈發生改變,但給定特徵下的目標變數條件分佈保持不變的現象。
融合來自不同模態(文本、圖像、音頻等)資訊的注意力機制,用於多模態深度學習任務。
隨著資料維度增加,樣本空間呈指數級膨脹,導致資料密度急劇下降、距離量度失效,使機器學習模型的訓練難度與資料需求大幅提高。