方面級情感分析 Aspect-based Sentiment Analysis
分析文本對特定方面或話題的情感態度,而非整體情感,如評論中對產品外觀、性能的分別評價。
瀏覽 AITerms.tw 中標籤為「自然語言處理」的 AI 術語,快速找到定義、FAQ 與 iPAS 考試重點。
思維鏈是一種讓大型語言模型逐步推理,而非直接給出答案,以提升複雜問題解答正確率的方法
統計語料中詞對同時出現的頻次形成的矩陣,是許多詞向量和 NLP 方法的基礎。
憲法式AI原則是一種透過明確的價值觀或「憲法」來引導AI系統行為的方法,旨在確保AI的輸出符合人類的期望和倫理標準。
將冗長的上下文內容壓縮為簡潔的摘要或關鍵信息,減少語言模型的輸入長度和計算成本。
解碼器是神經網路的一部分,負責將編碼器產生的抽象向量表示,轉換成人類可理解的目標輸出,如文字、圖片或語音。
深度學習模型架構設計,僅使用解碼器(Decoder)層進行文本生成和處理,無需編碼器,通過因果遮蔽使模型只能關注當前位置的歷史信息,實現自迴歸文本生成。
在多輪對話中自動追蹤和維護對話狀態(如用戶意圖、槽值),支持對話管理和任務完成。
直接偏好優化(DPO)是一種直接利用人類偏好資料,優化語言模型,無需訓練獎勵模型的強化學習替代方案。
隱藏狀態是神經網路中用於儲存與傳遞歷史資訊的內部記憶向量,負責在處理序列資料時保留上下文特徵,協助模型理解時序依賴關係。
研究人類與機器人之間互動的跨學科領域,旨在設計更自然、高效且安全的協作方式,提升使用者體驗與系統效能。
假設性文件嵌入是一種檢索技術,透過語言模型先生成假設解答,再將該解答轉為向量以搜尋真實文件。
拉普拉斯平滑(Laplace Smoothing)又稱加一平滑,是貝氏統計中避免零機率問題的技術,在計算類別條件機率時,將每個類別的計數加上常數 α(通常為 1),防止訓練集未見過的詞彙或特徵使整個機
LlamaIndex是一個資料框架,用於連接大型語言模型(LLMs)與您的私有或特定領域的資料,簡化建立基於LLM的應用程式。
邏輯形式生成是將自然語言轉換為結構化、機器可讀且無歧義表達式的過程,為語意分析的核心。
隨機遮蔽是隱藏部分資料的自監督技術,迫使模型從剩餘資訊推斷缺失內容,以提升特徵提取與泛化能力。
倒數排名融合是一種無需依賴絕對分數的結果融合技術。它透過計算文件在多個獨立檢索系統中排名的倒數並進行加總,藉此產生綜合多方結果的最終排名。
RAG(檢索增強生成)讓 AI 回答問題前先查詢外部知識庫,再結合查到的資料生成答案,大幅減少幻覺、提升回答準確性。
環狀注意力是一種分散式注意力機制,將注意力計算分散到多個設備上,減少單一設備的記憶體需求,適用於超大型模型。
將強化學習技術應用於自然語言處理任務中,透過獎勵機制優化文本生成的序列決策過程。
T5 (Text-to-Text Transfer Transformer) 是一種將所有 NLP 任務轉換為文本到文本格式的轉換器模型,簡化了模型訓練和應用。
指引AI模型生成內容的文字指令或問題,是與生成式AI互動的核心方式。
分詞是自然語言處理(NLP)中的基礎步驟,旨在將連續的文本序列拆解成更小的、具有語義意義的單元,例如詞彙、子詞或字符,這些單元稱為 tokens。
將文本分割成詞元(tokens)的工具,詞元可以是詞、子詞或字符,是 NLP 模型的輸入預處理步驟。
工具使用能力是指大型語言模型利用外部工具(例如API、資料庫)來擴展其功能,完成更複雜任務的能力。
完全基於 Attention 機制的架構,不用 RNN 的循環結構,能平行處理整個序列