時間動作定位 Temporal Action Localization
在視頻中精確識別和定位動作發生的時間段,給出動作開始和結束的時間戳。
瀏覽 AITerms.tw 中標籤為「AI應用」的 AI 術語,快速找到定義、FAQ 與 iPAS 考試重點。
在視頻中精確識別和定位動作發生的時間段,給出動作開始和結束的時間戳。
使用擴張卷積取代遞迴層捕捉時序依賴的網路架構,支援高度並行化。
測試時運算是指在模型部署後,進行推論時所使用的運算資源。目標是在效能和延遲之間取得平衡,以滿足實際應用需求。
文本分類是自然語言處理中的一項任務,旨在將文本自動分配到預定義的類別中。它應用廣泛,例如垃圾郵件檢測、情感分析等。
文字生成3D模型是指利用人工智慧技術,將文字描述轉換為對應的3D模型,實現從文字到視覺化模型的自動生成。
文字生成音訊(Text-to-Audio)是把一段文字描述直接轉成聲音的生成式 AI 技術,產出的是音樂、音效或環境音,不是唸稿的人聲。它跟文字轉語音(Text-to-Speech)最大的差別,在於生成的是整個聲音場景,還是單純的說話聲。
文字轉語音 (TTS) 技術將文字轉換為人類可理解的語音。它廣泛應用於輔助工具、語音助手和內容創作等領域。
改變分類模型的決策閾值來權衡精確率和召回率的技術,預設閾值通常為 0.5,調整閾值可適應不同業務需求
工具使用能力是指大型語言模型利用外部工具(例如API、資料庫)來擴展其功能,完成更複雜任務的能力。
軌跡最佳化是機器人學與控制領域的關鍵技術,旨在規劃出滿足特定約束條件並最佳化預設目標函數的運動路徑。
軌跡預測是基於實體歷史移動數據,推斷其未來路徑的技術,常見於自動駕駛、機器人導航等時序分析應用。
遷移學習是將已在大數據集習得的知識,轉移應用至小數據集的新任務,藉此加速模型訓練
將Transformer架構應用於時序資料,利用自注意力捕捉時間依賴,在預測任務上取得優異成績。
指在AI系統開發與運作中,適當揭露資料來源、模型設計與決策邏輯,讓利害關係人能理解並評估系統行為。
三元組抽取是從文本中提取(主語,謂語,賓語)三元組的過程,是構建知識圖譜的基礎,也是關係抽取的一種形式。