iPAS AI 應用規劃師中級 114 年第二次 科一 第 48 題 詳解

114 年第二次 科一 人工智慧技術應用與規劃

某數據工程師使用DBSCAN演算法對一份數百萬筆的高維顧客資料進行聚類分析,但發現程式執行速度極慢,甚至出現記憶體不足的情況。若要在不改變演算法核心邏輯的前提下,最有效提升其運算效率的作法為何?

  1. A改用以平均連結(Average Linkage)為基礎的階層式群集法(Hierarchical Clustering)

    換演算法已違反不改變核心邏輯,且階層式更耗資源。

  2. B採用高效率的距離索引結構(Distance Index Structure),例如KD-Tree或Ball Tree(正確答案)

    KD-Tree、Ball Tree 加速鄰域查詢,邏輯不變。

  3. C將ε(Epsilon)參數調得極小,以減少鄰近點的數量

    調 ε 會改變分群結果,屬調參不是加速。

  4. D在資料前處理時增加標準化後的特徵維度數

    增加維度只會讓距離計算更慢更失真。

正確答案:B

DBSCAN 的效能瓶頸在鄰域搜尋,須靠空間索引結構加速。 先問效能瓶頸出在哪個運算步驟,再選能加速該步驟又不動演算法邏輯的作法。

用刷8題準備 iPAS AI 應用規劃師中級

每天隨手刷 8 題,答錯的題目會自動排回來再考一次。不用註冊,打開就能開始。

開始刷題