經典心理學測驗揭露 AI 最大弱點:注意力任務複雜度提高後準確率從90%暴跌至近乎歸零
研究人員以經典心理學注意力測驗測試頂尖 AI 模型,發現重大缺陷。當任務從簡短清單延長至更複雜的情境時,部分領先系統的準確率從超過 90% 驟降至接近完全失敗。

文章重點
- 研究人員以經典心理學注意力測驗測試頂尖 AI 模型,揭露重大缺陷
- 部分領先 AI 系統準確率從超過 90% 驟降至接近完全失敗
- AI 模型在短清單顏色命名任務表現良好,但複雜度提高後急劇惡化
- 研究凸顯 AI 在持續注意力與抗干擾能力上存在根本性弱點
- 發現對無人機自主飛行、即時環境感知等高複雜度應用具警示意義
經典心理學測驗揭露 AI 最大弱點
研究人員近期以心理學領域廣泛使用的經典注意力測驗,對當前頂尖的 AI 模型進行測試,結果揭露了一項重大缺陷。
短清單表現亮眼,複雜任務卻全面崩潰
測試結果顯示,這些 AI 模型在處理簡短清單中的顏色命名任務時,表現相當出色,能夠正確辨識並回答。然而,當任務長度增加、複雜度提高後,模型的表現急劇惡化。部分業界領先的 AI 系統,準確率從超過 90% 驟降至接近完全失敗的程度。
注意力機制仍是 AI 核心挑戰
這項研究凸顯出,儘管當前 AI 模型在許多基準測試中表現優異,但在需要持續注意力與抗干擾能力的任務上,仍存在根本性的弱點。這對於仰賴 AI 進行長時間、高複雜度決策的應用場景——包括無人機自主飛行、即時環境感知與避障等領域——具有重要的警示意義。
研究人員指出,這項發現有助於理解大型語言模型在處理資訊時的內在限制,也為未來 AI 架構的改進提供了明確方向。
原文來源: 查看原文
常見問題
Newsletter
訂閱低空產業電子報
每日精選低空經濟與無人機產業新聞,直送您的信箱。
本文由 LAETimes 編輯部審核發佈 ·


