帳號:
密碼:
最新動態
 
產業快訊
 
CTIMES/SmartAuto / 新聞 /
AI「相變」新證據 Transformers從詞序推理突變為語意理解
 

【CTIMES/SmartAuto 王岫晨 報導】   2025年07月08日 星期二

瀏覽人次:【2201】

大利 SISSA Medialab 與瑞士 EPFL(洛桑聯邦理工學院)聯合研究,首次從理論角度驗證:「Transformers」神經網路在訓練過程中會出現如同物理相變的轉折點,初期階段以「位置」為依據理解語句,當訓練資料量足夠後,模型會突然切換到以「語意」為核心的理解方式。此突破性發現有助於打造更高效、安全且具可預測性的 AI 模型。

Transformers 是目前自然語言處理(NLP)主流模型,其深層自注意機制可同時處理語句中的位置訊息與內容語意。過去研究多以實務觀察方式指出位置/語意機制的切換,然而該機制何時且如何觸發一直不明顯。

為填補知識黑洞,SISSA Medialab 與 EPFL 的 Hugo Cui、Freya Behrens、Florent Krzakala 和 Lenka Zdeborova 等人在 arXiv 發表研究,透過「可解析的自注意力模型」(dot-product attention),證明具有位置編碼(positional encoding)的 Transformers 在接近某臨界資料量後,會以類似相變(phase transition)的方式重構其注意機制:從純位置相依切換到語意相關權重結構,並以封閉形式描述這一臨界行為。

根據研究,當訓練樣本與資料維度比例達到某特定臨界值後,全局最小化的 loss landscape 將從「位置相關注意」態翻轉為「語意相關注意」態,這意味模型能跳脫對詞序依賴,開始理解句子語意結構。研究團隊透過理論解析與模擬驗證,畫出臨界切換線,清晰揭示兩種機制間的「相變」關係 。

關鍵字: 人工智慧  AI代理  生成式AI 
相關新聞
Nordic與彥陽科技合作 強化全球物聯網戰略佈局
AI轉向落地實踐 NVIDIA報告顯示醫療與生命科學進入投資報酬期
ADI:2026年將是AI真正進入現實世界元年
身分攻擊成主流 Sophos報告揭示威脅組織數量創新高
Seagate:資料價值轉向邊緣 基礎架構成為企業競爭力核心引擎
相關討論
  相關文章
» 高耐用性臨床醫材連接器的工程設計
» Basler推出適用於機器人與物流應用的精巧型3D雙目視覺相機系統
» 模擬如何大幅強化汽車電子建模
» 先進半導體製程的虛擬填充技術進化
» 連續時間Σ-Δ ADC特性與工業測量分析


刊登廣告 新聞信箱 讀者信箱 著作權聲明 隱私權聲明 本站介紹

Copyright ©1999-2026 遠播資訊股份有限公司版權所有 Powered by O3  v3.20.2048.216.73.217.94
地址:台北數位產業園區(digiBlock Taipei) 103台北市大同區承德路三段287-2號A棟204室
電話 (02)2585-5526 #0 轉接至總機 /  E-Mail: webmaster@ctimes.com.tw