← 研究動態
研究2026/03/15 上午08:00

研究教學:為什麼深度學習無法超越 GARCH(三重確認)

GARCHGJR-GARCHHAR-RVLSTM波動率預測

讀者互動

登入會員可按讚與收藏。

分享到:LINEFacebookX / Twitter

持續追蹤這項研究

收藏、追蹤與明日提醒只保存必要識別資料,可在會員中心檢視或刪除。

研究資訊不構成個人投資建議;提醒僅代表研究更新,不代表交易訊號。

訂閱研究摘要

研究摘要與新文章,不轉售、不寄廣告,隨時可退訂。

三重確認:為什麼深度學習無法超越 GARCH

2026-03-15 Phase H 研究教學


前言

「用 AI 預測股市」是一個有吸引力的敘事。但當我們嚴謹地測試時,發現 1986 年 Bollerslev 的 GARCH(1,1)——一個只有 3 個參數的模型,在 日頻波動率預測 上至今無法被超越。

本文記錄我們如何用三種完全不同的方法得出相同結論。

方法一:Ljung-Box 殘差檢定

如果 GARCH 已經捕捉了所有波動率的結構,那它的標準化殘差 z² 應該是 iid(獨立同分佈)。

我們對 GJR-GARCH 的 z² 做 Ljung-Box 檢定:

Lagp-value結論
50.762不顯著
100.936不顯著
220.974不顯著

 結果 :z² 完全是 iid。沒有任何自相關結構留給 DL 學習。

方法二:GARCH-LSTM Hybrid

即使如此,我們仍然實作了文獻推薦的 hybrid 架構:先用 GJR 提取 conditional variance,再用 LSTM 學殘差結構。

 結果 :LSTM 的調整因子平均 1.31(放大 31%),標準差 1.16(極度不穩定)。QLIKE 比基準差 3%。LSTM 在噪音上過擬合。

方法三:Ridge Stacking

使用 6 個 features(3 個 GARCH 變體的 conditional variance + 3 個 HAR-style 統計量),用 Ridge 回歸找最佳組合。

 結果 :Ridge 把 所有 6 個 coefficient 設為零 ,只用 intercept(常數預測)。

這是最有說服力的證據,一個正規化的線性模型選擇了「忽略所有 features」作為最優解。

為什麼?

日頻波動率的本質是: 一天只有一個收盤價 。

從這一個數據點(r_t),GARCH 已經最優地提取了波動率信息。α\alpha 控制新信息的吸收速度,β\beta 控制歷史記憶的衰減。這個 trade-off 用 MLE 精確估計後,剩下的就是 純粹的隨機性 。

DL 需要 結構 才能學習。但日頻波動率的結構(volatility clustering)已經被 α\alpha+β\beta 的指數衰減完美描述。

什麼時候 DL 可能有用?

  1.  高頻數據 :每天 78 個 5-min bar,有日內 U-shape、開盤效應、微觀結構,遠比日頻豐富
  2.  多模態數據 :結合新聞情緒、社群媒體、選擇權市場資訊
  3.  非波動率任務 :方向性預測、regime detection、portfolio optimization

結論

三個完全不同的方法,統計檢定(Ljung-Box)、深度學習(LSTM hybrid)、機器學習(Ridge stacking),都指向同一個結論:

 GJR-GARCH(1,1) 是日頻 SPY 波動率預測的最終答案。 

不是因為 GARCH 很好,而是因為 日頻數據的信息量只夠支撐 3 個參數 。在這個信息約束下,GARCH 已經是最佳的。

相關文章

先讀正式關聯,若無則使用標籤與主題相似度補齊

📄
K1378:VIX 長期成分讓 SPY 波動預測勝過 GJR-GARCH,這個優勢在疫情窗外更穩定
做風險控管或選擇權定價的人,常要在兩種日頻波動模型之間取捨:只用報酬本身的 GJR-GARCH,或在 GARCH 之外加一個由 VIX 驅動的長期成分。後者多了一個外部變數要維護,值不值得,要看它的預測優勢從哪裡來。如果優勢只來自 2020 年那種市場崩跌的少數日子,平常用它就只是多背一個依賴;如果優勢出現在一般日子,它才是日常可用的改進。 K1378 用 SPY 的樣本外一步預測回答這個問題:A…
→
📄
K1862:HAR-RV 一個月波動預測的誤差,平均偏誤不隨波動水位變號,隨水位變寬的是誤差分布
用 HAR-RV 預測未來一個月波動的人,常會想加一層修正:波動很高時把預測往下調,波動很低時往上調,理由是 HAR 的均值回歸可能修正過頭。這層修正值不值得加,取決於 HAR 的誤差是否真的隨預測當下的波動水位系統性變號。 一般讀者版〈HAR 波動預測的誤差往哪邊偏:六成交易日高估,平均誤差卻幾乎是零〉處理的是整體偏誤。這篇處理條件結構:依預測當下的波動水位把樣本外日子分成五組,誤差的平均、中位…
→
📄
K1876:GVZ 預警黃金回撤的 regime 交互假說被推翻,而且這份樣本的 R=1 月份幾乎只出現在 2013–2016
一般讀者版(〈持有黃金,20 天內從高點回落 5% 的機率約四分之一〉)講的是結論:GVZ 做成的事前預警,樣本外勝不過歷史發生率。這篇補上那篇沒談的三件事:事前登記的 regime 交互假說為什麼被推翻、Clark-West 為正而 Brier 變差要怎麼讀、以及這份樣本裡的 regime 為什麼幾乎等於一個年代虛擬變數。 設定 事件:起點 t 之後 20 個交易日內,GLD 收盤價自期間高點回…
→