← 研究動態
一般讀者2026/06/30 上午01:00

商品 ETF 的方向對了一半,可惜統計撐不住:波動分高低之後的動能 vs 反轉拼圖

方法論波動率反轉商品ETF動能沒結論

讀者互動

登入會員可按讚與收藏。

分享到:LINEFacebookX / Twitter

持續追蹤這項研究

收藏、追蹤與明日提醒只保存必要識別資料,可在會員中心檢視或刪除。

研究資訊不構成個人投資建議;提醒僅代表研究更新,不代表交易訊號。

訂閱研究摘要

研究摘要與新文章,不轉售、不寄廣告,隨時可退訂。

商品市場的學界研究這兩年冒出一個新講法:短期的反轉跟動能其實同時存在,誰贏要看當下的波動高低。波動高的時候反轉壓過動能,波動低的時候動能壓過反轉。

聽起來很合理。趨勢交易圈裡這也是常識:行情急的時候追高會被打臉,行情慢的時候趨勢能跑很久。

我們把這個猜想搬到 6 個常見商品 ETF 上實際算。樣本是 2010 年 1 月到 2026 年 6 月,黃金、白銀、原油、天然氣、銅、廣義商品籃,週和月兩種頻率都跑,回看 1、2、4 個 bar 的方向訊號。一共 36 個格子,每個格子再切高低波動兩段,所以是 72 個獨立的檢驗。

結論先說:方向對了一半,但檢驗一個都過不了關。

設計怎麼擺

每個格子要回答的問題很單純:在這個 ETF、這個 N、這個頻率、這段波動環境裡,做反轉的平均報酬會不會明顯高過做動能?

訊號是「過去 N 期報酬的方向」,反轉就是把訊號反過來。兩邊用同一個延遲一根 bar 的規則,不偷看未來。波動分段用滑動視窗算出來的當下波動,再用展開中位數切高低,分位數本身只看過去資料,不會偷到當下這根 bar 的資訊。

設計欄位設定
標的黃金、白銀、原油、天然氣、銅、廣義商品 ETF
樣本2010-01 到 2026-06,最多 16.5 年(廣義商品月頻只有 122 筆,是樣本最薄的格子)
訊號過去 N 期報酬的方向,N 取 1、2、4
波動分段滑動視窗的實現波動切高低,門檻用展開中位數
比較反轉與動能兩邊的報酬差做統計檢驗
標準誤用支援自相關的穩健公式(學界稱 HAC)
多重檢驗校正36 個格子做 Bonferroni 校正,門檻收緊到 0.05 / 36 ≈ 0.0014

成本部分加了 1 個 bp 的翻倉費用,這只是 sensitivity 用,不會改變判定。

商品 ETF 高低波動下動能 vs 反轉的報酬風險對照

主結果:一半方向對 全部不顯著

把 36 個格子的方向擺出來看,剛好 18 個格子(50%)呈現「高波動時反轉平均報酬比動能高、低波動時動能平均報酬比反轉高」的預期方向。

但統計檢驗是另一回事。

在寬鬆的門檻下(一般說的 5% 顯著),高波動段抓到 1 個格子反轉顯著(銅 ETF 週頻 N=1,dm_t = +1.99),低波動段抓到 3 個格子動能顯著(黃金月頻 N=1、N=2、N=4,dm_t = −2.5 / −2.6 / −2.0)。另外高波動段還有 2 個格子達到寬鬆顯著但方向相反,原油月頻 N=1(dm_t = −2.42)跟廣義商品月頻 N=1(dm_t = −2.19),是動能贏,跟 H1(高波動反轉)相反。寬鬆 統計強度>1.96 命中合計 6 個格子。

把多重檢驗校正套下去,門檻收緊到 0.0014。剛剛那 6 個格子全部消失,36 個全部歸零。

檢驗顯著性分佈:寬鬆門檻抓到 4 個 校正後歸零

這 6 個寬鬆命中也不該被當證據。當你同時跑 36 個檢驗,就算這些檢驗背後其實全是雜訊,平均也會有大約 1.8 個跑出寬鬆顯著;72 個一起算就是大約 3.6 個。我們抓到 6 個,看起來略高,但低波動段抓到的 3 個黃金月頻格子(N=1、N=2、N=4)共用大部分樣本,三個檢驗高度相關,等同有效獨立檢驗只剩 4 個,跟雜訊期望幾乎沒實質差距。

為什麼方向對 統計卻撐不住

這個結果並不矛盾。方向一致不等於 effect 大。

樣本是第一個限制。廣義商品月頻 122 筆、銅月頻 158 筆,要在這種長度下檢出微小報酬差是吃力的。再把樣本切高低波動之後每邊只剩 60 到 100 筆,穩健標準誤又會把信賴區間撐開,t 值很難跑到校正後門檻的位置。

第二個限制是 ETF 替代物本身。學界討論的「商品短期反轉加動能共存」是建立在真正的期貨曲線資料上,roll yield、basis、庫存壓力都會進到訊號裡。ETF 把這些東西混進總報酬一鍋炒,最有資訊量的那層資訊先被吃掉了。剩下的就是純價格動能 — 而純價格動能在 2010 年之後的商品市場本來就被金融化稀釋得差不多。

第三個是 effect 本身可能就小。趨勢交易圈的「行情急 → 反轉、行情慢 → 動能」是長期累積的交易感覺,沒有人說過它應該大到 16 年 6 個 ETF 就能打出統計顯著。學界的常識感跟正式統計檢驗中間,本來就有一段距離。

一個方法論教訓

寫到這裡可以拉出一個更廣的教訓。如果今天直接看寬鬆門檻抓到 4 個顯著,再加上 18/36 方向對,文章寫起來會像「商品 ETF 在波動分段下展現出動能反轉共存的證據」。聽起來像個發現。

但這 4 個是從 72 個檢驗裡篩出來的。在 72 個檢驗下,純雜訊也會給你大約 3 到 4 個寬鬆命中。所以那 4 個跟「真的有訊號」幾乎沒辦法區分。多重檢驗校正存在的目的就是這個:把這層由檢驗數量帶來的假發現拉掉。

而 50% 方向對也要小心。72 個獨立的隨機方向訊號,純雜訊本來就會有大約 50% 機率落在「預期方向」那一側。你需要的是 70%、80% 才開始有意義。50% 不能拒絕「方向是隨機的」這個 baseline。

換句話說:方向對 跟 統計顯著 是兩回事,方向對的比例「夠不夠高」跟「跟 50% 純機率比起來顯著嗎」又是另一回事。每一層都要分開查。

接下來要怎麼做才有機會

這篇是 PoC(先驗證最簡架構),確認用 ETF 加滑動波動分段抓不到。這不代表學界的講法錯了。下一步比較有意義的方向至少有三個。

第一是換成真正的期貨連續契約,把 roll yield 跟 basis 重新放回訊號裡。CME 主流商品都有夠長的歷史。第二是把波動分段的切法升級,從滑動中位數換成更精緻的波動模型(例如有條件變異數模型)或隱藏狀態模型,這樣分段邊界會更清楚,混在邊界附近的觀察值不會稀釋訊號。第三是加進期貨曲線結構 — 看曲線是 backwardation 還是 contango,只在 contango 端做反轉、backwardation 端做動能,看分離度有沒有上來。

NULL 的價值在於它幫後續研究排掉一個解:問題不在「沒嘗試」,問題在 ETF 替代物跟單一波動指標的解析度不夠。下一輪如果用期貨加隱藏狀態還是抓不到,那就可以寫成清楚的證偽。

資料來源

yfinance 商品 ETF 收盤價,期間 2010 年 1 月到 2026 年 6 月 15 日。完整 36 格的報酬、最大回撤、檢驗統計、每格樣本數、跟未來資料偷看的審計紀錄都在實驗資料夾,程式碼可一鍵重跑。

懶人包圖組

懶人包:文章框架

懶人包:研究方法

懶人包:主要發現

相關文章

先讀正式關聯,若無則使用標籤與主題相似度補齊

📄
Meta 一週漲 12.9%、Nike 跌回二〇一四年的價位:看到個股排行榜,先過三道檢查再決定追或撿
這一週的個股排行榜,兩端都很好認。 一端是 Meta。推出 AI 代理人之後,股價從九月十八日收盤到九月二十五日收盤漲了 12.9%,收在 751.66 美元,離去年八月那次高點只差 4.85%。 另一端是 Nike。美國銀行把它降到「表現劣於大盤」,目標價砍到三十美元。股價收在 35.75 美元,今年以來跌了 43.89%,從二〇二一年十一月的高點 177.51 美元算起,已經少了將近八成。上一…
→
📄
銀行收緊放款時,債券 ETF 劇烈震盪會讓隔天股市更不安嗎?十九年資料:不必另設一道警報
美國聯準會每一季會問各大銀行:最近對企業放款,標準是放寬還是收緊?當回答「收緊」的銀行明顯多過「放寬」,市場常把它當成信用變緊的訊號。一個常見的延伸想法是:在這種時期,高收益債或貸款類 ETF 一旦出現劇烈震盪,隔天的股市就更容易跟著不安,所以要對債券 ETF 的動靜特別敏感,甚至提早減碼股票。 這篇回答的就是這個決策:銀行收緊放款的期間,要不要把債券 ETF 的單日劇烈波動,當成比平常更強的股市…
→
📄
量台指期一天晃多大,照成交節奏取樣比每 5 分鐘準;拿來預測明天就沒有贏
算一天的波動,最常見的做法是每隔 5 分鐘記一次價格,把這些小段的漲跌平方加起來。這把尺用的是時鐘: 不管盤面是熱是冷,每 5 分鐘都記一筆。可是市場不是照時鐘走的。開盤半小時可能成交幾千筆,午盤十分鐘也許只有零星幾筆。 學術界因此提出另一種做法:改照「交易的節奏」取樣,成交密的時候記密一點、冷清的時候記疏一點 (Oomen,2006;Dimitriadis 等人,2022)。 我們用台指期近月日…
→