← 研究動態
一般讀者2026/10/09 下午04:00

比特幣與以太幣換一家資料商:每天報酬平均差 0.09% 到 0.23%,十二格風險稽核一格都沒翻

比特幣風險值波動預測以太幣預註冊虛無結果資料來源

讀者互動

登入會員可按讚與收藏。

分享到:LINEFacebookX / Twitter

持續追蹤這項研究

收藏、追蹤與明日提醒只保存必要識別資料,可在會員中心檢視或刪除。

研究資訊不構成個人投資建議;提醒僅代表研究更新,不代表交易訊號。

訂閱研究摘要

研究摘要與新文章,不轉售、不寄廣告,隨時可退訂。

免費的日線資料很好用,幾行程式就能抓到比特幣與以太幣的歷史價格。可是同一天、同一個幣,Yahoo Finance、Binance、Coinbase 給的收盤價與最高最低價並不一樣。如果你拿其中一家的資料算風險,換成另一家,結論會不會跟著變?

我們事先把規則全部寫死,在三家都有完整歷史的 3198 個 UTC 日(2018-01-01 至 2026-10-03)上測了這個問題。先講結果:三家資料的每日報酬平均差 0.09% 到 0.23%,Yahoo 的日內高低價範圍平均偏窄約兩成。可是十二格風險稽核沒有任何一格翻轉,四個波動預測模型的排名在三個來源上完全一致。能寫的結論只有一句:在這個粒度下,我們沒有看到來源差異改寫結論。這不等於三家資料可以互換。

我們比了什麼

三份資料:

  • Yahoo Finance,透過 yfinance 取得。
  • Binance 的日 K 線,以 USDT 報價,沒有換算成美元。
  • Coinbase Exchange 的日 K 線。

只取三家都有的日期,不補值。比特幣與以太幣各有 3198 個日期、3197 筆日報酬。Kraken 的日線只回得出最近 716 天(2024-10-18 起),不夠估計模型,所以只放進描述性比較,不進後面兩項測試。

測試分三部分:

  1.  來源差異(描述) :三份日線到底差多少。
  2.  波動預測的排名 :四個模型各預測隔天的波動,用平均預測損失排名。HAR 把昨天、上週、上月的波動平均起來預測明天;AR1 只用昨天預測今天;EWMA 是近期加權平均(衰減係數 0.94);RW22 取過去 22 天的平均。目標是各來源自己用最高最低價算出的日內波動代理。估計窗 504 天,每 21 天重估一次,樣本外 2672 天。
  3.  風險稽核 :三種風險值模型,兩個水準(1% 與 2.5%),共 12 格(2 個幣 × 3 個模型 × 2 個水準),樣本外 2693 天。風險值是「今天預估最慘會虧多少」,實際虧損超過預估的日子叫違約。模型可靠的話,違約天數應該接近水準乘上天數:1% 水準約 26.9 天,2.5% 水準約 67.3 天。我們用兩項檢定:第一項(技術上叫 Kupiec 檢定)只看違約天數與預期是否相符,第二項(Christoffersen 檢定)同時看天數與違約是否連在一起,拒絕門檻都是 5%。三個來源的拒絕狀態不全相同,就記為這一格「翻轉」。

規則在跑任何統計之前凍結,也事先寫下認輸條件:沒有任何一格翻轉、預測最佳模型也沒有換人的話,結論就寫成「沒有看到來源差異改寫結論」,並且不宣稱來源可互換。預註冊不是盲的。凍結前我們看過同一套風險模型在 yfinance 比特幣資料上的一個既有結果(拿來當程式碼的對照點)、一份交易所價格離散度的舊研究摘要,以及各資料端點回傳的前幾列;沒有看過任何來源之間的報酬差異、預測排名或風險稽核結果。凍結前寫下的預期是:交易所之間的日收盤價只差極小,所以風險稽核不會翻轉,而用最高最低價算的預測排名會比較敏感。

三份資料其實不一樣

三份日線不是同一個序列:每天的報酬有出入,Yahoo 的高低價範圍平均還偏窄

同一天的日報酬,兩家資料平均差多少?比特幣是 Yahoo 對 Binance 差 0.19%、Yahoo 對 Coinbase 差 0.18%、Binance 對 Coinbase 只差 0.09%;以太幣依序是 0.23%、0.22%、0.10%。換句話說,兩家交易所的資料彼此近,Yahoo 跟兩家都比較遠。

差距集中在少數日子。六組配對裡,單日報酬差超過 1 個百分點的日子占 1.2% 到 3.8%。單日最大的差距,以太幣在 2018-01-16 的 Binance 對 Coinbase 差 7.1 個百分點,比特幣在 2018-02-08 的 Binance 對 Coinbase 差 5.73 個百分點。日報酬的相關係數仍在 0.994 到 0.998 之間,方向幾乎一致。

另一個差異是水準。以每日最高最低價算的波動,Yahoo 只有 Coinbase 的 0.79(比特幣)與 0.80(以太幣),也就是偏低約 21% 與 20%;Binance 是 Coinbase 的 1.00 與 0.99。這是整個樣本的平均,不是某一年的現象;偏窄的程度是否隨時間變化,見最後一節的限制。

風險稽核:十二格都沒翻

十二格風險稽核:三個來源的違約天數最多差 4 天,沒有任何一格被拒絕、也沒有任何一格翻轉

12 格裡,第一項檢定翻轉的有 0 格,第二項檢定翻轉的也是 0 格。三個來源都沒被拒絕的有 12 格,三個來源都被拒絕的有 0 格。36 個「格 × 來源」裡,違約天數落在 26 到 74 天之間;第一項檢定的機率最低是 0.2562,第二項最低是 0.2074,離 5% 的拒絕門檻都很遠。

同一格的三個來源,違約天數最多差 4 天。違約天數本來就會隨機跳動:1% 水準的一個標準差約 5.2 天,2.5% 水準約 8.1 天,所以 4 天的差距約 0.49 個標準差,小於一個標準差。我們也把日期重抽樣 2000 次,看三個來源結論不一致的頻率,12 格的頻率介於 0.039 與 0.110。

預測排名:沒變,但有一個但書

預測模型的排名一格都沒變;唯一翻面的比較,是在 0.05 門檻兩側差了一點點

平均預測損失最低的模型,在 2 個幣 × 3 個來源共 6 個組合裡,6 個都是 HAR,換人的資產有 0 個。三個來源之間的排名相關係數最低是 1.00,等於整條排名完全一致。對日期重抽樣 2000 次,三個來源最佳模型不一致的頻率,比特幣是 0.084、以太幣是 0.041。

我們還做了 HAR 對三個替代模型的成對比較,共 6 個比較,結論類別有 1 個不一致:比特幣的 HAR 對 EWMA,校正後機率在 Yahoo 是 0.0518,沒過 0.05 門檻;Binance 是 0.0177、Coinbase 是 0.0431,兩個都過了。三個數字只差在門檻兩側一點點,其餘 5 個比較在三個來源上結論一樣。

 這個結果有一個但書,必須先讀。  我們用的四個預測模型,對目標序列乘上一個常數都不敏感:目標整體放大或縮小,平均損失的排名與比較統計量都不變。上一節說 Yahoo 的日內波動整體偏低約兩成,那很像一個常數倍數,按構造就改不動排名。所以預測排名一致,部分是模型的性質,不是來源真的沒差。這項測試只能排除「不是整體倍數」的來源差異。事先寫下的預期是「預測排名比風險稽核更敏感」,這點沒有成真,原因就在這裡,而我們凍結預註冊時沒有想到。

這也是為什麼要把兩件事分開看:排名不變,不代表波動的水準沒變。如果你的用途直接用到波動的大小,例如用日內範圍算部位或停損距離,Yahoo 的資料在全樣本平均上低估約兩成,這項測試沒有檢查那種用法。

預期與結果

事先寫下的預期結果
風險稽核沒有翻轉,或只有邊際翻轉12 格中 0 格翻轉,違約天數最多差 4 天(0.49 個標準差)
預測排名比風險稽核更敏感最佳模型 0 個換人,成對比較 6 個中 1 個不一致;原因是模型對整體倍數不敏感,事先沒料到
沒有翻轉的話,不宣稱來源可互換照辦;本文不寫「可互換」

能說什麼,不能說什麼

能說的:在比特幣與以太幣、2018-01-01 至 2026-10-03、日頻、這幾個模型與這兩個水準之下,把輸入由 Yahoo Finance 換成 Binance 或 Coinbase,風險稽核的拒絕狀態沒有任何一格改變,預測模型的排名也沒有改變。

不能說的:

  • 不能說三家資料可以互換。第一部分已經量到每天報酬有出入、Yahoo 的高低價範圍偏窄。
  • 不能說波動的水準不受影響:預測排名對整體倍數不敏感,這項測試看不見它。
  • 只有兩個幣、一段期間、日頻。結果不外推到其他幣、其他期間或日內資料。
  • 日內波動用的是最高最低價算出的代理,不是用日內分鐘資料算的已實現波動。
  • 不稽核預期損失,也不做其他風險檢定。
  • Binance 以 USDT 報價、沒有換算成美元,USDT 與美元的價差會進入它的報酬與高低價。
  • 「翻轉」只是三個來源的離散結論不全相同,不是效應的顯著性;用 1 個標準差當「實質翻轉」的界線是慣例,不是檢定。第二項檢定沒有做重抽樣。
  • 事後觀察,事前沒有預期也沒有檢定:最近 716 天裡,Kraken 的日內高低價範圍只比 Yahoo 寬 3%(比特幣)與 5%(以太幣),遠小於全樣本的兩成。Yahoo 偏窄的程度很可能隨時間變化,我們沒有去檢定它。
  • Schwenkler、Shah 與 Yang(2026,《Management Science》)報告過不同供應商的加密貨幣價格、市值與成交量差異可以很大。本測試沒有重複那項研究,只在這個具體用途上量了一次。

資料來源與核對

價格:yfinance 1.2.0(不調整價格)、Binance 公開 API 的日 K 線、Coinbase Exchange 公開 API 的日 K 線,2026-10-08 一次抓回並凍結,之後離線重現。結果檔的雜湊值是 34db59e0de498ee33c7f23c566100d7bc098d1b43efd693c66bc8603311c17e2,資料快照的雜湊值是 f151d6c0c24e4af93379895608bc1ba9ad7cd60d6bb1ddd83f2a079e8f843042,兩者都能拿檔案核對。文中數字都由結果檔程式化取出,三張圖由同一份結果檔繪製。

懶人包圖組

概念卡:說明把比特幣與以太幣的輸入從雅虎財經換成幣安或 Coinbase 的日線,並列出共同交易日數與兩項測試的樣本外天數

方法卡:說明來源差異描述、波動預測排名、風險稽核三部分,預註冊先凍結再看結果,並列出估計窗長度、重抽樣次數與風險稽核格數

結果卡:列出風險稽核翻轉的格數、三個來源違約天數的最大差距、預測最佳模型換人的資產數,以及成對比較結論不一致的個數與總數

結論卡:說明在這個粒度下沒看到來源差異改寫結論但不等於資料可互換,並列出雅虎財經日內高低價範圍相對 Coinbase 的比值與模型對整體倍數不敏感的限制

相關文章

先讀正式關聯,若無則使用標籤與主題相似度補齊

📄
台指期貨成交推估的買賣方向,能預測接下來 5 分鐘和 30 分鐘的波動嗎?看得出一點效果,但小到不具實質意義
期貨的逐筆成交資料只有價格和數量,沒有買賣委託的內容。常見的做法是用成交價的變動去推估這一筆是買方主動還是賣方主動,再把推估的買賣方向乘上成交量,得到「成交推估的簽名成交量」。 我們問一個很窄的問題:用這個推估量做成的狀態模型,能不能讓台指期貨接下來 5 分鐘與 30 分鐘波動(RV)的預測更準?這是預先註冊的檢定,答案是有,但太小。 先講結論 在台指期貨日盤的逐筆成交資料上,用成交價變動推估買賣…
→
📄
聯準會點陣圖越分歧,下一季長天期公債就越震盪嗎?預先註冊的檢定沒有找到證據
聯準會每個季度會公布一張「點陣圖」:每位官員用一個點標出自己預期的政策利率。點散得越開,代表官員之間的看法越分歧。 一個直覺的想法是,官員越分歧,市場越難判斷利率走向,下一季的長天期公債也會越震盪。 我們把這個想法做成事先註冊的檢定,用 2012 到 2025 年的點陣圖和 TLT(長天期美國公債 ETF)的日資料驗證。兩項檢定都沒有找到證據。 先講結論 兩項檢定都沒有找到證據。 分歧最大的三分之…
→
📄
免費的政策不確定性與新聞情緒指標,能讓波動預測變準嗎?美股九年的樣本外檢驗:沒有檢出增量
有一種說法是:政策不確定性指數、新聞情緒指數這類免費、每天更新的指標,能比價格更早反映市場的緊張,拿來預測波動,會比只看過去的波動更好。 我們把這個說法放進標準的波動預測,看樣本外有沒有真的變準。 先講結論 在 SPY 2015 到 2023 年的 2,246 個樣本外預測日裡,加進政策不確定性、新聞情緒,或兩者都加進去,增量樣本外 R² 分別是 -0.22%、-0.18%、-0.28%,三個都是…
→
比特幣與以太幣換一家資料商:每天報酬平均差 0.09% 到 0.23%,十二格風險稽核一格都沒翻 | VolPred