ログランク検定 (ログランクけんてい、 英: logrank test, or log-rank test)は、2つの 標本 の 生存分布 を比較する 仮説検定 である。これは ノンパラメトリック 検定で、データが右に歪んで 打ち切られている 場合に使用するのに適している(技術的には、打ち切りは情報を与えないものでなければ.. 具体例でイメージするログランク検定 ここに2つの薬があるとします。 新しい薬Aと、これまでの標準的な薬Bです。 私たちは、この2つの薬が、がん患者さんの「再発までの期間」に違いをもたらすのかを知りたいと考えています。
ログランク検定(ログランクけんてい、英: logrank test, or log-rank test)は、2つの標本の生存分布を比較する仮説検定である。これはノンパラメトリック検定で、データが右に歪んで打ち切られている場合に使用するのに適している(技術的には、打ち切りは情報を与えないものでなければならない)。この検定は、臨床試験において、新しい治療法の有効性を対照群と比較して確立するため広く使用されており、測定する対象は事象発生までの時間(初回治療から心臓発作までの時間など)である。この検定は、ネイサン=マンテルとデイヴィッド・コックスにちなんでマンテル=コックス検定と呼ばれることもある。ログランク検定は、時間層別化されたコクラン=マンテル=ヘンツェル検定と見なすこともできる。
この検定は、ネイサン=マンテルによって最初に提案され、リチャード・ピートとジュリアン=ピートによってログランク検定と命名された。
定義
ログランク検定統計量は、観察された各事象の時間における2つのグループのハザード関数の推定値を比較する。これは、観察された事象の時間ごとに、いずれかのグループでの事象の観測数と期待数を計算し、これらを加算して、事象があったすべての時点にわたる全体的な要約を得ることによって構築される。
患者の2つのグループ、たとえば治療群と対照群を考える。 どちらかのグループで観察された事象の明確な時間を
1
,
…
,
J
{\displaystyle 1,\ldots ,J}
とする。
N
1
,
j
{\displaystyle N_{1,j}}
および
N
2
,
j
{\displaystyle N_{2,j}}
を、それぞれのグループ内における、時間
j
{\displaystyle j}
の開始時点での「リスクがある」(まだ事象が発生していない、または打ち切られていない)被験者の数とする。また、
O
1
,
j
{\displaystyle O_{1,j}}
および
O
2
,
j
{\displaystyle O_{2,j}}
を、時間
j
{\displaystyle j}
における各群で観測された事象の数とする。最後に、
N
j
=
N
1
,
j
+
N
2
,
j
{\displaystyle N_{j}=N_{1,j}+N_{2,j}}
と
O
j
=
O
1
,
j
+
O
2
,
j
{\displaystyle O_{j}=O_{1,j}+O_{2,j}}
を定義する。
帰無仮説は、2つのグループのハザード関数が同一であるというもので、
H
0
:
h
1
(
t
)
=
h
2
(
t
)
{\displaystyle H_{0}:h_{1}(t)=h_{2}(t)}
となる。したがって、
H
0
{\displaystyle H_{0}}
の下では、各グループ
i
=
1
,
2
{\displaystyle i=1,2}
に対して、
O
i
,
j
{\displaystyle O_{i,j}}
はパラメータ
N
j
{\displaystyle N_{j}}
,
N
i
,
j
{\displaystyle N_{i,j}}
,
O
j
{\displaystyle O_{j}}
を持つ超幾何分布に従う。この分布は、期待値が
E
i
,
j
=
N
i
,
j
O
j
N
j
{\displaystyle E_{i,j}=N_{i,j}{\frac {O_{j}}{N_{j}}}}
、分散が
V
i
,
j
=
E
i
,
j
(
N
j
−
O
j
N
j
)
(
N
j
−
N
i
,
j
N
j
−
1
)
{\displaystyle V_{i,j}=E_{i,j}\left({\frac {N_{j}-O_{j}}{N_{j}}}\right)\left({\frac {N_{j}-N_{i,j}}{N_{j}-1}}\right)}
である。
ログランク統計量は、すべての
j
=
1
,
…
,
J
{\displaystyle j=1,\ldots ,J}
について、
O
i
,
j
{\displaystyle O_{i,j}}
と
H
0
{\displaystyle H_{0}}
のもとでの期待値
E
i
,
j
{\displaystyle E_{i,j}}
と比較するものである。これは
Z
=
∑
j
=
1
J
(
O
i
,
j
−
E
i
,
j
)
∑
j
=
1
J
V
i
,
j
→
d
N
(
0
,
1
)
{\displaystyle Z={\frac {\sum _{j=1}^{J}(O_{i,j}-E_{i,j})}{\sqrt {\sum _{j=1}^{J}V_{i,j}}}}\ {\xrightarrow {d}}\ {\mathcal {N}}(0,1)}
(
i
=
1
{\displaystyle i=1}
または
2
{\displaystyle 2}
の場合) として定義されている。
中心極限定理により、
Z
{\displaystyle Z}
の分布は、
J
{\displaystyle J}
が無限に近づくにつれて標準正規分布の分布に収束するため、十分に大きな
J
{\displaystyle J}
に対しては標準正規分布で近似することができる。Peto and Petoの論文の付録Bで記述されているように、この量を、ピアソンの第1種ベータ分布または第2種ベータ分布(最初の4つのモーメントを一致させる)と等しくすることにより、より良い近似が得られる。
漸近分布
2つのグループが同じ生存関数を持つ場合、ログランク統計量は近似的に標準正規分布となる。片側レベル
α
{\displaystyle \alpha }
検定は、
Z
>
z
α
{\displaystyle Z>z_{\alpha }}
ならば帰無仮説を棄却する。ここで
z
α
{\displaystyle z_{\alpha }}
は、標準正規分布の上位
α
{\displaystyle \alpha }
分位点である。ハザード比を
λ
{\displaystyle \lambda }
、被験者総数を
n
{\displaystyle n}
人、どちらかの群の被験者が最終的に事象を起こす確率を
d
{\displaystyle d}
(したがって、
n
d
{\displaystyle nd}
は分析時の事象の期待数)、各群に無作為に割り振られた被験者の割合を50%とすると、ログランク統計量は平均
(
log
λ
)
n
d
4
{\displaystyle (\log {\lambda })\,{\sqrt {\frac {n\,d}{4}}}}
、分散 1 の近似正規分布となる。検出力
1
−
β
{\displaystyle 1-\beta }
の片側レベル
α
{\displaystyle \alpha }
検定の場合、必要な標本サイズは
n
=
4
(
z
α
+
z
β
)
2
d
log
2
λ
{\displaystyle n={\frac {4\,(z_{\alpha }+z_{\beta })^{2}}{d\log ^{2}{\lambda }}}}
となり、ここに
z
α
{\displaystyle z_{\alpha }}
と
z
β
{\displaystyle z_{\beta }}
は標準正規分布の分位数である。
同時分布
Z
1
{\displaystyle Z_{1}}
および
Z
2
{\displaystyle Z_{2}}
を、同じ検定の2つの異なる時点でのログランク統計量であるとする(
Z
1
{\displaystyle Z_{1}}
が先)。ここでも、2つのグループのハザード関数がハザード比
λ
{\displaystyle \lambda }
に比例し、
d
1
{\displaystyle d_{1}}
と
d
2
{\displaystyle d_{2}}
は
d
1
≤
d
2
{\displaystyle d_{1}\leq d_{2}}
の2つの時点で被験者が事象を起こす確率であると仮定する。
Z
1
{\displaystyle Z_{1}}
および
Z
2
{\displaystyle Z_{2}}
は、平均
log
λ
n
d
1
4
{\displaystyle \log {\lambda }\,{\sqrt {\frac {n\,d_{1}}{4}}}}
と
log
λ
n
d
2
4
{\displaystyle \log {\lambda }\,{\sqrt {\frac {n\,d_{2}}{4}}}}
、相関
d
1
d
2
{\displaystyle {\sqrt {\frac {d_{1}}{d_{2}}}}}
を持つ近似二変量正規分布である。データモニタリング委員会による1つの検査でデータが複数回が調査された場合、エラー率を正しく維持するためには、同時分布を含む計算が必要となる。
他の統計との関係
- ログランク統計量は、2つのグループを比較するCox比例ハザードモデルのスコア検定として導出できる。したがって、その統計量は、そのモデルに基づく尤度比検定統計量と漸近的に等価である。
- ログランク統計量は、比例ハザード代替性を持つ任意の分布族の尤度比検定統計量と漸近的に等価である。たとえば、2つの標本からのデータが指数分布を持つ場合がある。
-
Z
{\displaystyle Z}
をログランク統計量、
D
{\displaystyle D}
を観察された事象の数、
λ
^{\displaystyle {\hat {\lambda }}}
をハザード比の推定値とすると、
log
λ
^≈
Z4
/
D
{\displaystyle \log {\hat {\lambda }}\approx Z\,{\sqrt {4/D}}}
である。この関係は、2つの量が分かっている場合(たとえば、発表された論文から)、3つ目の量が必要な場合に有用である。
- ログランク統計量は、観測が打ち切られている場合に使用できる。データに打ち切られた観測が存在しない場合、ウィルコクソンの順位和検定が適切である。
- ログランク統計量は、事象が発生した時間にかかわらず、すべての計算に同じ重みを与える。ピートログランク検定統計量は、観測値の数が多い場合、初期の事象により多くの重みを与える。
検定の仮定
ログランク検定は、カプラン=マイヤー生存曲線と同じ仮定に基づいている。すなわち、打ち切りは予後とは無関係であり、生存確率は研究の初期と後期に募集された被験者で同じであり、事象は指定された時間に起こったという仮定である。これらの仮定からの逸脱が問題となるのは、比較されるグループ間で充足の度合いが異なる場合である。たとえば、あるグループでは打ち切りが他のグループよりも起こりやすいなどである。
参照項目
- 生存分析
- カプラン=マイヤー推定量
- ハザード比
脚注
Logrank 検定・多群Logrank 検定 LOGR スタットメイトStatMate医学統計 医療統計 例題と解析
ログランク検定と一般化ウィルコクソン検定とは?p値やカプランマイヤー曲線の解釈 いちばんやさしい、医療統計
【統計】生存時間解析 ログランク検定、一般化Wilcoxon検定(Gehan’s Wilcoxon検定)等 こちにぃるの日記
Cox回帰とログランク検定の違いをわかりやすく徹底解説|データ分析初心者向けガイド
ログランク検定(logrank test) 統計学備忘録 リハビリテーション統計学
書記が数学やるだけ844 ログランク検定|Writer_Rinka
【英単語】logrank testを徹底解説!意味、使い方、例文、読み方
ログランク検定と一般化ウィルコクソン検定とは?p値やカプランマイヤー曲線の解釈 いちばんやさしい、医療統計
【動画】「ログランク検定」の英語の発音をわかりやすく 英語の学会発表 with Amie
Log Rank Testとは ログランク検定 2群 ログランク検定 ログランク検定の概要 NXFJO
ログランク検定とは?初心者にもやさしく解説する基礎と使い方共起語・同意語・対義語も併せて解説!
加重ログランク検定とは|ビジネスコンシェルジュ
ログランク検定と一般化ウィルコクソン検定とは?p値やカプランマイヤー曲線の解釈 いちばんやさしい、医療統計
R と EZR を使ったログランク検定計算のわかりやすい解説 統計ER
【統計】生存時間解析 ログランク検定、一般化Wilcoxon検定(Gehan’s Wilcoxon検定)等 こちにぃるの日記
書記が数学やるだけ844 ログランク検定|Writer_Rinka
ログランク検定と一般化ウィルコクソン検定とは?p値やカプランマイヤー曲線の解釈 いちばんやさしい、医療統計
臨床試験における生存分析—ログランク検定
Log Rank Testとは ログランク検定 2群 ログランク検定 ログランク検定の概要 NXFJO
【英単語】log rank testを徹底解説!意味、使い方、例文、読み方
ログランク検定の特徴 時間経過に伴う生存率の違いを評価できる カプラン・マイヤー法による生存曲線を統計的に比較する。 打ち切りデータ(Censored Data)を考慮できる 途中で観察が終了した被験者を含めた解析が可能。 2つ以上のグループ間の差を比較できる 例えば、新薬群と従来薬群の.. Log-rant test とは、ある時点の生存率でなく、生存曲線の全体を比較することができる生存時間の検定手法である。生存時間 T は、一般に正規分布には従わない。