1 像測度による変換
証明.TとXは可測であるため、合成Y=T∘Xも可測である。分布と像測度の定義から、
μY(B)=P(T(X)∈B)=P(X∈T−1(B))=μX(T−1(B))を得る。▨
この命題は密度の存在を仮定しない。離散分布、絶対連続分布および特異分布のいずれにも同じ式を適用することができる。
2 Lebesgue 積分に対する変数変換
上流の§E4.14 定理 2.1は、有界 Jordan 可測集合と連続関数に対して変数変換公式を証明している。確率密度は連続とは限らないため、Borel 測度の一意性を用いて非負 Borel 可測関数まで公式を拡張する。
2.1 証明方針
Jacobi 行列式で重み付けた定義域側の測度を写像で移し、像側の Lebesgue 測度と比較する。最初にコンパクトに含まれる開直方体上で、連続関数版の変数変換公式と単調収束定理から両測度の値を一致させる。次に π–λ 定理で局所 Borel 集合へ広げ、可算な直方体被覆で開集合全体へ広げる。最後に指示関数、非負単関数、非負 Borel 可測関数の順に積分公式を導く。
補題 2.1.U,V⊂Rnを開集合とし、Φ:U→VをC1級微分同相とする。h:V→[0,∞]が Borel 可測ならば、
∫Vh(y)dy=∫Uh(Φ(x))∣detDΦ(x)∣dxが[0,∞]において成り立つ。hが実数値 Borel 可測関数で、いずれか一方の絶対値の積分が有限ならば、両辺は絶対収束し、同じ等式が成り立つ。
証明.V上の Borel 測度ρを
ρ(B)=∫Φ−1(B)∣detDΦ(x)∣dx(B∈B(V))によって定める。被積分関数は非負 Borel 可測であるため、ρは測度である。
連続なコンパクト台関数の多変数 Riemann 積分と Lebesgue 積分が一致することを、ここで確認する。関数gの台を含む閉直方体Kを格子へ分割し、各小直方体上のgの下限と上限を値とする単関数をℓm,umとする。gはK上で一様連続であるため、格子の最大辺長を零へ近づけると
0≤∫Kumdλn−∫Kℓmdλn≤λn(K)ωg(meshm)⟶0,ただしωgは一様連続性の法である。各単関数の Lebesgue 積分は対応する Darboux 和に一致し、ℓm≤g≤umである。したがって、Lebesgue 積分は下 Darboux 和と上 Darboux 和の共通極限、すなわち Riemann 積分に一致する。
開直方体QがQ⊂Vを満たすとする。連続関数
hk(y)=min{1,kdist(y,V∖Q)}はV上で非負であり、台はQに含まれ、hk↑1Qを満たす。上で確認した二つの積分の一致により、§E4.14 系 4.1をhkへ適用すると
∫Vhk(y)dy=∫Uhk(Φ(x))∣detDΦ(x)∣dxを得る。両辺へ単調収束定理を適用して
λn(Q)=ρ(Q)を得る。ここでλnはn次元 Lebesgue 測度である。
固定した開直方体Q上では、λnとρの制限は有限測度であり、全体Qの値が一致する。Qと、閉包がQに含まれる開直方体と、空集合からなる族は π 系であり、Qの Borel 集合族を生成する。二つの有限測度が一致する集合全体は Dynkin 系をなすため、§E9.1 定理 4.8により二つの測度はQのすべての Borel 集合上で一致する。
Vは、閉包がVに含まれる開直方体の可算族(Qj)j≥1で覆うことができる。D1=Q1および
Dj=Qj∖r<j⋃Qr(j≥2)とおくと、Djは互いに交わらず、各DjはQjに含まれる。任意の Borel 集合B⊂Vに対して局所的な一致をB∩Djへ適用し、可算加法性を用いると
λn(B)=j=1∑∞λn(B∩Dj)=j=1∑∞ρ(B∩Dj)=ρ(B)となる。したがって、λn=ρである。
指示関数、非負単関数およびその増加極限の順に積分すると、任意の非負 Borel 可測関数hについて
∫Vhdρ=∫Uh(Φ(x))∣detDΦ(x)∣dxである。ρ=λnを代入して非負の場合の主張を得る。実数値の場合はh+とh−へ非負の場合を適用する。絶対値の公式から一方の絶対可積分性は他方の絶対可積分性と同値であり、二つの等式の差をとることができる。▨
証明で用いた§E4.14 系 4.1は、開集合間のC1級微分同相と非負連続関数を仮定する。適用箇所のhkは連続かつコンパクト台であるため、同定理の仮定を満たす。
3 一変数の単調変換
導関数が零にならない場合には、逆関数がC1級であり、密度の公式は一つの逆像だけから得られる。
3.1 証明方針
Borel 集合Bを固定し、像測度の式でP(T(X)∈B)をT−1(B)上の密度積分として書く。補題 2.1を逆像点における密度と∣T′∣−1の積へ適用し、B上の積分へ移すことによって密度を同定する。
定理 3.1.I,J⊂Rを開区間とし、T:I→JをC1級微分同相とする。XはP(X∈I)=1を満たし、Lebesgue 密度fXをもつとする。このときY=T(X)は Lebesgue 密度
fY(y)=1J(y)∣T′(T−1(y))∣fX(T−1(y))をもつ。
証明. Borel 集合B⊂Rに対して、命題 1.1と補題 2.1を用いると、
P(Y∈B)=∫T−1(B∩J)fX(x)dx=∫B∩J∣T′(T−1(y))∣fX(T−1(y))dy.第二の等式では、Tに対する変数変換公式へh(y)=1B∩J(y)fX(T−1(y))/∣T′(T−1(y))∣を適用した。したがって、表示した関数がYの密度である。▨
導関数が零になる点を含む単調写像では、臨界集合へ元の分布が置く確率を分離する必要がある。
3.2 証明方針
I∖Cを導関数が零にならない開区間へ分解する。臨界集合Cからの確率を零確率の仮定で除いた後、各区間上の密度fX1Ikが定める劣確率測度の寄与へ補題 2.1を直接適用する。最後に非負項の可算和と積分を Tonelli の定理で交換する。
定理 3.2.I⊂Rを開区間、T:I→Rを単調なC1級写像とし、
C={x∈I:T′(x)=0}とおく。XはP(X∈I)=1を満たし、密度fXをもち、
P(X∈C)=∫CfX(x)dx=0とする。I∖Cの連結成分を(Ik)k≥1とし、Tk=T∣Ik、Jk=Tk(Ik)とおく。このときY=T(X)は密度
fY(y)=k≥1∑1Jk(y)∣T′(Tk−1(y))∣fX(Tk−1(y))をもつ。
証明.I∖Cは実直線の開集合であるため、高々可算個の互いに交わらない開区間Ikの和である。Tが単調であり、Ik上で導関数が零にならないため、各Tk:Ik→JkはC1級微分同相である。
Borel 集合Bに対して、Cからの寄与は仮定により零である。したがって、各kについて非負 Borel 可測関数
hk,B(y)=1B∩Jk(y)∣Tk′(Tk−1(y))∣fX(Tk−1(y))を考える。補題 2.1をTk:Ik→Jkとhk,Bへ適用すると、
∫B∩Jk∣Tk′(Tk−1(y))∣fX(Tk−1(y))dy=∫Ik∩T−1(B)fX(x)dx.この適用はfX1Ikの積分が1であることを必要とせず、各枝が担う劣確率測度の質量をそのまま移す。
したがって、
P(Y∈B)=k≥1∑∫Ik∩T−1(B)fX(x)dx=k≥1∑∫B∩Jk∣T′(Tk−1(y))∣fX(Tk−1(y))dy=∫Bk≥1∑1Jk(y)∣T′(Tk−1(y))∣fX(Tk−1(y))dy.第二の等式は上の枝ごとの変数変換、第三の等式は非負関数に対する Tonelli の定理による。ゆえに、表示した関数が密度である。▨
零確率という仮定を外すと、変換後の分布には原子または特異成分が生じる場合がある。
命題 3.3.T:I→Rが区間[a,b]⊂I上で定数cであり、P(X∈[a,b])>0とする。このとき、Y=T(X)はcに原子をもち、
P(Y=c)≥P(X∈[a,b])>0である。
証明.[a,b]⊂T−1({c})であるため、像測度の式から直ちに従う。▨
平坦な区間をもたない狭義単調写像でも、正の測度をもつ臨界集合が特異成分を作ることがある。
例 3.4 (太い Cantor 集合から生じる特異成分).[0,1]から、第n段階で残っている2n−1個の閉区間の中央から、それぞれ長さ4−nの開区間を除く。残った閉集合をFとする。除いた区間の長さの総和は
n=1∑∞2n−14−n=21であるから、Fは Lebesgue 測度1/2の閉集合である。各段階で各残存区間から開区間を除くため、Fは内点をもたず、補集合は稠密である。実際、第n段階の各残存区間の長さは前段階の長さの半分より小さいため、最大の長さは2−n以下で零へ収束する。
g(x)=dist(x,F)とし、
T(x)=∫0xg(t)dt(0≤x≤1)と定める。TはC1級でT′=gである。任意のa<bに対して(a,b)はFの補集合の開区間を含み、その区間上でg>0である。したがってT(b)−T(a)=∫abg(t)dt>0であり、Tは狭義単調である。一方、臨界集合は{T′=0}=Fであり、正の Lebesgue 測度をもつ。
Xを[0,1]上の一様分布とし、Y=T(X)とする。λ1(T(F))=0を確認する。任意のε>0に対して、gの連続性とg∣F=0から、Fを含みg<εを満たす開集合O⊂[0,1]を選ぶことができる。Oを互いに交わらない開区間へ分解し、各区間で微積分学の基本定理を用いると、単調性から
λ1(T(F))≤λ1(T(O))≤∫Og(x)dx≤ε.εは任意であるため、λ1(T(F))=0である。しかしTは単射なので、
P(Y∈T(F))=P(X∈F)=21.したがって、Yの分布は Lebesgue 測度に関して絶対連続ではなく、質量1/2の非原子的な特異成分をもつ。実際、Tは単射でありXは一点に正の確率を置かないため、Yも原子をもたない。
この例は「狭義単調である」という条件だけでは密度変換公式に十分でないことを示す。定理 3.2の零確率条件は、臨界集合から生じる特異な寄与を除いている。
4 有限個の単調枝をもつ変換
単射でない写像は、有限個の正則な単調枝に分けることができる場合に限って扱う。
4.1 証明方針
写像を確率零集合上も含めて Borel 可測写像として先に定める。各枝上のfX1Ijが定める劣確率測度へ Borel 可測関数版の変数変換公式を直接適用し、同じ像点へ到達する有限個の枝の密度寄与を加える。
証明. Borel 集合Bを固定する。各jについて
hj,B(y)=1B∩Jj(y)∣Tj′(Tj−1(y))∣fX(Tj−1(y))とおく。補題 2.1をTjとhj,Bへ適用すると、
∫B∩Jj∣Tj′(Tj−1(y))∣fX(Tj−1(y))dy=∫Ij∩T−1(B)fX(x)dx.各枝の積分は一般には1でなく、P(X∈Ij)に等しい劣確率測度の全質量である。枝が互いに交わらず、その和集合へXが入る確率が1であることから、
P(Y∈B)=j=1∑m∫Ij∩T−1(B)fX(x)dx=j=1∑m∫B∩Jj∣Tj′(Tj−1(y))∣fX(Tj−1(y))dy.有限和と積分を交換して表示した密度を得る。▨
例 4.2 (標準正規確率変数の平方).Xを標準正規分布に従う確率変数とし、Y=X2とする。写像T(x)=x2は(−∞,0)と(0,∞)の二つの枝で正則であり、P(X=0)=0である。y>0に対する二つの逆像は−yとyであるから、
fY(y)=2y12π1e−y/2+2y12π1e−y/2=2πy1e−y/2.y≤0ではfY(y)=0である。規格化はy=x2と置換して
∫0∞2πy1e−y/2dy=2∫0∞2π1e−x2/2dx=1と再計算することができる。
5 多変数の微分同相
一変数の導関数の絶対値は、多変数では Jacobi 行列式の絶対値に置き換わる。
5.1 証明方針
像測度によってP(Φ(X)∈B)をΦ−1(B)上の密度積分へ直す。補題 2.1を逆写像Φ−1へ適用して像側の積分へ移し、逆関数の微分公式で∣detDΦ−1∣を∣detDΦ∣−1に書き換える。
証明. Borel 集合B⊂Rnに対して、像測度の式と補題 2.1をΦ−1:V→Uへ適用すると、
P(Y∈B)=∫Φ−1(B∩V)fX(x)dx=∫B∩VfX(Φ−1(y))∣detDΦ−1(y)∣dy.逆関数の微分公式DΦ−1(y)=(DΦ(Φ−1(y)))−1から、行列式の二つの表示は一致する。行列式に絶対値を付けるため、向きを反転する微分同相にも同じ密度公式を適用することができる。▨
6 演習
問題 6.1 (減少変換で絶対値が必要な理由).Xが区間(0,1)上の一様分布に従い、Y=1−Xとする。定理 3.1を用いてYの密度を求め、導関数の絶対値を外すことができない理由を説明せよ。
解答.
T(x)=1−xは(0,1)から(0,1)へのC1級微分同相であり、T−1(y)=1−y、T′(x)=−1である。したがって、
fY(y)=1(0,1)(y)∣−1∣1=1(0,1)(y).絶対値を外すと候補は−1となり、非負でなければならない密度にならない。絶対値は向きの反転を体積の符号へ反映させないために必要である。▨
7 扱う範囲の境界と次の記事
非単射写像については、有限個の正則な単調枝に分けることができる場合だけを扱った。一般の可算枝、高次元での重複度を含む面積公式、臨界値集合を扱う高次元の Sard の定理、および特異測度の一般的な分解は本記事の範囲外である。次の記事では、独立な確率変数の和を写像(x,y)↦x+yで変換し、離散分布と絶対連続分布の畳み込みを導く。