學習目標:每個 batch 內解一次指派問題,就換到一組幾乎不交叉的配對。batch 越大越接近全域 OT,但小 batch 就拿到大部分好處——而且不管 batch 多小,終點分布都不會偏。
綠細線=配對直線 紅細線=和別人交叉的那些配對 靛/金粗線=這組配對訓出來的邊際 ODE 軌跡 藍點=起點 橘點=資料
從「獨立」按到「192(全域)」:交叉比例一路掉、紅線幾乎消失。實測交叉比例大約 20% → 9% → 4% → 1.4% → 0.6%,1 步 Euler 的誤差 1.5 → 0.77 → 0.41 → 0.21 → 0.08。所以 batch 16 就走完八成的路,但後面還有得賺——是報酬遞減,不是「16 就夠了」。兩件事要記住:batch 內重排只是一個置換,x₁ 的集合完全沒變,所以終點分布不會偏(影響的是曲率,不是正確性);而這裡是 2D,高維時獨立樣本兩兩距離會集中、成本矩陣接近常數,OT 配對就退化成接近隨機配對。