AI炒股的下單策略怎麼驗?研究發現獎勵正確仍可能學不好 2026 年 10 月 9 日 作者: 林承志 AI炒股工具的下單策略如何驗收?倫敦大學學院研究者以券商交易模擬檢查PPO,發現獎勵計算正確仍可能學得不準。本文整理比較基準、最終測試、重複訓練與條件變動四項問題,並說明金管會的AI模型驗證指引。