资讯1 分钟阅读·
技能设定调高后棋类模型计算单调移向更深层
冻结权重的Maia-3在Elo从700调到2500时计算后移,提示可解释性结论依赖条件设定。
重要性局部证据E2 未复现写法快讯
冻结权重的国际象棋模型Maia-3在技能设定调高后,计算会单调地向更深层迁移——Elo从700调到2500,所有棋子攻击动作的计算中心都后移,骑士捉双后移最多。
此前普林斯顿教授Tom Griffiths曾预测,技能越高、关键特征应越早算出;这一方向与预测相反。Maia-3是一个以Elo等级分为输入、模仿不同水平人类棋手的8层transformer,作者David Litman在不改动任何权重的情况下完成测量。
作者提示,在一种条件下找到的模型回路,换一种条件未必还在原处。结果出自预印本与作者自建的分析工具。