Lobsters | 原文链接 | 2026-09-20 收录

拿 Jev 试玩 2048:非自回归决策模型的真实水平

来源: gist.github.com — 2026-09-19

概述

作者用 2048 游戏给 TypeSafe 的决策模型 jev-1.13.0 做了一轮朴素试驾,把棋盘状态和上下左右四个选项交给模型,并用四种问法做了对照实验。结果不太好看:只给棋盘时它的中位得分只有 706,和随机走子(1102)在同一水平;补上规则和每种走法的说明后升到 1656;把每个走法导致的棋盘与得分都算好再交给它,中位得分 2494、最大 5532、最好方块到 512,大致追平一条固定规则。

核心要点

金句

只把棋盘交给它时,它的表现和随机走子差不多。
← 返回 Lobsters 首页