题目
规则和基础版一样:300 个块,200 轮,每轮留下、换新块或回旧块,换块扣费,总量最高的赢。 不同的是:
每次挖到的量会波动
每个块有一个真实水平,每次挖到的量围绕它上下波动。波动幅度每张地图不同,有的上下两成,有的上下一倍。格子上显示的是平均值,右上角的 ×n 是挖过几次。
偶尔挖空
每个块有自己的挖空概率,平均不到一成,个别块两三成。挖空那轮得 0。
挖一次不代表真实水平
一个块只挖一次,看到的数可能比真实水平高一倍,也可能是 0。多挖几次的平均才靠谱,但每多挖一次都花一轮。
正式比赛用这个版本
老师用隐藏的地图和多个种子重跑所有人的代码,按平均得分排名。地图上的分数按真实水平算。和基础版不同,加强版不公布本图的分布家族,state.dist 是 undefined。
地图
站过的块(按平均挖到的量排序,点击可回去)
累计得分
| # | 玩家 | 总得分 | 比上限少 | 换块次数 | 站过的块 | 最后站的块真实水平 | 它在全图里排 |
|---|---|---|---|---|---|---|---|
| 一局结束后出排名 | |||||||
四个机器人和你在同一张地图上跑,它们的走位和得分在一局结束后才公布。 "上限"是假设从第 1 轮就站在真实水平最高的块上、一次不换,能拿到的分数;"从不换"是开局分到哪块就守哪块。 所有玩家"换新块"拿到的顺序相同,每轮的波动和挖空也相同,所以策略之间没有抽签运气。
这台电脑上的对局记录
每局结束自动记一行,存在浏览器里。点"复现"用同一个种子重开一局手动,地图完全一样。
| 时间 | 种子 | 方式 | 分布 | 块 / 轮 | 你的得分 | 上限 | 你排第几 | |
|---|---|---|---|---|---|---|---|---|
| 还没有记录 | ||||||||
你的代码
和基础版共用同一份代码。加强版里 state.tried 每项的 count(挖过几次)和
mean(平均挖到)变得重要:只挖过一次的均值不可信。波动和挖空的具体规则见地图生成。
练习世界的参数(正式比赛由老师另定,你改这里只影响自己练习)
提交
加强版的比赛之后单独办,现在先办基础版的。这里的提交进的是加强版的池子,和基础版分开。提交前会按加强版公开分站试跑一遍,跑不起来会提示。 正式比赛用老师的隐藏地图和多个种子重跑所有人的代码,所以你在练习里的分数只是参考。 成绩在颁奖页看。
身份码(昵称是谁的,靠它认)
这台设备的身份码:
第一次用某个昵称提交时,服务器把昵称和你的身份码绑定,别人用同一个昵称提交会被拒。
换设备时把身份码抄过去填在下面,就还是同一个人。身份码丢了就换个昵称。