跳转到正文

动态交互 · 强化学习 · 无线通信 · 轻松一下

小游戏实验室

这里有 18 款无需额外依赖的轻量小游戏,嵌在页面里随手就能玩,也不会喧宾夺主。它们既有会从操作中学习的小型 Agent,也有取材于无线通信、人工智能与科研日常的概念模型和轻量谜题。

  • 卡片内游玩
  • 中英双语
  • 自动适配主题
  • 支持静态托管

01

把强化学习玩明白

你可以亲自示范并把控制权交给 Agent,也可以查看潜空间预测、解读时序逻辑监测报告,让抽象的学习机制先变得可见、可操作。

01

单键跑酷 · 20 秒–2 分钟

奖励跑酷

跳过障碍、收集奖励信标;跑道会在每回合逐渐加速,你唯一可执行的动作就是跳跃。

  • 点击 / 空格
  • 实时回报
  • 单键跑酷
单独打开
03

人机共同探索 Q 学习 · 20–60 秒

路由学徒

玩家与 Agent 以同等方式在新的路由回合中探索,每一步都会更新同一张小型 Q 表;你可以让 Agent 探索一局,也可以让它连续学习直到下一次成功送达。

  • 19 个决策状态
  • 人机共同探索
  • 障碍终止惩罚
单独打开
06

时序逻辑监测 · 30–90 秒

时序语义哨兵

调整时序逻辑告警阈值,观察简短的“观测—动作—结果”序列,再选择维持、局部修复或延长探测。灵敏阈值能更早发现故障,却更容易误报;宽松阈值则可能漏报。

  • 可调告警阈值
  • 语义裕度
  • 误报与漏报权衡
单独打开
02

多臂老虎机 · 15 次选择

探索与利用

在三个收益未知的选项之间反复选择,边试探边更新 Q 值,并决定何时探索、何时利用当前最优选项。

  • 三个选项
  • Q 值估计
  • 期望累积遗憾
单独打开
04

折扣回报 · 6 轮选择

折扣回报

在不同折扣因子下比较两条奖励序列,选出累积折扣回报更高的路线,并立即查看计算过程。

  • 折扣因子
  • 累积折扣回报
  • 即时反馈
单独打开
05

概念世界模型 · 30–90 秒

潜空间预演

向四周移动无人机中继并调整飞行高度,尽量让随海流漂移的用户保持在覆盖范围内。紧凑的动作条件模型会先在潜空间中预演三步,待真实观测返回后,再据此在线校正模型。

  • 七种飞行动作
  • 潜状态滚动预测
  • 连续服务锁定
单独打开

02

动手调一套无线系统

通过简化的概念模型直观看到覆盖、干扰、反向散射、语义链路恢复、反射、跳频和安全波束指向,并亲手调整系统参数。

07

天线几何 · 1–4 分钟

可移动天线实验

转动四座基站上的 12 副扇区天线,观察覆盖和干扰如何变化,或让搜索算法自动寻找更优配置。

  • 12 副可调天线
  • 覆盖图
  • 动态搜索
单独打开
10

人机共同探索抗干扰 · 30 秒–3 分钟

跳频学徒

玩家与 Agent 轮流面对新的干扰回合,每次选频都会更新同一个 18 状态策略;你可以让 Agent 探索一局,也可以让它持续学习,直到一局内至少送达 9 个数据包。

  • 18 状态表格学习
  • 人机共同探索
  • 连续探索至成功
单独打开
12

语义链路恢复 · 30–90 秒

断链续航

选择遥测语义信息的发送粒度,在链路中断时依靠预测状态维持服务,并把一次强制重新同步用在最合适的时机。它能保证下一时隙获得最新状态,但会带来明确的控制开销。

  • 预测缓存
  • 一次强制同步机会
  • 服务缺口
单独打开
08

波导布设 · 1–4 分钟

夹持天线实验

沿介质波导移动四个夹持点并切换辐射方向,在扩大用户覆盖与减少波束重叠干扰之间寻找更优配置。

  • 拖动夹持点
  • 切换方向
  • 动态搜索
单独打开
09

安全波束指向 · 30 秒–3 分钟

保密波束实验

在全空间局部平均能量图上调整 Alice 的波束方向。障碍物会完全遮断其后的视距传播;启用墙面后,墙与障碍物遵循同一种有损镜面反射规律,合计最多发生三次反射。比较 Bob 与 Eve 的可达速率,并最大化瞬时保密速率。

  • 瞬时保密速率
  • 能量覆盖图
  • 三次反射
单独打开
11

对抗式反向散射 · 1–3 分钟

借波突围

在十个时隙中管理有限的数据队列与电量。通过探测跟踪对手不断变化的发射节奏,结合最近四轮载波观测,判断当前信号是威胁、能量来源,还是可供反向散射利用的载波。

  • 队列与电量
  • 观测记录
  • 节奏适应
单独打开

03

网页里的科研彩蛋

把链路捕获和灵感记录藏进一两次点击里,适合放在论文、项目说明旁,或主页不经意的角落。

13

链路捕获 · 10–20 秒

链路捕获

点一下启动轨道过站,再点一下把卫星锁定在捕获窗口内;两次操作就能完成一次链路尝试。

  • 两次点击
  • 捕获时机
  • 距离提示
单独打开
14

灵感记录 · 5–30 秒

灵感星图

点下七个灵感节点,把片刻停留连成一张属于自己的研究星图。

  • 点击 / 回车
  • 7 个节点
  • 没有输赢
单独打开

04

研究间隙,多玩一会儿

把信号序列、视觉记忆、论文成长与资源组网做成耐玩的小谜题,适合研究间隙放空几分钟,也依然收在可嵌入的卡片里。

15

信号记忆 · 30 秒–3 分钟

信号回放

观察四个信道依次点亮,再按原顺序回放;信号序列每轮增加一步。

  • 按键 1–4
  • 10 轮
  • 慢速提示
单独打开
17

科研合成 · 3–10 分钟

论文花园

在 4×4 棋盘上合并相同阶段的研究样本,把一个小灵感逐步培育成一篇完整论文。

  • 方向键
  • 本机最佳记录
  • 灵感 → 论文
单独打开
16

视觉记忆 · 1–4 分钟

图样记忆

把 4×4 图样方阵当作一次小型视觉记忆测试:找齐 8 对图案,并尝试用更少步数完成。

  • 8 对图案
  • 本机最佳记录
  • 支持键盘
单独打开
18

资源编排 · 1–5 分钟

OpenRaaS 组网

旋转 OpenRaaS 网络节点,让计算、存储与镜像资源全部接入协调器,再观察请求如何沿着已连通路径流动。

  • 旋转节点
  • 每局可解
  • OpenRaaS
单独打开