动态交互 · 强化学习 · 无线通信 · 轻松一下
小游戏实验室
这里有 18 款无需额外依赖的轻量小游戏,嵌在页面里随手就能玩,也不会喧宾夺主。它们既有会从操作中学习的小型 Agent,也有取材于无线通信、人工智能与科研日常的概念模型和轻量谜题。
你可以亲自示范并把控制权交给 Agent,也可以查看潜空间预测、解读时序逻辑监测报告,让抽象的学习机制先变得可见、可操作。
01 单键跑酷 · 20 秒–2 分钟
奖励跑酷
跳过障碍、收集奖励信标;跑道会在每回合逐渐加速,你唯一可执行的动作就是跳跃。
单独打开 ↗ 03 人机共同探索 Q 学习 · 20–60 秒
路由学徒
玩家与 Agent 以同等方式在新的路由回合中探索,每一步都会更新同一张小型 Q 表;你可以让 Agent 探索一局,也可以让它连续学习直到下一次成功送达。
单独打开 ↗ 06 时序逻辑监测 · 30–90 秒
时序语义哨兵
调整时序逻辑告警阈值,观察简短的“观测—动作—结果”序列,再选择维持、局部修复或延长探测。灵敏阈值能更早发现故障,却更容易误报;宽松阈值则可能漏报。
单独打开 ↗ 02 多臂老虎机 · 15 次选择
探索与利用
在三个收益未知的选项之间反复选择,边试探边更新 Q 值,并决定何时探索、何时利用当前最优选项。
单独打开 ↗ 04 折扣回报 · 6 轮选择
折扣回报
在不同折扣因子下比较两条奖励序列,选出累积折扣回报更高的路线,并立即查看计算过程。
单独打开 ↗ 05 概念世界模型 · 30–90 秒
潜空间预演
向四周移动无人机中继并调整飞行高度,尽量让随海流漂移的用户保持在覆盖范围内。紧凑的动作条件模型会先在潜空间中预演三步,待真实观测返回后,再据此在线校正模型。
单独打开 ↗ 通过简化的概念模型直观看到覆盖、干扰、反向散射、语义链路恢复、反射、跳频和安全波束指向,并亲手调整系统参数。
07 天线几何 · 1–4 分钟
可移动天线实验
转动四座基站上的 12 副扇区天线,观察覆盖和干扰如何变化,或让搜索算法自动寻找更优配置。
单独打开 ↗ 10 人机共同探索抗干扰 · 30 秒–3 分钟
跳频学徒
玩家与 Agent 轮流面对新的干扰回合,每次选频都会更新同一个 18 状态策略;你可以让 Agent 探索一局,也可以让它持续学习,直到一局内至少送达 9 个数据包。
单独打开 ↗ 12 语义链路恢复 · 30–90 秒
断链续航
选择遥测语义信息的发送粒度,在链路中断时依靠预测状态维持服务,并把一次强制重新同步用在最合适的时机。它能保证下一时隙获得最新状态,但会带来明确的控制开销。
单独打开 ↗ 08 波导布设 · 1–4 分钟
夹持天线实验
沿介质波导移动四个夹持点并切换辐射方向,在扩大用户覆盖与减少波束重叠干扰之间寻找更优配置。
单独打开 ↗ 09 安全波束指向 · 30 秒–3 分钟
保密波束实验
在全空间局部平均能量图上调整 Alice 的波束方向。障碍物会完全遮断其后的视距传播;启用墙面后,墙与障碍物遵循同一种有损镜面反射规律,合计最多发生三次反射。比较 Bob 与 Eve 的可达速率,并最大化瞬时保密速率。
单独打开 ↗ 11 对抗式反向散射 · 1–3 分钟
借波突围
在十个时隙中管理有限的数据队列与电量。通过探测跟踪对手不断变化的发射节奏,结合最近四轮载波观测,判断当前信号是威胁、能量来源,还是可供反向散射利用的载波。
单独打开 ↗ 把链路捕获和灵感记录藏进一两次点击里,适合放在论文、项目说明旁,或主页不经意的角落。
13 链路捕获 · 10–20 秒
链路捕获
点一下启动轨道过站,再点一下把卫星锁定在捕获窗口内;两次操作就能完成一次链路尝试。
单独打开 ↗ 14 灵感记录 · 5–30 秒
灵感星图
点下七个灵感节点,把片刻停留连成一张属于自己的研究星图。
单独打开 ↗ 把信号序列、视觉记忆、论文成长与资源组网做成耐玩的小谜题,适合研究间隙放空几分钟,也依然收在可嵌入的卡片里。
15 信号记忆 · 30 秒–3 分钟
信号回放
观察四个信道依次点亮,再按原顺序回放;信号序列每轮增加一步。
单独打开 ↗ 17 科研合成 · 3–10 分钟
论文花园
在 4×4 棋盘上合并相同阶段的研究样本,把一个小灵感逐步培育成一篇完整论文。
单独打开 ↗ 16 视觉记忆 · 1–4 分钟
图样记忆
把 4×4 图样方阵当作一次小型视觉记忆测试:找齐 8 对图案,并尝试用更少步数完成。
单独打开 ↗ 18 资源编排 · 1–5 分钟
OpenRaaS 组网
旋转 OpenRaaS 网络节点,让计算、存储与镜像资源全部接入协调器,再观察请求如何沿着已连通路径流动。
单独打开 ↗