该数据集建立于2025年3月,利用Python仿真平台构建生成,主要面向动态未知环境下的人机协同无人集群空战控制问题,旨在为多智能体强化学习、人类意图嵌入、层级元命令决策与OOD泛化能力评估提供数据支撑。数据集基于Harfang三维空战仿真平台生成,主要包含6v6训练场景,以及6v6、8v8、12v12、20v20等对称场景和6v8、8v12、12v20等非对称OOD测试场景。数据集包含一个txt文本文件,即replay_bufer.txt。replay_bufer.txt为无人集群执行任务过程中的状态、动作、奖励等强化学习要素数据,包含4列数据,分别为无人集群状态(state)、无人集群个体动作(action),团队奖励函数值(reward)、无人集群下一状态(next state)以及当前任务是否完成标志(done)。数据内容包括无人机状态、局部观测、连续控制动作、元命令选择、人类偏好值、奖励反馈、任务终止信息,以及胜率、毁伤比和平均回合时长等评估指标,可用于支撑人机协同集群控制策略训练与跨场景泛化性能测试。
| 采集时间 | 2025/01/01 - |
|---|---|
| 采集地点 | 合肥 |
| 海拔 | 4.0m - 80.0m |
| 数据量 | 143.8 MiB |
| 数据格式 | .txt |
本数据集为完全仿真生成数据,不源自特定文献、实测或第三方下载。
本数据集基于Harfang三维仿真环境和人机协同多智能体强化学习交互过程生成。首先初始化红蓝双方无人机的位置、速度、姿态和健康状态,并在仿真过程中依据飞行动力学和近距空战规则更新状态、执行攻击判定并记录交互轨迹。随后,将高层战术意图加工为“攻击/规避—目标组”的元命令,并结合人类对不同元命令的偏好值,形成带有人类意图标注的决策样本。最后,通过6v6训练场景和不同敌方策略、不同规模配置下的OOD测试场景生成多样化数据,并统计胜率、毁伤比和平均回合时长等指标,形成用于层级人机协同集群控制研究的结构化数据。
该数据呈现了无人集群子任务执行的详细数据。
| # | 编号 | 名称 | 类型 |
| 1 | 2022ZD0120000 | 博弈智能场景应用 |
本作品采用
CC BY 4.0 (知识共享 署名 4.0 国际许可协议)进行许可。
| # | 标题 | 文件大小 |
|---|---|---|
| 1 | 6_人机协同集群空战泛化数据集.txt | 143.8 MiB |
| # | 类别 | 标题 | 作者 | 年份 |
|---|---|---|---|---|
| 1 | 论文 | Exploring a Favorable Tradeoff for Finding Every Efficient Path in Large-Scale Networks | Qin J, Yu W, Mo Y, Liu H, Zhu X, Wei W, Yao Z | 2025 |
© 中国科学院西北生态环境资源研究院 2005- 备案号:陇ICP备2021001824号-21
兰州市东岗西路320号, 730000, 电话: 0931-4967592,0931-4967596

