当前位置: 网站首页 >AI教程资讯 >正文

Collaborative Gym – 支持人与AI代理实时交互协作的评估框架

来源:爱论文 时间:2025-03-19 10:21:29

Collaborative Gym是什么

Collaborative Gym(Co-Gym)是专注于人机协作(Human-Agent Collaboration)的框架,支持人类与AI代理之间的实时交互与协作。通过模拟和真实两种实验条件,支持开发者在受控环境中进行迭代开发,同时能在真实场景中部署和评估协作效果。Co-Gym支持异步交互,能处理代理、人类和任务环境之间的三方互动。

Collaborative Gym

Collaborative Gym的主要功能

支持异步交互:Co-Gym突破传统多智能体框架中同步行动的限制,支持人类和AI代理在协作中灵活地发起行动,无需严格按顺序交互。更接近真实的人类协作模式。任务环境设计:Co-Gym将每个任务定义为部分可观测马尔可夫决策过程(POMDP),支持公共和私有观测空间。公共部分对所有参与者可见,私有部分仅对所有者可见,类似于人类团队**享白板和个人笔记的区别。评估框架:Co-Gym关注任务完成的结果,重视协作过程本身。提供了综合评估框架,从协作质量和协作过程两个维度对代理进行评估。模拟与真实条件:Co-Gym支持模拟和真实两种实验条件。模拟条件使用预收集的任务实例和模拟人类行为,便于快速迭代开发;真实条件支持与真实人类在实际任务环境中协作,支持旅行规划、文献综述和表格分析等多种任务。

Collaborative Gym的技术原理

协作驱动的环境设计:Co-Gym借鉴了OpenAI Gym的设计思路,针对人机协作进行了优化。支持在观测空间中定义公共和私有部分:公共部分对所有参与者可见,私有部分仅对所有者可见。模拟了真实协作场景**享信息和个人笔记的区别。异步交互:Co-Gym支持异步交互,支持人类和代理在必要时独立行动,无需等待对方响应。为此,Co-Gym引入了两种协作行为:发送消息(SendTeammateMessage)和等待对方继续(WaitTeammateContinue),采用通知协议实时通知参与者环境的变化。通知协议:Co-Gym通过Redis服务器实现通知协议,支持四种事件类型:共享观测更新、私有观测变化、新消息通知以及环境不活动超时通知。这支持代理实时监控环境变化,更好地与人类协作。任务环境接口(CoEnv):Co-Gym提供了灵活的任务环境接口,支持开发者轻松添加新的任务环境。开发者只需定义任务描述、动作空间和观测空间即可。Co-Gym支持多种任务环境,如旅行规划、文献综述和表格数据分析。

Collaborative Gym的项目地址

Github仓库:https://github.com/SALT-NLP/collaborative-gymarXiv技术论文:https://arxiv.org/pdf/2412.15701

Collaborative Gym的应用场景

旅行规划(Travel Planning):在旅行规划任务中,Co-Gym支持人类与AI代理协作制定详细的旅行行程。代理可以基于搜索和规划能力,人类可以提供偏好和专业知识,共同完成旅行计划。表格数据分析(Tabular Analysis):Co-Gym为代理和人类提供了共享工作空间和实时沟通能力,支持效的协作分析。文献综述(Related Work):在文献综述任务中,Co-Gym支持人类与AI代理协作完成学术文献的整理和分析。代理可以快速检索和筛选相关文献,人类可以提供领域专业知识,共同完成高质量的文献综述。
上一篇:TIGER – 清华大学推出的轻量级语音分离模型
相关资讯 更多+
  • Collaborative Gym – 支持人与AI代理实时交互协作的评估框架
    Collaborative Gym – 支持人与AI代理实时交互协作的评估框架

    Collaborative Gym(Co-Gym)是专注于人机协作(Human-Agent Collaboration)的框架,支持人类与AI代理之间的实时交互与协作。通过模拟和真实两种实验条件,支持开发者在受控环境中进行迭代开发,同时能在真实场景中部署和评估协作效果。

    AI教程资讯 2023-04-14

  • TIGER – 清华大学推出的轻量级语音分离模型
    TIGER – 清华大学推出的轻量级语音分离模型

    TIGER(Time-frequency Interleaved Gain Extraction and Reconstruction Network)是清华大学研究团队提出的轻量级语音分离模型,通过时频交叉建模策略,结合频带切分和多尺度注意力机制,显著提升了语音分离的效果,降低了参数量和计算量。

    AI教程资讯 2023-04-14

  • NPOA – 开源舆情检测工具,实时监控网络舆情与分析
    NPOA – 开源舆情检测工具,实时监控网络舆情与分析

    NPOA 是开源的功能强大的舆情监测工具,可以帮助用户实时监控网络舆情,了解公众对特定话题或品牌的看法。系统基于先进的自然语言处理技术,可以分析大量的网络数据,提供可视化的舆情分析报告。

    AI教程资讯 2023-04-14

  • Long-VITA – 腾讯优图联合南大、厦大开源的多模态模型
    Long-VITA – 腾讯优图联合南大、厦大开源的多模态模型

    Long-VITA 是腾讯优图实验室、南京大学、厦门大学开源的多模态模型,能处理超过100万tokens的长文本输入,在短文本任务中表现出色。Long-VITA基于分阶段训练,逐步扩展视觉和语言的上下文理解能力,支持图像、视频和文本的多模态输入。

    AI教程资讯 2023-04-14

最新录入 更多+
确定