XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment

발행일
출처
arXiv
논문 번호
866
분야
Robotics
arXiv 번호
2608.09892

이 논문은 N개 로봇 정책과 M개 평가 환경을 연결하는 데 O(NM)이 걸리던 것을 O(N+M)로 줄이는 통합 표준(XPolicyLab)을 만들었다. 42개 정책을 통합했고, 적응 시간을 5시간에서 30분으로 줄였다.

이 논문은 한마디로 로봇 정책(모델)마다 소프트웨어 의존성, 데이터 형식, 인터페이스가 달라서 새 벤치마크나 로봇에 연결할 때마다 매번 다시 짜야 하는 문제를 해결했다. XPolicyLab은 관찰·행동·궤적 표준 스키마와 의존성 격리 서빙 아키텍처를 제공해서, 정책 쪽과 환경 쪽이 각자 자기 소프트웨어를 유지하면서 하나의 인터페이스로 통신한다. 42개 정책을 통합하고 통합 시간을 5시간 → 30분으로 줄였다.

핵심 요약

  • 로봇 정책-환경 연결 비용을 O(NM)에서 O(N+M)로 줄이는 통합 표준을 제안했다.
  • 42개 로봇 정책(VLA, WAM, 모방학습 등)을 하나의 인터페이스로 통합했다.
  • 정책 서버와 환경 클라이언트를 소프트웨어 의존성별로 격리하는 구조를 만들었다.
  • 새 정책 적응 시간을 5시간 이상에서 30분(패키지 스킬 사용 시)으로 단축했다.
  • RoboTwin, RoboDojo 시뮬레이션 및 실제 로봇 평가를 하나의 어댑터로 지원한다.

논문 링크

외부 연구를 정리한 자료입니다. HDATF가 발표한 논문이나 제품 성능을 측정한 결과는 아닙니다.

원문 보기 (새 탭에서 열림)