B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations

발행일
출처
arXiv
논문 번호
601
분야
Robotics
arXiv 번호
2607.09648

로봇 조작 정책의 액션을 연속 B-spline 곡선으로 표현해 실행 속도를 크게 높이는 B-spline Policy(BSP)를 제안한다.

B-spline Policy(BSP)는 이산적 액션 청킹 대신 연속 B-spline 곡선으로 액션을 파라미터화해 로봇 조작 정책의 실행 속도를 가속한다. B-spline의 시간적 스케일링으로 동일 궤적을 더 빠른 속도로 실행할 수 있으며, 추론 시점 세그먼트 정렬 메커니즘이 세그먼트 경계의 불연속성을 해소한다. 실제 로봇 실험에서 Table Cleaning 태스크 완료 시간을 50% 단축(23.57s→11.80s)하면서 성공률을 유지했고, Diffusion Policy 및 ACT 백본 모두에 drop-in으로 통합 가능하다.

핵심 요약

  • 이산 액션 청킹을 연속 B-spline 곡선으로 대체 — 시간적 재스케일링으로 실행 속도 가속
  • 추론 시점 세그먼트 정렬: 인접 B-spline 세그먼트 간 부드러운 전환 보장, 고속 실행 시 필수
  • Table Cleaning: 4X 속도에서 완료 시간 50% 단축(23.57s→11.80s), 성공률 유지(13/20 vs 14/20)
  • Diffusion Policy + ACT 백본 모두에 drop-in 통합 가능 — 기존 파이프라인 수정 최소
  • PushT 시뮬레이션: 4X 속도에서 점수 0.59→0.73, 시간 7.19s→2.87s로 동시 향상
  • 비균일 시간 구조 대응: 도달(빠름)~파지(정밀) 등 태스크 단계별 제어 입도 자동 할당

논문 링크

외부 연구를 정리한 자료입니다. HDATF가 발표한 논문이나 제품 성능을 측정한 결과는 아닙니다.

원문 보기 (새 탭에서 열림)