B-spline Policy: Accelerating Manipulation Policies via B-spline Action Representations
- 발행일
- 출처
- arXiv
- 논문 번호
- 601
- 분야
- Robotics
- arXiv 번호
- 2607.09648
로봇 조작 정책의 액션을 연속 B-spline 곡선으로 표현해 실행 속도를 크게 높이는 B-spline Policy(BSP)를 제안한다.
B-spline Policy(BSP)는 이산적 액션 청킹 대신 연속 B-spline 곡선으로 액션을 파라미터화해 로봇 조작 정책의 실행 속도를 가속한다. B-spline의 시간적 스케일링으로 동일 궤적을 더 빠른 속도로 실행할 수 있으며, 추론 시점 세그먼트 정렬 메커니즘이 세그먼트 경계의 불연속성을 해소한다. 실제 로봇 실험에서 Table Cleaning 태스크 완료 시간을 50% 단축(23.57s→11.80s)하면서 성공률을 유지했고, Diffusion Policy 및 ACT 백본 모두에 drop-in으로 통합 가능하다.
핵심 요약
- 이산 액션 청킹을 연속 B-spline 곡선으로 대체 — 시간적 재스케일링으로 실행 속도 가속
- 추론 시점 세그먼트 정렬: 인접 B-spline 세그먼트 간 부드러운 전환 보장, 고속 실행 시 필수
- Table Cleaning: 4X 속도에서 완료 시간 50% 단축(23.57s→11.80s), 성공률 유지(13/20 vs 14/20)
- Diffusion Policy + ACT 백본 모두에 drop-in 통합 가능 — 기존 파이프라인 수정 최소
- PushT 시뮬레이션: 4X 속도에서 점수 0.59→0.73, 시간 7.19s→2.87s로 동시 향상
- 비균일 시간 구조 대응: 도달(빠름)~파지(정밀) 등 태스크 단계별 제어 입도 자동 할당
논문 링크
외부 연구를 정리한 자료입니다. HDATF가 발표한 논문이나 제품 성능을 측정한 결과는 아닙니다.