Operation-Guided Progressive Human-to-AI Text Transformation Benchmark for Multi-Granularity AI-Text Detection
- 발행일
- 출처
- arXiv
- 논문 번호
- 330
- 분야
- LLMs / NLP
- arXiv 번호
- 2606.06481
인간-AI 공동 편집 과정에서 AI 저작 신호가 어떻게 누적·소멸하는지 분석하는 다중 세분성 벤치마크다.
OpAI-Bench는 인간 작성 문서를 시작으로 AI 편집 연산을 점진적으로 적용해 9단계 수정 버전을 생성하는 벤치마크다. 문서, 문장, 토큰, 스팬 네 가지 세분성에서 AI 텍스트 탐지를 평가하며, 8개 문서 수준, 7개 문장 수준, 2개 미세 수준 탐지기를 포함한다. 핵심 발견은 AI 탐지 가능성이 AI 편집 비율뿐 아니라 편집 연산 유형, 도메인, 누적 수정 이력에 따라 결정되며, 혼합 저작의 중간 버전이 완전 인간이나 완전 AI보다 탐지하기 더 어렵다는 비단조적 패턴이다.
핵심 요약
- 인간-AI 점진적 공동 편집 과정을 9단계로 모델링하는 벤치마크 OpAI-Bench를 제안한다.
- 문서, 문장, 토큰, 스팬 네 가지 세분성에서 AI 텍스트 탐지기를 평가한다.
- 5가지 대표적 AI 편집 연산과 4개 도메인을 포괄한다.
- 혼합 저작의 중간 버전이 완전 인간이나 고비율 AI보다 탐지하기 더 어려운 비단조적 패턴을 발견했다.
- AI 탐지 가능성은 편집 비율, 연산 유형, 도메인, 누적 이력에 모두 의존한다.
논문 링크
외부 연구를 정리한 자료입니다. HDATF가 발표한 논문이나 제품 성능을 측정한 결과는 아닙니다.