Step-TP: LLM가 유도하는 텐서 프로그램 최적화를 위한 근거 기반 단계별 데이터셋과 Chain-of-Thought 추론
Step-TP: A Grounded, Step-Level Dataset with Chain-of-Thought Reasoning for LLM-Guided Tensor Program Optimization

TL;DR AI
1분핵심 요약
연구진은 LLM 기반 텐서 프로그램 최적화를 위한 사후학습 데이터셋 Step-TP를 소개했다.
Step-TP는 토큰 효율적인 IR과 명시적 상태 전이를 활용해 최적화를 원자적이고 검증 가능한 단계로 나눈다.
이 데이터셋은 근거가 있는 chain-of-thought 감독과 전략 필터링을 통해 다단계 최적화 학습을 강화한다.
목표는 자동 코드·성능 튜닝을 더 신뢰할 수 있고 해석 가능하며 검증하기 쉽게 만드는 것이다.
