본 발명의 목적에 따른 노래 반주 시스템으로서, 사용자로부터 특정 노래에 대한 부르기 신청이 입력되면, 상기 특정 노래에 대한 멜로디 정보를 포함한 MR 데이터 및 상기 MR 데이터와 매칭되는 TTS(Text to Speech) 데이터를 포함하는 반주 데이터를 준비하도록 구성되는 사용자 단말, 및 상기 사용자 단말과 네트워크로 통해 통신하고, 상기 사용자 단말로부터 상기 특정 노래에 대한 반주 데이터의 전송 요청이 수신되면, 상기 특정 노래의 가사 라인별 시간 정보 및 가사 음절별 시간 정보를 포함하는 가사 포맷에 기초하여, 적어도 하나 이상의 인접하는 가사 라인들의 사이에 출력될 TTS 정보를 포함한 TTS 데이터를 생성하고, 상기 TTS 데이터를 상기 MR 데이터와 함께 상기 반주 데이터로서 상기 사용자 단말로 전송하도록 구성되는 중앙 서버를 포함하고, 상기 사용자 단말은 상기 중앙 서버로부터 제공받은 상기 반주 데이터가 준비되면, 동작 모드에 기초하여 상기 반주 데이터를 실행하도록 구성된다.