안녕하세요, 안드로이드 음성인식 관련 앱 만들고있는 학생입니다.
다름이아니라 구글의 음성인식은..
클라이언트-서버 기반으로, 사용자가 음성명령을 내리면 서버로 음성데이터를 전달하여
서버측에서 Convert 한 후에 사용자에게는 Text를 리턴해주는 방식을 사용한다고 하는데요, 일단 음성인식 소스코드를 보면
private void startVoiceRecognitionActivity() {
try {
Intent it = new Intent(RecognizerIntent.ACTION_RECOGNIZE_SPEECH);
// it.putExtra(RecognizerIntent.EXTRA_LANGUAGE_MODEL, // RecognizerIntent.LANGUAGE_MODEL_FREE_FORM);
it.putExtra(RecognizerIntent.EXTRA_LANGUAGE, Locale.ENGLISH.toString());
it.putExtra(RecognizerIntent.EXTRA_PROMPT, "단어를 말하세요!");
startActivityForResult(it, REQUEST_CODE);
} catch (ActivityNotFoundException ex) {
Toast.makeText(SpeechActivity.this, "Activity Not Found", Toast.LENGTH_LONG).show();
}
Intent로 음성인식 기능을 하는것들을 불러와서 데이터를 넘겨주고 받아오고 하는데요, 궁금한것이
구글 서버가 IP를 뭘쓰는지도 알았고, 어떤방식으로 작동되는지도 알았는데요
예를들면, 제가 서버를 하나 구축하고 음성데이터를 제 서버로 보내고 싶다면
어느부분을 어떻게 수정해야 하나요??




제공되는 것으로는 안되고 직접 다 구현해야 되지 않을까 싶은데요.
우선 오디오 레코딩해서, pcm 데이터 같은거 뽑고, 서버에 전송하고.. 다시 응답받는것까지요.