G2 음성 플러그인 개발자, 휴대전화 내 음성 인식 API 제안
SDK 0.0.10의 오디오 인터페이스를 바탕으로, 개발자가 별도 클라우드 음성 인식 인프라를 운영해야 하는 부담을 지적한 커뮤니티 제안이다.
G2 플러그인에서 음성을 텍스트로 바꾸려면 외부 클라우드 서비스가 필요하다는 개발자 주장이 5월 커뮤니티에 올라왔다. 작성자에 따르면 SDK 0.0.10은 audioControl과 onAudioData로 모노 16kHz PCM을 제공하며, 받아쓰기 구현에는 별도 서버와 인증 관리가 따른다.
작성자는 휴대전화의 음성 인식을 호출하는 recognizeSpeech API를 제안했다. 현재 클라우드 방식은 네트워크가 끊기면 전사가 중단된다는 설명이다. 오프라인 처리와 지연 감소는 제안의 기대 효과이며, 공식 지원 발표나 구현이 확인된 기능은 아니다.
READ THE ORIGINAL
이 이야기의 출처
GitHub · Even Hub 개발자 이슈 · 원문 발행 5월 7일
원문에서 확인하기 원문을 바탕으로 한국어로 정리했습니다. 사용자 경험과 의견은 공식 제품 안내와 구분해 읽어주세요.여러분은 어떻게 쓰고 있나요?
직접 써본 경험이나 궁금한 점을 커뮤니티에 남겨주세요.
