한줄평
“기성 모델이 없는 언어나 특수 어휘용 음향 모델을 만들 때 유용합니다. 다만 학습 파이프라인이 복잡하고, 요즘의 신경망 기반 음성인식보다 정확도 면에서 뒤처집니다.”
이런 분께 맞춤 음성인식 모델을 학습시키려는 연구자께
좋은 점
- 맞춤 음향 모델 학습 가능
- 오픈소스 연구·실험에 적합
아쉬운 점
- 학습 절차가 복잡하고 진입 장벽이 큼
- 최신 딥러닝 방식 대비 성능 열세
스핑크스트레인 소개
CMU Sphinx 음성인식용 음향 모델을 직접 학습시키는 오픈소스 트레이너입니다. 음성 데이터와 발음 사전을 넣어 특정 언어나 도메인에 맞춘 인식 모델을 만들 때 씁니다. 여러 단계를 명령·스크립트로 실행하는 개발자·연구자용 CLI 도구입니다.