메인 콘텐츠로 건너뛰기

사용자 사전(단어 등록·단어 강조)

AmiVoice API에는 사용자 사전 기능이 있으며, 인식되지 않는 단어나 인식하기 어려운 단어를 인식시키고 싶은 경우, 하이브리드 엔진에서는 "단어 등록"을, End to End 엔진에서는 "단어 강조"를 할 수 있습니다.

여기서는 먼저 사용자 사전 기능을 간단히 테스트해볼 수 있는 절차를 소개합니다.

Quick Start

노트

Python 샘플 코드를 실행하려면 requests 라이브러리가 필요합니다. 아래 코드를 quickstart.py 등의 파일명으로 저장합니다.

python -m pip install requests

다음 명령어를 실행합니다.

python quickstart.py

시스템 환경에 따라 python 대신 python3 또는 py를 사용하십시오.

1

사용자 사전 등록하기

사용자 사전 등록 API를 이용하거나 마이페이지에서 사용자 사전 등록을 수행합니다. 여기서는 "会話_汎用" 엔진(-a-general)에서 "とりぷるだぶる"이라는 발화를 "WWW"로 인식시키기 위해, 다음과 같이 등록합니다.

  • {API_key}에는 자신 계정의 API key를 지정합니다.
  • {profile_id}에는 임의의 프로파일 ID를 지정합니다. 예를 들어 test라는 프로파일 ID를 사용하고 싶은 경우, 아래의 {profile_id} 부분에 test라고 기입합니다.
curl https://acp-api.amivoice.com/profilewords/-a-general/{profile_id} \
-H "Authorization: Bearer {API_key}" \
-H "Content-Type: application/json" \
-d '{"profilewords":[{"written":"WWW","spoken":"とりぷるだぶる"}]}' | jq
노트
  • curl 명령어가 설치되어 있지 않은 경우, https://curl.se/ 에서 사용 중인 OS의 패키지를 다운로드하거나 패키지 매니저를 이용하여 curl을 설치하십시오.
  • 결과 텍스트는 Unicode 이스케이프되어 있습니다. 위 명령어에서는 응답을 보기 좋게 정리하기 위해 jq를 사용하고 있습니다. jq가 설치되어 있지 않은 경우 | jq 부분을 제외하고 실행해 보십시오. jq 명령어는 https://stedolan.github.io/jq/ 에서 사용 중인 OS의 패키지를 다운로드하거나 패키지 매니저를 이용하여 설치할 수 있습니다.
2

음성 파일 준비하기

음성 인식하고자 하는 음성 파일을 준비합니다. 다음 샘플 음성(www.wav)을 그대로 사용할 수 있습니다.

지원되는 음성 파일 형식에 대해서는 음성 포맷를 참조하십시오.

3

음성 인식 실행하기

다음을 실행하십시오. {API_key}는 자신 계정의 API key로, {profile_id}는 사용할 프로파일의 프로파일 ID로, www.wav는 사용할 음성 파일의 경로를 지정하십시오.

curl https://acp-api.amivoice.com/v1/recognize \
-F u={API_key} \
-F d="grammarFileNames=-a-general profileId=:{profile_id}" \
-F a=@www.wav | jq
노트
  • curl 명령어가 설치되어 있지 않은 경우, https://curl.se/ 에서 사용 중인 OS의 패키지를 다운로드하거나 패키지 매니저를 이용하여 curl을 설치하십시오.
  • 결과 텍스트는 Unicode 이스케이프되어 있습니다. 위 명령어에서는 응답을 보기 좋게 정리하기 위해 jq를 사용하고 있습니다. jq가 설치되어 있지 않은 경우 | jq 부분을 제외하고 실행해 보십시오. jq 명령어는 https://stedolan.github.io/jq/ 에서 사용 중인 OS의 패키지를 다운로드하거나 패키지 매니저를 이용하여 설치할 수 있습니다.
4

결과 확인

성공하면 다음과 같은 JSON 데이터가 반환됩니다. text 항목에 음성 인식 결과 텍스트가 포함됩니다.

{
"results": [
{
"tokens": [ ... ],
"confidence": 0.94,
"starttime": 500,
"endtime": 2084,
"tags": [],
"rulename": "",
"text": "WWW"
}
],
"utteranceid": "20260611/18/019eb5f848ac0a3013ba94cb_20260611_181648",
"text": "WWW",
"code": "",
"message": ""
}

상세한 응답 내용에 대해서는 음성 인식 결과 형식를 참조하시기 바랍니다.

다음 단계

하이브리드 엔진의 경우, 기본 상태에서는 음성 인식 엔진이 미리 등록된 단어만 인식할 수 있습니다. 따라서 고유명사 등 엔진에 학습되지 않은 단어를 인식시키고 싶은 경우, 해당 단어 정보를 추가로 등록해야 합니다. 이를 위한 기능이 "단어 등록"입니다.

반면, End to End 엔진의 경우, 하이브리드 엔진과는 음성 인식의 메커니즘이 다르며, "미리 등록된 단어"라는 개념을 가지고 있지 않습니다. 인식되지 않거나 인식하기 어려운 단어를 인식시키고 싶은 경우, 해당 단어의 출현 빈도를 높이는 "단어 강조"를 활용합니다.

이 섹션에서는 다음과 같은 내용을 설명합니다.

API Reference는 다음을 참조하십시오.

노트

언어에 따라 사용자 사전을 지원하지 않을 수 있습니다. 자세한 내용은 AmiVoice API 지원되는 언어를 참조하십시오.