한국어 형태 · 문법
품사 체계
세부 태그
체언에는 NNG·NNP·NNB·NNBC·NP·NR, 용언에는 VV·VA·VX·VCP·VCN이 있습니다. J 계열은 조사, EP·EF·EC·ETN·ETM은 어미 기능을 구분합니다.
XPN·XSN·XSV·XSA와 XR은 파생 구조를 표현합니다. 태그는 표면형 문자열이 아니라 원문 분석의 node와 edge에 붙습니다.
coarse mapping
noun은 NNG·NNP·NNB·NNBC를, verb는 VV를, adjective는 VA를 포함합니다. VCP·VCN은 지정사 규칙에서 별도로 처리하고 질의 분석이 요구하는 범주로 projection합니다.
Coarse POS가 세부 태그를 지우지는 않습니다. 일치 origin에는 실제 질의 분석과 원문 analysis index가 남습니다.
중의 분석
나는은 나/NP+는/JX와 날다/VV+는/ETM 같은 여러 분석을 가질 수 있습니다. 질의 POS가 pronoun이면 첫 경로만, verb이면 둘째 경로만 프로그램이 됩니다.
원문에서도 여러 분석이 구조를 만족하면 후보를 유지합니다. 문맥의 의미를 추정해 하나를 선택하지 않습니다.
따라서 pro:나와 v:날다는 원문 나는 새를 본다의 나는과 각자의 분석으로 일치합니다. 반면 n:나는 대명사 NP를 일반명사 NNG로 바꾸지 않으므로 이 분석과 일치하지 않습니다.