박정구 교수
Park, Jung-Ku
서울대학교 중국어학(어법) · 공학
연구실 소개
박정구 교수의 연구실은 현대중국어의 문장 구조, 특히 문두에 다중논항이 배열되는 어순의 제약 원리에 중점을 두고 있다. 의미역 위계, 정보구조, 통사적·인지적 요인 간의 상호작용을 분석함으로써 언어의 문법성과 수용성의 기초를 규명하고자 한다. 특히 언어 모델링과 대량 말뭉치 기반의 통계적 분석, 그리고 트랜스포머 기반의 딥러닝 모델을 활용한 자연어처리 기법을 접목하여 언어 현상의 정량적 해석을 추구한다. 연구는 언어의 의미적·구조적 특성뿐 아니라 담화맥락과 정보 전달 방식의 상관관계를 고려한 종합적 접근을 특징으로 한다.
연구 현황
연구 성과 추이
표시된 성과는 수집된 데이터 기준으로 산출되며, 일부 차이가 있을 수 있습니다.
주요 논문
15본고는 다양한 장르의 현대중국어 말뭉치 자료에서 다중논항이 문두에 출현하는 5,000여 개의 예문을 추출하고 의미역 차이에 따른 논항의 어순 배열에 대한 통계 분석을 진행하였다. 본고의 분석을 통해 의미역에 따른 논항 간의 어순 관계를 다음과 같이 규명할 수 있었다. 첫째, 시간/처소는 모든 의미역에 선행하며 시간은 처소에 선행하는 경향이 있다. 이는 시간/처소가 문장의 나머지 부분의 정보에 대해 배경을 제공하는 테마로서의 기능을 하기 때문으로 판단된다. 둘째, 필수논항 간의 어순은 일정한 경향성이 존재함을 확인할 수 있었다. 일반적으로 동사의 앞에서 주어로 쓰이는 의미역이 동사의 뒤에서 목적어로 쓰이는 의미역들에 선행한다. 그 반대의 경우에는 대조의 의미를 수반하고 수용성의 제약이 크다. 셋째, 문두의 수의논항의 분포는 도구, 방법, 재료와 원인, 근거의 두 부류로 나누어 볼 수 있고, 기점은 처소기점과 시간기점으로 나누어 볼 수 있다. 도구, 방법, 재료, 처소기점은 필수논
This paper has made a research on Chinese aspect system and its grammaticalization with linguistic typological perspective. This study is focused on lots of variations of aspect markers of Chinese dialects which function as completive, resultative, perfect, or perfective aspect. We can draw two main grammaticalizing paths toward the perfective aspect marker: one origin of the perfective is the verbs ‘了’, ‘掉’, ‘撇’, ‘刮’, ‘脱’, etc. with the meaning 'finish' and the other is the verbs ‘在’, ‘着’, ‘到’,
본고는 다양한 장르의 현대중국어 말뭉치 자료에서 문두에 다중논항이 출현하는 대량의 예문을 수작업뿐만 아니라 코딩을 통한 프로그램을 통해서 추출하였다. 추출한 예문에 대해서 논항의 순서를 바꾼 후 원어민의 검증을 거쳐 어순 수용성 데이터를 구축하였다. 이렇게 구축한 대량의 데이터에 대해서 문두 다중논항의 의미역 배열 조합의 수량과 비율을 통계적으로 분석하였다. 지금까지의 분석을 토대로 문두 다중논항 배열 제약을 귀납하고 의미역 위계를 설정할 수 있게 되었다. 문두에 출현하는 필수논항은 목적어로 쓰이는 논항이 주어로 쓰이는 논항에 우선한다. 수의논항 중에서는 시간, 처소, 원인 논항이 다른 논항에 선행한다. 기점과 종점 논항은 시간을 나타내는 경우 다른 논항에 선행하는 경향을 보이는 공통점이 있다. 그러나 처소를 나타내는 경우에는 다른 특성을 보인다. 처소기점은 필수논항을 후행하고 처소종점은 필수논항에 선행한다. 도구, 방식, 재료는 가장 술어에 근접하며, 수혜자, 접수자는 필수논항에
정보가 문장에서 어떻게 전달되는지는 의사소통에서 아주 중요한 부분이다. 언어에 따라 정보가 문장에 반영되는 방식은 차이가 있는데 중국어의 정보 포장은 직접적으로 문장 어순으로 실현된다. 본 연구의 대상인 ‘我就是’와 ‘就是我’ 구문은 모두 한국어로 ‘저입니다’라고 해석이 되지만 맥락에 따라서 선택적 제약이 존재한다. 본 연구의 목적은 두 문형의 선택적 제약이 정보구조 차이로 인한 것임을 담화맥락, 초점구조, 악센트 분포 분석을 통해 밝히는데 있다. 분석을 통해 귀납된 결론은 다음과 같다. 첫째, ‘我就是’ 혹은 ‘就是我’ 로 답변하는 경우 기본적으로 질문의 정보구조를 유지하려는 경향성이 존재한다. 둘째, ‘X是Y’ 구조에서 X는 무표적으로 지시물(개체)의 외연을 나타낸다. Y는 무표적으로 내포 의미를 나타내지만, 유표적으로 일치관계의 외연 의미를 나타낼 수도 있다. 셋째, ‘X是Y’ 구조에서 X는 무표적으로 화제가 되고 Y는 자연초점이 된다. 그러나 열린 명제의 강한 배타적 초점이
본고에서는 중국어 문두 다중논항의 어순 배열 문제를 해결하기 위해 트랜스포머 기반의 신경망 언어 모델을 적용하고 그 효율성을 검증하는 연구를 수행하였다. 본 연구에서는 문두에 나타나는 다양한 성분들과 이들 사이의 상호 작용, 그리고 어순 배열에 대한 제약이 어떻게 문법성을 형성하는지에 초점을 맞췄다. 이를 통해 중국어 문두 다중논항의 어순 배열과 관련된 문법성을 판단하는데 자연어처리 방법론이 얼마나 효과적인지 검증하고자 하였다. 본 연구에서 구축된 ‘문두 다중논항 데이터셋’은 15,298개의 중국어 문장으로 이루어져 있으며, 이 데이터셋은 문법적으로 올바른 문장과 비문법적인 문장을 이진 분류 방식으로 레이블링 하여 사용되었다. 연구팀은 이 데이터셋을 활용하여 문두 다중논항의 어순 수용성을 예측하는 모델을 개발하고, 그 정확도를 평가하였다. 연구 결과, 모델은 90%의 높은 정확도로 어순 수용성을 예측할 수 있음을 보여주었다. 또한, 본 연구는 원어민의 판단과 모델의 예측이 일치하지
본고는 화용적인 측면에서 ‘这+N(명사)’ 형식이 ‘这+Q(양사)+N’ 형식과 달리 어떠한 기능적 차이점이 있는지를 밝히고자 하였다. 분석 결과, 지시성과 정보구조에 있어서 두 형식의 특성을 귀납할 수 있었다.지시성의 측면에 있어서, ‘这+N’은 집합적 유형(Type)을 지시할 수 있다는 점이 ‘这+Q+N’과 다르다. ‘这+N’ 형식은 개체명사보다 물질명사나 추상명사와 더 잘 쓰이는 경향이 있다. 물질명사나 추상명사는 상대적으로 비이산적이기 때문에 ‘这+N’ 형식과 더 잘 호응한다. 현대중국어에서 명사에 양사가 부가되면 개체성이 훨씬 부각되고 토큰(token)적 지시를 하게 되는데 이는 유형적 지시와는 구분된다. 유형적 지시성의 필요성을 만족시키기 위해서 양사를 제거한 형식을 사용하려는 것이 ‘这+N’ 형식을 사용하게 된 동기라고 판단한다.정보구조적 측면에 있어서 ‘这+Q+N’은 문장의 초점이나 대조 성분이 될 수 있지만 ‘这+N’은 그렇지 않다. 초점이나 대조는 문장에서 정보적으로
In this paper, we have investigated the variations of resultative and progressive aspect makers in 153 Chinese dialects corresponding to ‘zhe(着)’ and ‘zai(在)’ following the verbs in Mandarin. This study shows that there are various asymmetrical phenomena of ‘zhe(着)’ and ‘zai(在)’ in terms of their distributions, functions or usage overlapping, and that there are many different types of aspectual systems in different dialects: the same form can function as a resultative aspect or a progressive asp
문두에 두 개 이상의 논항을 갖는 구문에서 논항 간의 어순은 일정한 의미역 위계가 존재한다. 이러한 의미역 위계는 경향성의 문제이며 비이산적인 특성으로서 때로는 의미역 위계를 위배하는 어순이 존재할 수도 있다. 본고는 문두 다중논항 구문의 수용성을 제고하기 위해서 논항 간의 어순 배열과 유관한 의미역 위계 외에 정보구조적 역할을 밝히고자 하였다. 본고에서는 비선호되는 논항 배열을 갖는 문장에 대해 문두 논항이나 술어의 구조에 변화를 가함으로써 해당 문장들의 수용성을 제고할 수 있었다. 수용성 제고 책략은 크게 두 유형으로 나누어 볼 수 있다. 첫째는 화제 표지 부가, 논항의 길이 조정, 평언 성분의 확장 등을 통해 화제-평언 간의 정보구조적 관계를 명확히 하는 것이다. 둘째는 술어에 조동사, 부사, 부정사, 보어, 상 표지 등의 성분을 부가하여 문장의 초점을 부각함으로서 정보구조적 안정성을 확보하는 것이다. 본 연구를 통해서 중국어 문두 다중논항 구문의 수용성 여부에는 정보구조적 요
대표 연구 분야
박정구 교수의 연구를 Nubint에서 더 깊이 살펴보세요
이 연구실의 논문을 앱에서 열어 AI와 함께 읽고, 핵심을 요약하고, 내 글에 인용하세요.