<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD JATS (Z39.96) Journal Publishing DTD v1.3 20210610//EN" "JATS-journalpublishing1-3.dtd">
<article article-type="research-article" dtd-version="1.3" xmlns:mml="http://www.w3.org/1998/Math/MathML" xmlns:xlink="http://www.w3.org/1999/xlink" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xml:lang="ru"><front><journal-meta><journal-id journal-id-type="publisher-id">filnauki</journal-id><journal-title-group><journal-title xml:lang="ru">Филологические науки в МГИМО</journal-title><trans-title-group xml:lang="en"><trans-title>MGIMO Journal of Language Research and Teaching</trans-title></trans-title-group></journal-title-group><issn pub-type="ppub">2410-2423</issn><issn pub-type="epub">2782-3717</issn><publisher><publisher-name>МГИМО МИД России</publisher-name></publisher></journal-meta><article-meta><article-id pub-id-type="doi">10.24833/2410-2423-2020-4-24-14-24</article-id><article-id custom-type="elpub" pub-id-type="custom">filnauki-297</article-id><article-categories><subj-group subj-group-type="heading"><subject>Research Article</subject></subj-group><subj-group subj-group-type="section-heading" xml:lang="ru"><subject>Лингвистика и межкультурная коммуникация</subject></subj-group><subj-group subj-group-type="section-heading" xml:lang="en"><subject>LINGUISTICS AND INTERCULTURAL COMMUNICATION</subject></subj-group></article-categories><title-group><article-title>Частота совместной встречаемости иероглифов как показатель лексичности (при отборе лексики китайского военного дискурса)</article-title><trans-title-group xml:lang="en"><trans-title>Frequency of co-occurrence of chinese characters as an indicator of lexicality (when selecting the vocabulary of chinese military discourse)</trans-title></trans-title-group></title-group><contrib-group><contrib contrib-type="author" corresp="yes"><name-alternatives><name name-style="eastern" xml:lang="ru"><surname>Коршунов</surname><given-names>Д. С.</given-names></name><name name-style="western" xml:lang="en"><surname>Korshunov</surname><given-names>D. S.</given-names></name></name-alternatives><bio xml:lang="ru"><p>Коршунов Дмитрий Сергеевич – кандидат филологических наук, научно-педагогический работник ВУРЭ</p><p>162600, Вологодская область, г. Череповец, пр. Советский, 126</p></bio><bio xml:lang="en"><p>Dmitry S. Korshunov – PhD (philology), scientific and pedagogical employee</p><p>126, Sovetsky Prospect, Cherepovets, Vologda region, 162600</p></bio><email xlink:type="simple">dmitry-korshunov@yandex.ru</email><xref ref-type="aff" rid="aff-1"/></contrib></contrib-group><aff-alternatives id="aff-1"><aff xml:lang="ru"><institution>Военный университет радиоэлектроники</institution><country>Россия</country></aff><aff xml:lang="en"><institution>Military University of Radio Electronics</institution><country>Russian Federation</country></aff></aff-alternatives><pub-date pub-type="collection"><year>2020</year></pub-date><pub-date pub-type="epub"><day>27</day><month>12</month><year>2020</year></pub-date><volume>6</volume><issue>4</issue><fpage>14</fpage><lpage>24</lpage><permissions><copyright-statement>Copyright &amp;#x00A9; Коршунов Д.С., 2020</copyright-statement><copyright-year>2020</copyright-year><copyright-holder xml:lang="ru">Коршунов Д.С.</copyright-holder><copyright-holder xml:lang="en">Korshunov D.S.</copyright-holder><license xml:lang="ru" license-type="creative-commons-attribution" xlink:href="https://creativecommons.org/licenses/by/4.0/" xlink:type="simple"><license-p>Данная работа распространяется под лицензией Creative Commons Attribution 4.0.</license-p></license><license xml:lang="en" license-type="creative-commons-attribution" xlink:href="https://creativecommons.org/licenses/by/4.0/" xlink:type="simple"><license-p>This work is licensed under a Creative Commons Attribution 4.0 License.</license-p></license></permissions><self-uri xlink:href="https://philnauki.mgimo.ru/jour/article/view/297">https://philnauki.mgimo.ru/jour/article/view/297</self-uri><abstract><p>Преподавание иностранного языка в неязыковом вузе должно быть профессионально ориентированным, что ставит перед преподавателем задачу отбора лексики, репрезентативной для профессионального дискурса изучаемой специальности и актуальной для его текущего состояния. Современные корпусы текстов являются слишком общими по тематике и охватываемому периоду для такой узкой задачи. Поэтому материалом для отбора лексики должна выступать специально составленная коллекция текстов. В случае с китайским языком задача осложняется отсутствием сегментации таких текстов на слова. С учётом того, что большинство слов китайского языка записываются двумя иероглифами, предполагается, что одним из применимых в этой ситуации методов может быть сплошной частотный анализ текстовых последовательностей из двух иероглифов – иероглифических биграмм. В результате такого анализа среди частотных биграмм получено более 70 % репрезентативных для данного дискурса лексических единиц, в том числе 11 % несловарных. Оставшаяся доля биграмм приходится на синтаксические конструкции, в том числе структурно незавершённые, и фрагменты более длинных лексических единиц. Таким образом, высокая частота совместной встречаемости иероглифов может с достаточно большой вероятностью (p &gt; 0,7) рассматриваться как показатель лексичности при выявлении репрезентативной лексики в несегментированной тематической коллекции текстов на китайском языке.</p></abstract><trans-abstract xml:lang="en"><p>Teaching a foreign language in a non-linguistic college or university should be professionally oriented, which brings up the question of selecting the relevant vocabulary of a professional discourse under study. Modern text corpora are too general in subject matter and the time span. Therefore, a specially compiled collection of texts can serve the purpose of selecting the vocabulary. In the case of the Chinese language, the task is complicated by the lack of word segmentation in such texts. Taking into account the fact that most words in Chinese are written in two characters, it is assumed that one of the methods applicable in this situation is a comprehensive frequency analysis of text sequences of two characters – character bigrams. The analysis of frequent bigrams has showed that 70% of the most frequent lexical units are representative of the discourse, including 11% of out-of-vocabulary ones. The remaining part of bigrams pertain to syntactic constructions, including structurally incomplete ones, and fragments of longer lexical units. Thus, the high frequency of character co-occurrence can with a rather high probability (p &gt; 0.7) be considered as an indicator of lexicality in identifying representative vocabulary in an unsegmented the matic collection of texts in Chinese.</p></trans-abstract><kwd-group xml:lang="ru"><kwd>китайский военный дискурс</kwd><kwd>китайский язык</kwd><kwd>новостные сообщения военной тематики</kwd><kwd>отбор лексики</kwd><kwd>лексические единицы</kwd><kwd>несловарные слова</kwd><kwd>иероглифические биграммы</kwd><kwd>частота совместной встречаемости</kwd></kwd-group><kwd-group xml:lang="en"><kwd>Chinese military discourse</kwd><kwd>Chinese language</kwd><kwd>military news reports</kwd><kwd>vocabulary selection</kwd><kwd>lexical units</kwd><kwd>out-of-vocabulary words</kwd><kwd>character bigrams</kwd><kwd>frequency analysis</kwd><kwd>frequency of co-occurrence</kwd></kwd-group></article-meta></front><back><ref-list><title>References</title><ref id="cit1"><label>1</label><citation-alternatives><mixed-citation xml:lang="ru">Алексахин А.Н. Алфавит китайского языка путунхуа. Буква – фонема – звук речи – слог – слово. 4-е изд., испр. и доп. М.: Восточная книга, 2018. 212 с.</mixed-citation><mixed-citation xml:lang="en">Aleksakhin, A.N. Alfavit kitayskogo iazyka putunkhua. Bukva – fonema – zvuk rechi – slog – slovo [The Chinese language alphabet of Putonghua. Letter – phoneme – speech sound – syllable – word]. 4th ed., rev. and add. M.: Vostochnaia kniga, 2018. 212 p. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit2"><label>2</label><citation-alternatives><mixed-citation xml:lang="ru">Алексахин А.Н. Современная политика КНР в отношении иероглифической и буквенной письменности // Вестник МГИМО. 2011. № 3. С. 243–252.</mixed-citation><mixed-citation xml:lang="en">Aleksakhin, A.N. Sovremennaia politika KNR v otnoshenii ieroglificheskoi i bukvennoi pis’mennosti [Modern policy of the PRC in relation to hieroglyphic and alphabetic writing] // MGIMO Bulletin, 2011. No. 3. Pp. 243–252. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit3"><label>3</label><citation-alternatives><mixed-citation xml:lang="ru">Горина О.Г. Использование технологий корпусной лингвистики для развития лексических навыков студентов-регионоведов в профессионально-ориентированном общении на английском языке: дисс. … канд. пед. наук. М.: МГУ, 2014. 321 с.</mixed-citation><mixed-citation xml:lang="en">Gorina, O.G. Ispol’zovanie tekhnologii korpusnoi lingvistiki dlia razvitiia leksicheskikh navykov studentov-regionovedov v professional’no-orientirovannom obshchenii na angliiskom iazyke [The use of corpus linguistics technologies for the development of the lexical skills of regional students in professionally oriented communication in English]. PhD thesis. Moscow: Moscow State University, 2014. 332 p. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit4"><label>4</label><citation-alternatives><mixed-citation xml:lang="ru">Кленин И.Д. Лексикология китайского языка / И.Д. Кленин, В.Ф. Щичко. М.: Восточная книга, 2013. 272 с.</mixed-citation><mixed-citation xml:lang="en">Klenin, I.D. Leksikologiia kitaiskogo iazyka [Lexicology of the Chinese language] / I.D. Klenin, V.F. Shchichko. M.: Vostochnaia kniga, 2013. 272 p. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit5"><label>5</label><citation-alternatives><mixed-citation xml:lang="ru">Курдюмов В.А. Динамический подход к научному изучению китайского языка // III Готлибовские чтения: Востоковедение и регионоведение Азиатско-Тихоокеанского региона в фокусе современности : материалы Междунар. науч. конф. Иркутск, 10–16 сент. 2019 г. / ФГБОУ ВО «ИГУ»; [отв. ред. Е.Ф. Серебренникова]. Иркутск: Изд-во ИГУ, 2019. С. 285–291.</mixed-citation><mixed-citation xml:lang="en">Kurdyumov, V.A. Dinamicheskii podkhod k nauchnomu izucheniiu kitaiskogo iazyka [Dynamic approach to exploring Chinese]. III Gotlibovskie chteniia: Vostokovedenie i regionovedenie Aziatsko-Tikhookeanskogo regiona v fokuse sovremennosti: materialy Mezhdunar. nauch. konf. Irkutsk, 10–16 Sent. 2019. FGBOU VO «IGU»; [otv. red. Ie. F. Serebrennikova]. Irkutsk: Izd-vo IGU, 2019. Pp. 285–291. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit6"><label>6</label><citation-alternatives><mixed-citation xml:lang="ru">Муравьёв Н.А. Подходы к составлению лексических минимумов в России и за рубежом: проблемы и перспективы / Н.А. Муравьёв, М.Ю. Ольшевская // Вестник НГУ. Серия: Лингвистика и межкультурная коммуникация. 2019. Т. 17, № 1. С. 78–89.</mixed-citation><mixed-citation xml:lang="en">Murav’ëv, N.A. Podkhody k sostavleniiu leksicheskikh minimumov v Rossii i za rubezhom: problemy i perspektivy [Approaches to the composition of lexical minima in Russia and abroad: problems and prospects] / N.A. Murav’ev, M. Iu. Olshevskaia. Vestnik NSU. Series: Linguistics and Intercultural Communication, 2019, 17 (1). Pp. 78–89. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit7"><label>7</label><citation-alternatives><mixed-citation xml:lang="ru">Риехакайнен Е.И. Восприятие русской устной речи: контекст + частотность: монография. СПб.: С.-Петерб. гос. ун-т, 2016. 270 с.</mixed-citation><mixed-citation xml:lang="en">Riehakainen, E.I. Vospriiatie russkoi ustnoi rechi: kontekst + chastotnost’ [Perception of Russian spoken language: context + frequency]. Monograph. St. Petersburg: St. Petersburg. State Univ., 2016. 270 p. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit8"><label>8</label><citation-alternatives><mixed-citation xml:lang="ru">Солнцев В.М. Язык как системно-структурное образование. Изд. 2-е, доп. М.: Наука, 1977.</mixed-citation><mixed-citation xml:lang="en">Solntsev, V.M. Iazyk kak sistemno-strukturnoe obrazovanie [Language as a systemic-structural formation]. Ed. 2nd, add. M .: Nauka, 1977. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit9"><label>9</label><citation-alternatives><mixed-citation xml:lang="ru">Солнцев В.М. Теоретическая грамматика современного китайского языка (проблемы морфологии): курс лекций / В.М. Солнцев, Н.В. Солнцева. М.: Военный институт, 1978.</mixed-citation><mixed-citation xml:lang="en">Solntsev, V.M. Teoreticheskaia grammatika sovremennogo kitaiskogo iazyka (problemy morfologii) [Theoretical grammar of modern Chinese (problems of morphology)]. Course of lectures, Moscow: Military Institute, 1978. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit10"><label>10</label><citation-alternatives><mixed-citation xml:lang="ru">Шейгал Е.И. Семиотика политического дискурса: дисс. ... д-ра филол. наук. Волгоград, 2000. 431 с.</mixed-citation><mixed-citation xml:lang="en">Sheigal, E.I. Semiotika politicheskogo diskursa [Semiotics of Political Discourse]. Doctoral Thesis. Volgograd, 2000. 431 p. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit11"><label>11</label><citation-alternatives><mixed-citation xml:lang="ru">Шемет Г.И. Совершенствование обучения иностранному языку курсантов военных вузов на основе оптимизации лексической компоненты: дисс. … канд. пед. наук. М.: Военный университет, 2011. 249 с.</mixed-citation><mixed-citation xml:lang="en">Shemet, G.I. Sovershenstvovanie obucheniia inostrannomu iazyku kursantov voennykh vuzov na osnove optimizatsii leksicheskoi komponenty [Improving the teaching of a foreign language to cadets of military colleges based on the optimization of the lexical component]. PhD thesis. Moscow: Military University, 2011. 249 p. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit12"><label>12</label><citation-alternatives><mixed-citation xml:lang="ru">Юй Чуцяо. Автоматический синтаксический анализ китайских предложений при ограниченном словаре / Юй Чуцяо, И.А. Бессмертный // Программные продукты и системы. 2017. Т. 30. № 1. С. 138–142.</mixed-citation><mixed-citation xml:lang="en">Yu, Chuqiao. Avtomaticheskii sintaksicheskii analiz kitaiskikh predlozhenii pri ogranichennom slovare [Automatic syntactic analysis of Chinese sentences with a restricted dictionary] / Yu Chuqiao, I.A. Bessmertnyi // Programmnye produkty i sistemy. 2017. 30 (1). Pp. 138–142. (In Rus.)</mixed-citation></citation-alternatives></ref><ref id="cit13"><label>13</label><citation-alternatives><mixed-citation xml:lang="ru">Da Jun. 2004. Chinese text computing. [Electronic resource] – URL: http://lingua.mtsu.edu/chinese-computing (accessed: 23.03.2020)</mixed-citation><mixed-citation xml:lang="en">Da, Jun. 2004. Chinese text computing, https://lingua.mtsu.edu/chinese-computing (accessed: 23.03.2020)</mixed-citation></citation-alternatives></ref><ref id="cit14"><label>14</label><citation-alternatives><mixed-citation xml:lang="ru">Deng K. On the unsupervised analysis of domain-specific Chinese texts / K. Deng, P.K. Bol, K.J. Li et al. // Proceedings of the National Academy of Sciences of the United States of America, 2016. Vol. 113, No. 22. Pp. 6154–6159.</mixed-citation><mixed-citation xml:lang="en">Deng, K. On the unsupervised analysis of domain-specific Chinese texts / K. Deng, P.K. Bol, K.J. Li et al. // Proceedings of the National Academy of Sciences of the United States of America, 2016. Vol. 113, No. 22. Pp. 6154–6159.</mixed-citation></citation-alternatives></ref><ref id="cit15"><label>15</label><citation-alternatives><mixed-citation xml:lang="ru">Huang W. Toward Fast and Accurate Neural Chinese Word Segmentation with Multi-Criteria Learning / W. Huang, X. Cheng, K. Chen et al. [Electronic resource] Cornell University &gt; Computer Science &gt; Computation and Language. – URL: https://arxiv.org/abs/1903.04190 (accessed: 22.03.2020)</mixed-citation><mixed-citation xml:lang="en">Huang, W. Toward Fast and Accurate Neural Chinese Word Segmentation with Multi-Criteria Learning / W. Huang, X. Cheng, K. Chen et al. [Electronic resource] Cornell University &gt; Computer Science &gt; Computation and Language, https://arxiv.org/abs/1903.04190 (accessed: 22.03.2020)</mixed-citation></citation-alternatives></ref><ref id="cit16"><label>16</label><citation-alternatives><mixed-citation xml:lang="ru">Li Sh. Collocation Analysis Tools for Chinese Collocation Studies / Sh. Li, Sh. Guo // Journal of Technology and Chinese Language Teaching. Vol. 7, No. 1, 2016. Pp. 56–77.</mixed-citation><mixed-citation xml:lang="en">Li, Sh. Collocation Analysis Tools for Chinese Collocation Studies / Sh. Li, Sh. Guo // Journal of Technology and Chinese Language Teaching. Vol. 7, No. 1, 2016. Pp. 56–77.</mixed-citation></citation-alternatives></ref><ref id="cit17"><label>17</label><citation-alternatives><mixed-citation xml:lang="ru">Li J. A Comparison and Semi-Quantitative Analysis of Words and Character-Bigrams as Features in Chinese Text Categorization / J. Li, M. Sun, X. Zhang // Proceedings of the 21st International Conference on Computational Linguistics and 44th Annual Meeting of the Association for Computational Linguistics, Sydney, July 2006. Pp. 545–552.</mixed-citation><mixed-citation xml:lang="en">Li, J. A Comparison and Semi-Quantitative Analysis of Words and Character-Bigrams as Features in Chinese Text Categorization / J. Li, M. Sun, X. Zhang // Proceedings of the 21st International Conference on Computational Linguistics and 44th Annual Meeting of the Association for Computational Linguistics, Sydney, July 2006. Pp. 545–552.</mixed-citation></citation-alternatives></ref><ref id="cit18"><label>18</label><citation-alternatives><mixed-citation xml:lang="ru">Ma J. State-of-the-art Chinese Word Segmentation with Bi-LSTMs / J. Ma, K. Ganchev, D. Weiss // In Proceedings of the 2018 Conference on Empirical Methods in Natural Language Processing. Brussels, Belgium, October 31 – November 4, 2018. Pp. 4902–4908.</mixed-citation><mixed-citation xml:lang="en">Ma, J. State-of-the-art Chinese Word Segmentation with Bi-LSTMs / J. Ma, K. Ganchev, D. Weiss // In Proceedings of the 2018 Conference on Empirical Methods in Natural Language Processing. Brussels, Belgium, October 31 – November 4, 2018. Pp. 4902–4908.</mixed-citation></citation-alternatives></ref><ref id="cit19"><label>19</label><citation-alternatives><mixed-citation xml:lang="ru"></mixed-citation><mixed-citation xml:lang="en"></mixed-citation></citation-alternatives></ref><ref id="cit20"><label>20</label><citation-alternatives><mixed-citation xml:lang="ru"></mixed-citation><mixed-citation xml:lang="en"></mixed-citation></citation-alternatives></ref></ref-list><fn-group><fn fn-type="conflict"><p>The authors declare that there are no conflicts of interest present.</p></fn></fn-group></back></article>
