Языковая политика и языковые ресурсы в китайском интернете

Rok vydání: 2020
Předmět:
иероглиф года
Standard Mandarin
диалекты Миньнань
языковые ресурсы
language corpora
кантонский диалект
машинный перевод
китайский язык
machine translation
интернет
слово года
speech synthesis
lexical frequency studies
языковой корпус
синтез речи
Cantonese
Chinese dialects
иероглифическая письменность
распознавание речи
китайские диалекты
искусственный интеллект
Internet
Minnan dialects
character of the year
word of the year
speech recognition
путунхуа
статистические исследования
artificial intelligence
Chinese characters
language policy
language resources
байхуа
лексика
вэньянь
language planning
языковая политика
part-of-speech tagging
DOI: 10.24411/2686-7702-2020-10002
Popis: Языковая политика, которой китайское государство уделяет значительное внимание на протяжении последних десятилетий, освещается на многочисленных официальных сайтах центрального и регионального уровня. Среди задач, поставленных перед лингвистами, – ежегодный статистический анализ слов и иероглифов, которые употребляются в современном китайском языке, прежде всего, в интернете. Технологии, позволяющие автоматически выделять в иероглифических цепочках слова и определять их принадлежность к той или иной части речи в изолирующем китайском языке, лежат также в основе текстовых корпусов, многие из которых доступны в сети. Исследования, связанные с распознаванием и синтезом устной речи, востребованы при разработках в области машинного устного перевода, в процессе изучения путунхуа на специальных сайтах и при создании устных языковых корпусов, в том числе онлайновых диалектных на Тайване и в Гонконге.
The language policy and planning in the PRC are represented on various official central and local websites. The annual statistical analysis of Chinese words and characters used online are among the tasks, set by the authorities before the linguists. The technologies, allowing to recognize words within the character texts and to mark them as belonging to a particular part of speech in the isolating syllabic Chinese language are applied within the process of creating numerous text corpora, often accessible on the Web. Speech recognition and speech synthesis technologies based on AI are used in machine translation, on the official websites for Standard Mandarin learners, as well as in spoken corpora. Among the latter are dialect corpora created in Taiwan and Hong Kong and available online.
Databáze: OpenAIRE