Сравнивайте с английским: нажмите на абзац — оригинал откроется в окне. Кнопка EN под абзацем показывает его прямо в тексте.
Введение
Система обмена данными детской речи (CHILDES) – это корпус, созданный в 1984 году. Самые ранние транскрипты датируются 1960-ми годами, а по состоянию на 2015 год он содержит материалы (транскрипты, аудио- и видеозаписи) на 26 языках из 230 различных корпусов, все из которых находятся в свободном доступе по всему миру. В последнее время CHILDES стал частью более крупного корпуса TalkBank, который также включает языковые данные людей с афазией, изучающих второй язык, анализ разговорной речи и обучение языкам в классе. CHILDES используется главным образом для анализа речи маленьких детей и обращенной к детям речи взрослых. В начале 1990-х годов, с появлением вычислительных ресурсов, способных легко обрабатывать объемы данных, содержащиеся в CHILDES, значительно возросло число исследований по овладению детской речью, использующих этот корпус. Транскрипции кодируются в формате CHAT (Codes for the Human Analysis of Transcripts) – стандартизированном формате для создания транскриптов бесед. Эту систему можно использовать для транскрипции бесед с любыми изучающими язык: детьми, изучающими второй язык, и людьми, восстанавливающимися после афазии. Помимо транскрипции на уровне дискурса, система CHAT также предоставляет возможности для фонологического и морфологического анализа. Программа CLAN, разработанная Леонидом Спектором, помогает в транскрипции и анализе данных детской речи.
The Child Language Data Exchange System (CHILDES) is a corpus established in 1984 Its earliest transcripts date from the 1960s, and as of 2015 has contents (transcripts, audio, and video) in 26 languages from 230 different corpora, all of which are publicly available worldwide. Recently, CHILDES has been made into a component of the larger corpus TalkBank, which also includes language data from aphasics, second language acquisition, conversation analysis, and classroom language learning. CHILDES is mainly used for analyzing the language of young children and directed to the child speech of adults. During the early 1990s, as computational resources capable of easily manipulating the data volumes found in CHILDES became commonly available, there was a significant increase in the number of studies of child language acquisition that made use of it. The transcriptions are coded in the CHAT (Codes for the Human Analysis of Transcripts) transcription format, which provides a standardized format for producing conversational transcripts. This system can be used to transcribe conversations with any type of language learner: children, second language learners, and recovering aphasics. In addition to discourse level transcription, the CHAT system also has options for phonological and morphological analysis. The CLAN program was developed by Leonid Spektor and aids in transcription and analysis of the child language data.
Использование в исследованиях
На сегодняшний день более 4500 опубликованных исследований цитируют CHILDES. Эта цифра указана в руководствах CHILDES, а по данным Google Scholar на июль 2017 года насчитывалось 5451 цитирование.
To date, over 4500 published studies cite CHILDES. CHILDES reports this number in their manuals and Google Scholar contains 5451 citations as of July 2017.