Ағылшыншамен салыстырыңыз: абзацты басыңыз — түпнұсқа терезеде ашылады. Абзац астындағы EN түймесі оны мәтін ішінде көрсетеді.
Мазмұны
Кіріспе
Ашық кодты ережеге негізделген машиналық аударма платформасы
Open source rule based machine translation platform
Apertium – тегін және ашық кодты ережеге негізделген машиналық аударма платформасы. Бұл бағдарламалық қамтамасы еркін таратылады және GNU General Public License шарты бойынша жарық көреді.
Apertium is a free/open source rule based machine translation platform. It is free software and released under the terms of the GNU General Public License.
Шолу
Apertium – бұл барлық лексикалық түрлендірулер үшін шекті күйдегі түрлендіргіштерді, сондай-ақ сөйлеу бөлігін тану / сөз категориясын ажырату үшін шектеу грамматикалық теггерлерді және жасырын Марков модельдерін немесе перцептрон түрлерін қолданатын трансферге негізделген машиналық аударма жүйесі. Сөздердің орнын ауыстыру және сөздердің үйлесуі үшін құрылымдық көшіру компоненті жауапты; қазірге дейін Apertium тілдерінің көпшілігі «бөліктерге бөлу» немесе беткейлік көшіру ережелерін қолданған, бірақ жаңа тіл жұптары контекстсіз грамматикада анықталған (мүмкін рекурсивті) ережелерді пайдаланады. Қазіргі уақытта қол жетімді көптеген машиналық аударма жүйелері коммерциялық немесе авторлық құқықтары бар технологияларды қолданады, бұл оларды жаңа қолдануларға бейімдеуді өте қиын жасайды. Apertium коды мен деректері ашық лицензиямен таратылады және Apertium-ға үлес қосуды жеңілдету, тиімді дамуды қамтамасыз ету және жобаның жалпы өсуін күшейту үшін тілден тәуелсіз сипаттаманы қолданады. 2020 жылдың желтоқсанына қарай Apertium 51 тұрақты тіл жұбын шығарды, олар жылдам аудармаларды жеткілікті деңгейде түсінікті нәтижелермен ұсынады (қателерді оңай түзетуге болады). Apertium ашық кодты жоба болғандықтан, әлеуетті әзірлеушілерге өздерінің тіл жұбын құру және жобаға үлес қосу үшін қажетті құралдарды ұсынады.
Apertium is a transfer based machine translation system, which uses finite state transducers for all of its lexical transformations, and Constraint Grammar taggers as well as hidden Markov models or Perceptrons for part of speech tagging / word category disambiguation. A structural transfer component is responsible for word movement and agreement; most Apertium language pairs up until now have used "chunking" or shallow transfer rules, though newer pairs use (possibly recursive) rules defined in a Context free grammar. Many existing machine translation systems available at present are commercial or use proprietary technologies, which makes them very hard to adapt to new usages. Apertium code and data is free software and uses a language independent specification, to allow for the ease of contributing to Apertium, more efficient development, and enhancing the project's overall growth. At present (December 2020), Apertium has released 51 stable language pairs, delivering fast translation with reasonably intelligible results (errors are easily corrected). Being an open source project, Apertium provides tools for potential developers to build their own language pair and contribute to the project.
Тарих
Apertium OpenTrad жобасының машиналық аударма қозғалтқыштарының бірі ретінде пайда болды, оны Испания үкіметі қаржыландырып, Алакант университетінің Transducens зерттеу тобы әзірледі. Ол бастапқыда жақын туысқан тілдер арасында аудару үшін жасалған, бірақ соңғы кезде әртүрлі тіл жұптарымен жұмыс істеу үшін кеңейтілді. Жаңа машиналық аударма жүйесін құру үшін, жақсы анықталған XML форматтарында тілдік деректерді (сөздіктер, ережелер) жасау ғана қажет. Ол үшін жасалған тілдік деректер (Universidad de Vigo, Universitat Politècnica de Catalunya және Universitat Pompeu Fabra-мен бірлесіп) қазіргі уақытта араб, арагон, астурия, баск, белорус, бретон, болгар, каталан, қырым татар, дания, ағылшын, эсперанто, француз, галиси, хинди, исланд, индонезия, итальян, қазақ, македон, малайзия, мальтия, солтүстік саами, норвегия (бокмол және нюнорск), окситан, поляк, португал, румын, орыс, сардиния, серб-хорват, силезия, словен, испан, швед, татар, украин, урду және валлий тілдерін қолдайды. Толық тізім төменде берілген. Apertium-ның дамуына бірнеше компания қатысады, оның ішінде Prompsit Language Engineering, Imaxin Software және Eleka Ingeniaritza Linguistikoa. Жоба Google Summer of Code 2009, 2010, 2011, 2012, 2013 және 2014 жылғы басылымдарына, сондай-ақ Google Code In 2010, 2011, 2012, 2013, 2014, 2015, 2016 және 2017 жылғы басылымдарына қатысты.
Apertium originated as one of the machine translation engines in the project OpenTrad, which was funded by the Spanish government, and developed by the Transducens research group at the Universitat d'Alacant. It was originally designed to translate between closely related languages, although it has recently been expanded to treat more divergent language pairs. To create a new machine translation system, one just has to develop linguistic data (dictionaries, rules) in well specified XML formats. Language data developed for it (in collaboration with the Universidade de Vigo, the Universitat Politècnica de Catalunya and the Universitat Pompeu Fabra) currently support (in stable version) the Arabic, Aragonese, Asturian, Basque, Belarusian, Breton, Bulgarian, Catalan, Crimean Tatar, Danish, English, Esperanto, French, Galician, Hindi, Icelandic, Indonesian, Italian, Kazakh, Macedonian, Malaysian, Maltese, Northern Sami, Norwegian (Bokmål and Nynorsk), Occitan, Polish, Portuguese, Romanian, Russian, Sardinian, Serbo Croatian, Silesian, Slovene, Spanish, Swedish, Tatar, Ukrainian, Urdu, and Welsh languages. A full list is available below. Several companies are also involved in the development of Apertium, including Prompsit Language Engineering, Imaxin Software and Eleka Ingeniaritza Linguistikoa. The project has taken part in the 2009, 2010, 2011, 2012, 2013 and 2014 editions of Google Summer of Code and the 2010, 2011, 2012, 2013, 2014, 2015, 2016 and 2017 editions of Google Code In.