Кіріспе
1954 жылы машиналық аударманың көрсетілімі
Джорджтаун–IBM эксперименті 1954 жылдың 7 қаңтарында өткізілген, машиналық аударманың маңызды көрсетілімі болды. Джорджтаун университеті мен IBM бірлесіп жасаған экспериментте 60-тан астам орыс тіліндегі сөйлемдер толық автоматты түрде ағылшын тіліне аударылды.
The Georgetown–IBM experiment was an influential demonstration of machine translation, which was performed on January 7, 1954. Developed jointly by the Georgetown University and IBM, the experiment involved completely automatic translation of more than sixty Russian sentences into English.
Өмірбаян
Машиналық аударманың мүмкіндіктерін көрсету арқылы үкіметтік және қоғамдық назар аудару мен қаржыландыруды тарту мақсатында жасалған және іске асырылған бұл жүйе, толыққанды жүйе емес еді: оның грамматикалық ережелерінің саны алты ғана болды, ал сөздік қоры (көктері мен жұрнақтары) 250 лексикалық бірліктен тұрды. Сөздіктегі сөздер саясат, құқық, математика, химия, металлургия, коммуникация және әскери істер салаларын қамтыды. Сөздік мәліметтері перфокарталарға тегілді. Бұл толық сөздік толығымен көрсетілген жоқ (тек Гарвиннің мақаласындағы кеңейтілген нұсқасы ғана көрсетілді). Жалпы тақырыптардан өзге, жүйе органикалық химия саласында маманданған. Аударма IBM 701 машинасы арқылы жүзеге асырылды. Жером Вайснер бұл идеяны қолдады және MIT Электроника зертханасынан қаржы ұсынды. Леон Достерт бұрынғы аудармаларды автоматты түрде түзету тәжірибесіне ие болғандықтан (сол кезде "механикалық аударма" деп аталған) жобаға шақырылды; оның интерпретациялық жүйесі Нюрнберг соғыс қылмыстары трибуналына зор әсер етті. Демонстрацияның тіл білімі бөлігін көбінесе тілші Пол Гарвин жүзеге асырды, ол орыс тілін де жақсы білді. Орыс тілін білмейтін компьютер операторы машинаға саяси, құқықтық, математикалық және ғылыми тақырыптарға қатысты 60-тан астам ресми түрде жазылған орыс тіліндегі мәтіндерді енгізді, ал нәтижедегі ағылшын тіліне аудармалар принтерде пайда болды. Аудармаға алынған сөйлемдер мұқият таңдалды. Демонстрация үшін көптеген операциялар нақты сөздер мен сөйлемдерге бейімделді. Сонымен қатар, сөйлем құрылымын танитын реляциялық немесе сөйлемдік талдау болған жоқ. Бұл тәсіл негізінен "лексикографиялық" сипатта болды, яғни сөздікке негізделген, онда әрбір сөз белгілі бір ережелер мен қадамдармен байланыстырылған.
Алгоритм
Алгоритм алдымен орыс сөздерін сандық кодтарға аударады, содан кейін әрбір сандық код бойынша мынадай жағдай талдауын жүргізеді: мүмкін болатын ағылшын сөздерінің аудармаларын таңдау, ағылшын сөздерінің ретін өзгерту немесе кейбір ағылшын сөздерін жою. Алгоритмнің блок-схемасы қайтадан келтірілген. 6 ереже 1-кестеде берілген.