Ағылшыншамен салыстырыңыз: абзацты басыңыз — түпнұсқа терезеде ашылады. Абзац астындағы EN түймесі оны мәтін ішінде көрсетеді.
Мазмұны
Кіріспе
Қытайлық америкалық инженер және компьютер ғалымы (1936–2020)
Chinese American engineer and computer scientist (1936–2020)
Томас Ши Тао Хуан (26 маусым 1936 – 25 сәуір 2020) – Қытайда туған американдық компьютер ғалымы, электр инженері және жазушы. Ол Иллинойс университетінің (UIUC) зерттеушісі және зейнеткер профессор болған. Хуан компьютерлік көру, үлгілерді тану және адам-компьютерлік өзара әрекеттесу салаларындағы жетекші тұлғалардың бірі еді.
Thomas Shi Tao Huang (, June 26, 1936 – April 25, 2020) was a Chinese born American computer scientist, electrical engineer, and writer. He was a researcher and professor emeritus at the University of Illinois at Urbana Champaign (UIUC). Huang was one of the leading figures in computer vision, pattern recognition and human computer interaction.
Ерте өмір және білім
Хуан 1936 жылдың 26 маусымында Қытай Республикасының Шанхай қаласында дүниеге келген. 1949 жылы оның отбасы Тайваньға көшіп келді. Хуан Тайвань ұлттық университетінде электроника мамандығы бойынша білім алып, 1956 жылы бакалавр дәрежесін алды. Хуан АҚШ-қа Массачусетс технология институтында (MIT) оқуға барды. MIT-де ол бастапқыда ақпарат теориясы және бейне кодтауға қызығушылық танытқан Питер Элиаспен, содан кейін Уильям Ф. Шрайбермен жұмыс істеді. Сол кезде сканерлік жабдықтар саудада болмағандықтан, суреттерді цифрландыру және көбейту үшін сканер жасау қажет болды. Компьютерлік бағдарламалар ассемблер тілінде Lincoln Lab TX 0 компьютерінің прототипі арқылы жазылды. Цифрлық суреттердің сипаттамалары тесілген қағаз лентасында сақталды және оның Sc. D. диссертациясы – «Суреттегі шу» (1963). Оның шеберлік жұмысы шеттерге сезімталдықпен интерполяция үшін адаптивті әдістерді қолдана отырып, сурет кодтау алгоритмдеріне бағытталған. Докторлық диссертациясы суреттегі шудың спектрдегі субъективті әсерлеріне арналған жұмысты қамтыды. Ол Координациялық ғылыми зертханамен (CSL) байланыста болды, Бекман ғылым және технология институтының Сурет қалыптастыру және өңдеу тобының басшысы және Бекман институтының Адам-компьютерлік зиялы қарым-қатынасы бойынша зерттеу бағытының тең төрағасы болды. 2012 жылы ол Сванлунд профессоры атағын алды, бұл UIUC-дегі ең жоғары дәреже. Хуан 2014 жылдың желтоқсанында оқытушылық қызметтен зейнеткерлікке шықты, бірақ зерттеуші ретінде белсенділігін жалғастырды. Хуан International Journal of Computer Vision, Graphics and Image Processing журналының және Springer Verlag компаниясының Springer Series in Information Sciences сериясының негізін қалаушы редакторы болды. Ол алғашқы Халықаралық сурет кодтау симпозиумын (1969), өте төмен біт-сипаты бейне кодтау жөніндегі алғашқы халықаралық семинарды (1993) және Автоматты бет және ишараларды тану жөніндегі алғашқы халықаралық конференцияны (1995) ұйымдастыруға көмектесті, олардың барлығы қайталанатын шараларға айналды. Ол сонымен қатар цифрлық голография бойынша жарияланымдар жасады. Пурдю университетінде жұмыс істеген кезде ол сызықтық емес сүзгілер, әсіресе медиандық сүзгілер бойынша жұмыс істеді, олар бейнелердегі шуды жоюдың стандартты әдісіне айналды. Оның алғашқы жұмыстарының кейбірі суреттерді сығумен айналысты, кейіннен жақсарту, қалпына келтіру және талдау салаларына қарай кеңейді. Ол екі өлшемді сканерленген ақпаратты пайдалана отырып, сканерлеудің бір сызығынан екіншісіне дейінгі өзгерістерді қарап, келесі сызықтың айырмашылығын анықтайтын екілік құжатты сығу әдістерін әзірледі. Статистикалық болжамдар мен модельдің эксперименттік нәтижелері жақсы сәйкес келді, бұл J. J. Y. Huang және Peter M. Schultheiss еңбектеріне негізделген. 1984 жылы Цай және Хуан жиілік доменіндегі көп кадрлы әдісті алғаш рет ұсынды, ол байқалған төмен ажыратымдылықтағы спутниктік суреттердің дискретті Фурье түрлендіруін алу кезеңінен жоғары ажыратымдылықтағы суреттің үздіксіз Фурье түрлендіруімен байланыстырды, кері Фурье түрлендіруін пайдаланып жоғары ажыратымдылықтағы соңғы суретті алды. Хуан сонымен қатар кодтаудың толқындық әдістері және фракталды кодтау бойынша жұмыс істеді. Толқындық кодтау бейнелер, бейнелер, аудио және мәтін бар мультимедиалық деректер қорынан мазмұнға негізделген суреттерді алу үшін ерекше маңызды. Бұл толық көлемді суреттерден гөрі кішірек кодталған суреттерде іздеуді жүзеге асыруға мүмкіндік береді және мультимедиалық ақпаратты (көрнекілік реті, аудио және қол жетімді болған жағдайда жабық мәтіндер) пайдалана отырып, бейне үшін мазмұндық кестелер мен семантикалық индекстер құруға мүмкіндік береді. 3D модельдеу саласында Хуан үш өлшемді қозғалысты анықтау және сәйкес белгілерді анықтай алатын бірнеше суреттер берілген қатты нысандардың құрылымы бойынша жұмыс істеді. Бұл жұмыс теледидарлық бейнелерді сығу, бейне стандарттарын әзірлеу және адам мен компьютер көруін зерттеу үшін маңызды болды. Хуан бейне және сөйлеуді өңдеуді негізінен ұқсас деп санайды. Олар адамның назарын аударуы мүмкін дыбыс элементтерін анықтау әдістерін әзірледі және оларды маңызды ақпаратты табу үшін адамдар аудио жазбалардың үлкен көлемін тиімдірек өтуге мүмкіндік береді. Хуан мультимодальды адам-компьютер өзара әрекеттесуі және интерфейс дизайнында маңызды жұмыс атқарды. Ол адамның эмоциялық күйін анықтау үшін аудио және бейне негізделген әдістерді біріктірген алғашқы зерттеушілердің бірі болды. Хуанның және басқалардың соңғы жұмыстары «көп түрлі режимнен ақпаратты оңтайлы жолмен алуға арналған алгоритмдер сериясын әзірлеуге» бағытталған.
Huang was born June 26, 1936, in Shanghai, Republic of China. In 1949, his family moved to Taiwan. Huang studied electronics at the National Taiwan University and received his bachelor's degree in 1956. Huang went on to the United States to study at the Massachusetts Institute of Technology (MIT). At MIT he worked initially with Peter Elias, who was interested in information theory and image coding, and then with William F. Schreiber. At that time scanning equipment was not commercially available, so it was necessary to build a scanner for digitizing and reproducing images. Computer programs were written in assembly language using a prototype Lincoln Lab TX 0 computer. Descriptions of digitized images were stored on paper tape with punched holes. and his Sc. D. thesis, Pictorial noise (1963). His master's work focused on algorithms for image coding using adaptive techniques for interpolation with sensitivity to edges. His doctorate included work on the subjective effects of pictorial noise across a spectrum. He was involved with the Coordinated Science Laboratory (CSL), and served as head of the Image Formation and Processing Group of the Beckman Institute for Advanced Science and Technology and co chair of the Beckman Institute's research track on Human Computer Intelligent Interaction. As of 2012, he was named a Swanlund Chair, the highest endowed title at UIUC. Huang retired from teaching as of December 2014, but continued to be active as a researcher. Huang was a founding editor of the International Journal of Computer Vision, Graphics and Image Processing, and of Springer Verlag's Springer Series in Information Sciences. He helped to organize the first International Picture Coding Symposium (1969), the first International Workshop on Very Low Bitrate Video Coding (1993), and the first International Conference on Automatic Face and Gesture Recognition (1995), all of which became repeated events. He also published on digital holography. While at Purdue, he worked on nonlinear filters, particularly median filters, which became a standard technique for the removal of noise in images. Some of his earliest work dealt with image compression, extending later into areas of enhancement, restoration and analysis. He developed approaches for binary document compression that utilized 2 dimensional scanned information, examining the changes from one line of a scan to the next, and detecting transition points at which a subsequent line differs. Statistical predictions and experimental results of the model's performance conformed well. building on the work of J. J. Y. Huang and Peter M. Schultheiss. In 1984, Tsai and Huang were the first to present a frequency domain multi frame method which related the discrete Fourier transform of observed low resolution satellite images from the acquisition stage to the continuous Fourier transform of the high resolution image, using the inverse Fourier transform to obtain a final image with increased resolution. Huang also worked on wavelet methods of encoding and on fractal coding. Wavelet coding is particularly important for content based image retrieval from multimedia databases containing images, video, audio, and text. It enables searches to be done on smaller encoded images rather than on full size retrieved images. and constructing tables of contents and semantic indexes for video using multimedia information (image sequence, audio, and closed captions if available). In the area of 3 D modelling, Huang worked on the identification of three dimensional motion and the structure of rigid objects given multiple images in which corresponding features can be identified. This work was important for the compression of television images, for the development of image standards, and for research into human and computer vision. Huang considered image and speech processing to be fundamentally similar, They also developed methods for detecting audio elements that are likely to attract human attention, and are using them to enable humans to more effectively go through large amounts of audio recordings to find important information. Huang did important work in multimodal human computer interaction and interface design. He was one of the first researchers to combine audio and video based techniques for identification of human affective states. More recent work by Huang and others attempts to "develop a series of algorithms to extract information from multi modality in an optimal way",
Хуан сонымен қатар адамдардың компьютермен немесе виртуалды ортамен сөйлеу және ишара арқылы тиімдірек әрекеттесуіне бағытталған жаңа тәсілдерді әзірлеуді үміттенеді. Бұл аудио сөйлеуді танудың дәлдігін арттыру үшін визуалды еріннің оқуын пайдалануды; және виртуалды ортада дисплейлерді басқаруда сөйлеуді тану және визуалды ишара талдауын интеграциялауды қамтиды. 2015 жылы Хуан Ann Willemsen Dunlap-пен бірлесіп, пациенттерге медициналық ақпаратты онлайн жеткізу үшін тиісті эмоцияларды көрсете алатын 3D компьютерлік аватарды әзірлеу жобасында жұмыс істеді. Ол сонымен қатар жақсырақ терең оқу техникаларын әзірлеу үшін жоғары өнімділіктегі есептеулерді және үлкен деректерді пайдалануды зерттеді.
Huang also hoped to develop more natural and effective ways for humans to interact with a computer or virtual environment using speech and gesture. the use of visual lip reading to enhance audio speech recognition accuracy; and integration of speech recognition and visual gesture analysis in the controlling of displays in virtual environments. In 2015, Huang worked with Ann Willemsen Dunlap in an interdisciplinary project to develop a 3 D computer generated avatar, capable of showing appropriate emotions, to be used in online communication of medical information to patients. He also explored the use of high performance computing and big data to develop better techniques for deep learning.
Атап көрсетілген сыйлықтар
Хуан 100-ден астам аспирантқа жетекшілік етті. 2012 жылы Томас және Маргарет Хуанның аспиранттар зерттеуін қолдау қоры, бұрынғы студенттері Джеймс Дж. Куч пен Чанг Вэнь Чэньнің шақыруымен, Хуан мен оның әйелінің ұстаздар мен оқытушылар ретіндегі, сондай-ақ ғалым ретіндегі еңбегін құрметтеу мақсатында құрылды. Бұл қор Бекман институтындағы Адам-компьютерлік интеллектуалды өзара әрекеттесу саласындағы студенттерге стипендиялар ұсынады.
Huang supervised more than 100 graduate students. In 2012, the Thomas and Margaret Huang Fund for Graduate Research was created in response to appeals by former students James J. Kuch and Chang Wen Chen, to celebrate the contributions of Huang and his wife as mentors and teachers as well as his contributions as a researcher. The fund will provide scholarships to support students in Human Computer Intelligent Interaction at the Beckman Institute.