Ағылшыншамен салыстырыңыз: абзацты басыңыз — түпнұсқа терезеде ашылады. Абзац астындағы EN түймесі оны мәтін ішінде көрсетеді.
Мазмұны
Кіріспе
Компьютерлік мәтіндік іздеу сұранысы функциясы. Мәтінді өңдеуде жақындық іздеу – екі немесе одан көп бөлек сәйкес келетін сөздердің белгілі бір арақашықтықта орналасқан құжаттарды іздейді, мұнда арақашықтық – аралық сөздердің немесе таңбалардың саны. Жақындықтан өзге, кейбір жүзеге асырулар сөздердің тізбегіне де шектеу қоюы мүмкін, яғни ізделіп отырған мәтіндегі сөздердің реті іздеу сұранысының ретімен сәйкес болуы керек. Жақындықпен іздеу қарапайым сөздерді сәйкестендіруден асып, жақындық шартын қосады және көбінесе кеңейтілген іздеу түрі деп есептеледі. Мысалы, "қызыл кірпіш үй" іздеуі "қызыл кірпіштен жасалған үй" немесе "қызыл кірпіш үйі" сияқты тіркестерді таба алады. Жақындықты шектеу арқылы осы тіркестерге сәйкес келуге болады, сонымен қатар сөздер бір бетке шашырап кеткен немесе әртүрлі мақалаларда таралып кеткен құжаттарды іздеуден аулақ болуға болады.
Computer text search query functionIn text processing, a proximity search looks for documents where two or more separately matching term occurrences are within a specified distance, where distance is the number of intermediate words or characters. In addition to proximity, some implementations may also impose a constraint on the word order, in that the order in the searched text must be identical to the order of the search query. Proximity searching goes beyond the simple matching of words by adding the constraint of proximity and is generally regarded as a form of advanced search. For example, a search could be used to find "red brick house", and match phrases such as "red house of brick" or "house made of red brick". By limiting the proximity, these phrases can be matched while avoiding documents where the words are scattered or spread across a page or in unrelated articles in an anthology.
Негізгі себептері
Жақындық іздеудің негізгі тілдік қағидасы – құжаттағы сөздердің жақын орналасуы олардың арасындағы байланысты білдіреді. Құжат авторлары бір идеяны немесе көршілес сөйлемдердегі немесе абзастарға жинақталған байланысты идеялар жиынын қамтитын сөйлемдерді жасауға тырысатынын ескере отырып, құжат құрылымында бірге қолданылатын сөздердің өзара байланысты болу ықтималдығы жоғары. Керісінше, егер екі сөз кітаптың екі шетінде орналасса, онда олардың арасындағы байланыс ықтималдығы төмендеу болады. Іздеу нәтижелерін тек белгіленген ең жақын аралықта немесе қашықтықта орналасқан сәйкестіктерді ғана қамту арқылы, іздеу нәтижелері шашыраңқы орналасқан сәйкестіктерге қарағанда маңыздырақ деп есептеледі. Коммерциялық интернет іздеу жүйелері әдетте орташа іздеу сұранысына тым көп сәйкестіктерді (еске алу деп аталады) береді. Жақындық іздеу – сәйкес келетін беттердің санын азайту және сөздердің жақындығын рейтинг беруге көмектесу арқылы сәйкес келетін беттердің релеванттылығын арттырудың бір жолы. Қосымша пайдасы ретінде, жақындық іздеу спам-дексингке қарсы күресуге көмектеседі, себебі сөздіктердің тізімдері немесе мыңдаған сөздердің тізімі бар веб-беттерден аулақ болу қажет, әйтпесе іздеу жүйесі сөздердің жиілігіне басымдық берсе, олар жоғары орын алады.
The basic linguistic assumption of proximity searching is that the proximity of the words in a document implies a relationship between the words. Given that authors of documents try to formulate sentences which contain a single idea, or cluster of related ideas within neighboring sentences or organized into paragraphs, there is an inherent, relatively high, probability within the document structure that words used together are related. On the other hand, when two words are on the opposite ends of a book, the probability of a relationship between the words is relatively weak. By limiting search results to only include matches where the words are within the specified maximum proximity, or distance, the search results are assumed to be of higher relevance than the matches where the words are scattered. Commercial internet search engines tend to produce too many matches (known as recall) for the average search query. Proximity searching is one method of reducing the number of pages matches, and to improve the relevance of the matched pages by using word proximity to assist in ranking. As an added benefit, proximity searching helps combat spamdexing by avoiding webpages which contain dictionary lists or shotgun lists of thousands of words, which would otherwise rank highly if the search engine was heavily biased toward word frequency.
Буль синтаксисі мен операторлары
Жақындық іздеу тек кейбір кілт сөздердің белгілі бір арақашықтықта болуын талап ететінін көрсете алады. Жақындық іздеуді басқа іздеу синтаксисімен және/немесе басқару элементтерімен бірге қолдану арқылы іздеу сұранымын күрделендіруге болады. Көрсетілген кілт сөздер арасындағы жақындық іздеу шегін белгілеу үшін кейде NEAR, NOT NEAR, FOLLOWED BY, NOT FOLLOWED BY, SENTENCE немесе FAR сияқты операторлар қолданылады, мысалы: "brick NEAR house".
Note that a proximity search can designate that only some keywords must be within a specified distance. Proximity searching can be used with other search syntax and/or controls to allow more articulate search queries. Sometimes query operators like NEAR, NOT NEAR, FOLLOWED BY, NOT FOLLOWED BY, SENTENCE or FAR are used to indicate a proximity search limit between specified keywords: for example, "brick NEAR house".