Ағылшыншамен салыстырыңыз: абзацты басыңыз — түпнұсқа терезеде ашылады. Абзац астындағы EN түймесі оны мәтін ішінде көрсетеді.
Мазмұны
Кіріспе
АҚШ Ұлттық медицина кітапханасының дерекқорлар бөлімшесі
Database branch of the US National Library of Medicine
Ұлттық биотехнологиялық ақпарат орталығы (NCBI) – АҚШ Ұлттық медицина кітапханасының (NLM) бір бөлігі және Ұлттық денсаулық сақтау институтының (NIH) құрамындағы бөлімше. Ол АҚШ үкіметімен бекітіліп, қаржыландырылады. NCBI Мэриленд штатының Бетезда қаласында орналасқан және 1988 жылы АҚШ конгрессмені Клод Пеппер демеушілік еткен заңнама арқылы құрылған. NCBI биотехнология және биомедицина салаларына қатысты бірнеше дерекқорларды қамтиды және биоинформатикалық құралдар мен қызметтер үшін маңызды ресурс болып табылады. Басты дерекқорлардың қатарында ДНК тізбектері үшін GenBank және биомедициналық әдебиеттерге арналған библиографиялық дерекқор PubMed бар. Сондай-ақ, NCBI Epigenomics дерекқоры да бар. Барлық дерекқорлар Entrez іздеу жүйесі арқылы онлайн режимінде қолжетімді. NCBI-ге биоинформатика саласындағы беделді ғалым Дэвид Липман жетекшілік етті.
The National Center for Biotechnology Information (NCBI) is part of the United States National Library of Medicine (NLM), a branch of the National Institutes of Health (NIH). It is approved and funded by the government of the United States. The NCBI is located in Bethesda, Maryland, and was founded in 1988 through legislation sponsored by US Congressman Claude Pepper. The NCBI houses a series of databases relevant to biotechnology and biomedicine and is an important resource for bioinformatics tools and services. Major databases include GenBank for DNA sequences and PubMed, a bibliographic database for biomedical literature. Other databases include the NCBI Epigenomics database. All these databases are available online through the Entrez search engine. NCBI was directed by David Lipman, and a widely respected figure in bioinformatics.
GenBank
NCBI 1992 жылдан бері GenBank ДНК тізбегінің дерекқорын қолжетімді етуге жауапты. GenBank жеке зертханалармен және Еуропалық молекулалық биология зертханасының (EMBL) және Жапонияның ДНК дерекқоры (DDBJ) сияқты басқа тізбек дерекқорымен үйлестіреді. NCBI интернет браузерлері немесе FTP арқылы қолжетімді бағдарламалық құралдарға ие. Мысалы, BLAST – бұл тізбектердің ұқсастығын іздеу бағдарламасы. BLAST GenBank ДНК дерекқорымен 15 секундтан кем уақытта тізбектерді салыстыра алады.
NCBI had responsibility for making available the GenBank DNA sequence database since 1992. GenBank coordinates with individual laboratories and other sequence databases, such as those of the European Molecular Biology Laboratory (EMBL) and the DNA Data Bank of Japan (DDBJ). The NCBI has software tools that are available through internet browsers or by FTP. For example, BLAST is a sequence similarity searching program. BLAST can do sequence comparisons against the GenBank DNA database in less than 15 seconds.
NCBI кітап сөресі
NCBI кітап сөресі – таңдалған биомедициналық кітаптардың тегін қолжетімді, жүктеуге болатын онлайн нұсқаларының жиынтығы. Кітап сөресі молекулалық биология, биохимия, жасуша биологиясы, генетика, микробиология, молекулалық және жасушалық деңгейдегі аурулар, зерттеу әдістері және вирусология сияқты кең ауқымды тақырыптарды қамтиды. Кітаптардың кейбіреуі бұрын жарияланған кітаптардың онлайн нұсқалары болса, ал басқалары, мысалы, Coffee Break, NCBI қызметкерлерімен жазылып, өңделген. Кітап сөресі Entrez PubMed репозиторийіне толықтыру ретінде қызмет етеді, өйткені кітап сөресінің мазмұны зерттеулердің дамитын салаларына қатысты қалыптасқан көзқарастарды ұсынады және көптеген жеке зерттеулерді ұйымдастыруға мүмкіндік беретін контекстті қамтамасыз етеді.
The NCBI Bookshelf is a collection of freely accessible, downloadable, online versions of selected biomedical books. The Bookshelf covers a wide range of topics including molecular biology, biochemistry, cell biology, genetics, microbiology, disease states from a molecular and cellular point of view, research methods, and virology. Some of the books are online versions of previously published books, while others, such as Coffee Break, are written and edited by NCBI staff. The Bookshelf is a complement to the Entrez PubMed repository of peer reviewed publication abstracts in that Bookshelf contents provide established perspectives on evolving areas of study and a context in which many disparate individual pieces of reported research can be organized.
Жергілікті сәйкестікті іздеудің негізгі құралы (BLAST)
BLAST – ДНК нуклеотидтік тізбектері мен ақуыздың аминқышқылдық тізбектері сияқты биологиялық тізбектердің арасындағы тізбектік ұқсастықты есептеуге қолданылатын алгоритм. BLAST – бір организмде немесе әртүрлі организмдерде сұраныс тізбегіне ұқсас тізбектерді табуға мүмкіндік беретін қуатты құрал. Ол NCBI дерекқоры мен серверлерінде сұраныс тізбегін іздеп, нәтижелерді таңдалған форматта пайдаланушының браузеріне жібереді. BLAST-қа енгізілетін тізбектер көбінесе FASTA немесе GenBank форматында болады, ал нәтижелер HTML, XML пішімінде және қарапайым мәтін сияқты әртүрлі форматтарда ұсынылуы мүмкін. HTML – NCBI веб-бетінің әдепкі нәтиже форматы. NCBI BLAST нәтижелері барлық табылған сәйкестіктермен, ұпаймен байланысты деректері бар сәйкестіктердің тізбек идентификаторларымен кесте түрінде, сондай-ақ қызығушылық тудыратын тізбек пен осыған ұқсас BLAST ұпайлары бар сәйкестіктермен бірге графикалық форматта көрсетіледі.
BLAST is an algorithm used for calculating sequence similarity between biological sequences, such as nucleotide sequences of DNA and amino acid sequences of proteins. BLAST is a powerful tool for finding sequences similar to the query sequence within the same organism or in different organisms. It searches the query sequence on NCBI databases and servers and posts the results back to the person's browser in the chosen format. Input sequences to the BLAST are mostly in FASTA or GenBank format while output could be delivered in a variety of formats such as HTML, XML formatting, and plain text. HTML is the default output format for NCBI's web page. Results for NCBI BLAST are presented in graphical format with all the hits found, a table with sequence identifiers for the hits having scoring related data, along with the alignments for the sequence of interest and the hits received with analogous BLAST scores for these.
Ентерз
Entrez Global Query Cross Database Search System NCBI-де нуклеотидтік және ақуыздық тізбектер, ақуыз құрылымдары, PubMed, таксономия, толық геномдар, OMIM және басқа да маңызды деректер қоры үшін қолданылады. Entrez – биомедициналық зерттеулер үшін әртүрлі көздерден алынған деректерді индекстеу және іздеу жүйесі болып табылады. NCBI 1991 жылы Entrez-дің алғашқы нұсқасын шығарды, ол PDB және GenBank-тен нуклеотидтік тізбектер, SWISS PROT-тен ақуыздық тізбектер, сондай-ақ GenBank, PIR, PRF, PDB-ден аударылған тізбектер мен PubMed-тен алынған мақалалар мен сілтемелерден тұрды. Entrez әртүрлі көздерден, деректер қорынан және форматтардан алынған деректерді бірыңғай ақпараттық модельге және тиімді іздеу жүйесіне біріктіру үшін арнайы жасалған, ол қажетті мақалаларды, тізбектерді және құрылымдарды жылдам табуға мүмкіндік береді.
The Entrez Global Query Cross Database Search System is used at NCBI for all the major databases such as Nucleotide and Protein Sequences, Protein Structures, PubMed, Taxonomy, Complete Genomes, OMIM, and several others. Entrez is both an indexing and retrieval system having data from various sources for biomedical research. NCBI distributed the first version of Entrez in 1991, composed of nucleotide sequences from PDB and GenBank, protein sequences from SWISS PROT, translated GenBank, PIR, PRF, PDB, and associated abstracts and citations from PubMed. Entrez is specially designed to integrate the data from several different sources, databases, and formats into a uniform information model and retrieval system which can efficiently retrieve that relevant references, sequences, and structures.
Ген
Гендер туралы ақпаратты сипаттау және ұйымдастыру үшін NCBI-де Gene жүйесі іске қосылды. Ол геномдық карта, ген экспрессиясы, тізбек, ақуыз функциясы, құрылымы және гомология деректерінің тоғысқан жеріндегі маңызды түйін рөлін атқарады. Әрбір гендік жазбаға қайта қарау кезеңдерінде де анықтауға болатын бірегей GeneID тағайындалады. Белгілі немесе болжанған гендердің жазбалары осы жерде құрылады және олар карталық орналасуымен немесе нуклеотидтік тізбектерімен белгіленеді. Gene жүйесінің бұрынғы LocusLink жүйесінен бірнеше артықшылықтары бар, оның ішінде NCBI-дегі басқа дерекқорлармен жақсы үйлесімділік, кеңірек таксономиялық көлем және Entrez жүйесімен ұсынылатын сұрау мен іздеуге қатысты жақсартылған мүмкіндіктер бар.
Gene has been implemented at NCBI to characterize and organize the information about genes. It serves as a major node in the nexus of the genomic map, expression, sequence, protein function, structure, and homology data. A unique GeneID is assigned to each gene record that can be followed through revision cycles. Gene records for known or predicted genes are established here and are demarcated by map positions or nucleotide sequences. Gene has several advantages over its predecessor, LocusLink, including, better integration with other databases in NCBI, broader taxonomic scope, and enhanced options for query and retrieval provided by the Entrez system.
Белсенділер
Протеин дерекқоры жеке протеин тізбектерінің мәтіндік жазбаларын сақтайды, олар NCBI Reference Sequence (RefSeq) жобасы, GenBank, PDB және UniProtKB/SWISS-Prot сияқты көптеген әртүрлі көздерден алынған. Протеин жазбалары FASTA және XML сияқты әртүрлі форматтарда ұсынылады және басқа NCBI ресурстарымен байланыстырылған. Протеин пайдаланушыларға гендер, ДНҚ/РНҚ тізбектері, биологиялық жолдар, экспрессия және вариация туралы деректер, сондай-ақ әдебиеттер сияқты қажетті мәліметтерді ұсынады. Бұдан өзге, BLAST арқылы есептелген әрбір тізбек үшін ұқсас және бірдей белоктардың алдын ала анықталған жиынтығын қамтиды. NCBI-дің құрылымдық дерекқорында (Structure database) PDB-дегі эксперименттік жолмен анықталған құрылымдардың 3D координаттары жиынтығы бар, олар NCBI жүйесіне импортталады. Протеиннің сақталған домендер дерекқорында (CDD) белок тізбектеріндегі жоғары сақталған домендерді сипаттайтын тізбектік профильдер бар. Сондай-ақ, SMART және Pfam сияқты сыртқы ресурстардан алынған жазбалар да бар. Тағы бір белок дерекқоры бар, ол Протеин кластерлері дерекқоры деп аталады, онда BLAST есептеуі бойынша жеке тізбектер арасындағы максималды сәйкестіктерге сәйкес кластерленген белок тізбектерінің жиынтығы сақталған.
Protein database maintains the text record for individual protein sequences, derived from many different resources such as NCBI Reference Sequence (RefSeq) project, GenBank, PDB, and UniProtKB/SWISS Prot. Protein records are present in different formats including FASTA and XML and are linked to other NCBI resources. Protein provides the relevant data to the users such as genes, DNA/RNA sequences, biological pathways, expression and variation data, and literature. It also provides the pre determined sets of similar and identical proteins for each sequence as computed by the BLAST. The Structure database of NCBI contains 3D coordinate sets for experimentally determined structures in PDB that are imported by NCBI. The Conserved Domain database (CDD) of protein contains sequence profiles that characterize highly conserved domains within protein sequences. It also has records from external resources like SMART and Pfam. There is another database of proteins known as Protein Clusters database, which contains sets of proteins sequences that are clustered according to the maximum alignments between the individual sequences as calculated by BLAST.
Pubchem дерекқоры
NCBI-нің PubChem дерекқоры – молекулалар және олардың биологиялық талдауларға қатысты белсенділіктері туралы ашық қолжетімді ресурс. PubChem Entrez ақпаратты іздеу жүйесі арқылы іздеуге және қол жеткізуге болады.
PubChem database of NCBI is a public resource for molecules and their activities against biological assays. PubChem is searchable and accessible by Entrez information retrieval system.