這期內(nèi)容當(dāng)中小編將會(huì)給大家?guī)?lái)有關(guān)怎樣獲取物種所有基因?qū)?yīng)的GO注釋?zhuān)恼聝?nèi)容豐富且以專(zhuān)業(yè)的角度為大家分析和敘述,閱讀完這篇文章希望大家可以有所收獲。
從策劃到設(shè)計(jì)制作,每一步都追求做到細(xì)膩,制作可持續(xù)發(fā)展的企業(yè)網(wǎng)站。為客戶提供成都網(wǎng)站設(shè)計(jì)、成都做網(wǎng)站、網(wǎng)站策劃、網(wǎng)頁(yè)設(shè)計(jì)、域名與空間、虛擬主機(jī)、網(wǎng)絡(luò)營(yíng)銷(xiāo)、VI設(shè)計(jì)、 網(wǎng)站改版、漏洞修補(bǔ)等服務(wù)。為客戶提供更好的一站式互聯(lián)網(wǎng)解決方案,以客戶的口碑塑造優(yōu)易品牌,攜手廣大客戶,共同發(fā)展進(jìn)步。
Gene Ontology是研究基因功能的重要數(shù)據(jù)庫(kù)之一,在進(jìn)行GO的富集分析時(shí),需要提供所有基因?qū)?yīng)的GO注釋信息,下面介紹幾種獲取該信息的方式。
官網(wǎng)提供了幾種常見(jiàn)物種對(duì)應(yīng)的GO注釋信息,文件格式為GAF, 下載鏈接為
http://www.geneontology.org/page/download-go-annotations
human對(duì)應(yīng)的文件如下
該文件中提供的是uniprot數(shù)據(jù)庫(kù)中的蛋白對(duì)應(yīng)的GO信息,會(huì)給出蛋白對(duì)應(yīng)的uniprot數(shù)據(jù)庫(kù)編號(hào),蛋白對(duì)應(yīng)的基因symbol, 以及GO注釋?zhuān)纠缦?/p>
UniProtKB A0A024R161 DNAJC25-GNG10 GO:0003924
原始文件列數(shù)很多,我只選了前4列,第一列表示數(shù)據(jù)庫(kù)的名字,第二列為數(shù)據(jù)庫(kù)中的編號(hào),第三列為gene symbol, 第四列為對(duì)應(yīng)的GO注釋。
EBI對(duì)uniprot數(shù)據(jù)庫(kù)中的蛋白進(jìn)行了GO注釋分析,這個(gè)項(xiàng)目名為gene ontology annotation, 簡(jiǎn)稱(chēng)GOA, 在FTP也提供了物種對(duì)應(yīng)的注釋信息,示意圖如下
以human為例,F(xiàn)TP地址如下
ftp://ftp.ebi.ac.uk/pub/databases/GO/goa/HUMAN/
這里的文件和GO官網(wǎng)的文件內(nèi)容和格式是一致的,只不過(guò)數(shù)量上稍有差異。
在NCBI檢索基因時(shí),在結(jié)果頁(yè)面會(huì)看到該基因?qū)?yīng)的很多注釋信息,其中就包括了GO注釋?zhuān)@些信息在FTP上都提供了源文件,以供下載,鏈接如下
ftp://ftp.ncbi.nih.gov/gene/DATA/
幾個(gè)主要的文件示例如下
gene2go
就是基因?qū)?yīng)的GO注釋文件,這個(gè)文件包含了所有物種的GO信息,可以根據(jù)物種對(duì)應(yīng)的tax id提取指定物種。
NCBI中用Entrez Id 標(biāo)識(shí)每個(gè)基因,通過(guò)另外的幾個(gè)文件,可以得到Entrez ID
, Ensemble Id
, Gene Symbol
對(duì)應(yīng)的GO信息。
對(duì)于常見(jiàn)的物種,Bioconductor上也提供了對(duì)應(yīng)的注釋包,示意如下
以org.Hs.eg.db
為例,這個(gè)R包存儲(chǔ)了很多human基因?qū)?yīng)的信息,通過(guò)keys
和select
函數(shù)可以獲得基因?qū)?yīng)的GO注釋信息,代碼如下
> k <- keys(org.Hs.eg.db, keytype = "ENTREZID")[1:3] > select(org.Hs.eg.db, keys = k, columns = c("GO", "ONTOLOGY"), keytype="ENTREZID") 'select()' returned 1:many mapping between keys and columns ENTREZID GO EVIDENCE ONTOLOGY 1 1 GO:0002576 TAS BP 2 1 GO:0003674 ND MF 3 1 GO:0005576 IDA CC
這里的代碼只是根據(jù)Entrez ID 得到了GO注釋信息,其實(shí)這個(gè)R包也包含了gene symbol
, ensembl id
等很多其他的基因ID。
許多做富集分析的包就會(huì)從物種對(duì)應(yīng)的db
包中讀取GO注釋信息。
上述就是小編為大家分享的怎樣獲取物種所有基因?qū)?yīng)的GO注釋了,如果剛好有類(lèi)似的疑惑,不妨參照上述分析進(jìn)行理解。如果想知道更多相關(guān)知識(shí),歡迎關(guān)注創(chuàng)新互聯(lián)行業(yè)資訊頻道。
網(wǎng)站標(biāo)題:怎樣獲取物種所有基因?qū)?yīng)的GO注釋
文章位置:http://jinyejixie.com/article34/gpejse.html
成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供App設(shè)計(jì)、品牌網(wǎng)站制作、外貿(mào)建站、網(wǎng)頁(yè)設(shè)計(jì)公司、網(wǎng)站設(shè)計(jì)公司、網(wǎng)站策劃
聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請(qǐng)盡快告知,我們將會(huì)在第一時(shí)間刪除。文章觀點(diǎn)不代表本網(wǎng)站立場(chǎng),如需處理請(qǐng)聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時(shí)需注明來(lái)源: 創(chuàng)新互聯(lián)