Gene search


Sequence information


Select Gene Cds Cds_length GC_content Pep Pep_length
Cmo01g02071 ATGCAGCACCGCCCTTCAAGTGCTTTCAACGCCCCCTTCTGGACTACGAATTCTGGTGCTCCAGTATGGAACAACAACTCGTCGATGACCGTTGGGCCCAGAGGTCCCATTCTCCTAGAGGATTATCATCTAGTGGAGAAACTTGCTAACTTTGATAGGGAGCGGATCCCAGAGCGGGTTGTCCATGCTAGAGGAGCTAGTGCAAAAGGGTTTTTTGAGGTGACTCATGATATTACCAACCTTTCATGTGCTGATTTCCTTCGGGCCTCTGGAGTTCAGACTCCAGTTATTGTACGTTTCTCCACTGTTATCCATGAGCGTGGCAGCCCTGAAACACTGAGAGATCCCCGAGGTTTTGCTGTGAAGTTCTACACCAGGGAGGGTAATTTTGATCTTGTGGGCAATAACTTCCCTGTATTTTTCATCCGTGATGGTATGAAATTTCCAGACATGGTACATGCTCTCAAGCCGAATCCCAAGTCCCATATCCAGGAGAATTGGAGGATCCTTGACTTCTTTTCTCACCATCCAGAAAGCTTGAACATGTTCTCATTTCTATTTGATGATATTGGCATCCCACAAGATTACAGACACATGGACGGTTCAGGTGTTAACACTTATACTCTGATTAACAAGGCAGGGAAGGCACACTACGTGAAATTTCACTGGAGGCCTACCTGTGGAGTCAAGTCTTTGCTGGAGGAAGATGCTATCCGTGTTGGAGGAAGCAATCATAGCCACGCTACTCAGGACCTCTATGATTCAATTGCAGCAGGCAACTACCCCGAGTGGAAGCTTTTCATTCAGACTATTGACCCTGATCATGAAGACAAATATGACTTTGACCCTCTAGATGTAACTAAGACATGGCCTGAGGATATCTTGCCCCTGCAGCCAGTTGGCCGCATGGTTTTGAATAAGAACATAGATAACTTCTTTGCAGAGAATGAACAACTGGCTTTTTGTCCTGCCATTATAGTTCCTGGAGTCTACTATTCTGATGACAAATTGCTTCAGACCAGGATCTTCTCCTATGCTGATACTCAGAGGCACCGTCTTGGACCAAACTATCTGCAACTCCCTGCTAATGCACCCAAGTGTGCTCACCACAACAATCACCACGAGGGTTTCATGAACTTTATGCACCGAGATGAGGAGGTCAATTACTTCCCTTCTAGATTTGATCCTTCTCGTCACGCGGAGAGGTACCCTCACCCACCTGCTGTCTGCTCTGGAAAGCGCGAGAGGTGCATAATTGAAAAGGAGAACAACTTCAAGGAGCCTGGAGAGAGATACAGATCTTGGACACCAGACAGGCAAGAACGATTCGTCCGCAGATGGGTTGATGCTTTGTCCGACACCCGAGTCACCCATGAGATCCGCAGCATCTGGATTTCATACTGGTCTCAGGCGGATAGGTCTCTTGGTCAGAAGCTCGCATCCCATCTCAACGAACTTGAAGGATTCAAGGAAGGGGGCCTGCGAGCGGTATCATTGGGAGAAGGACCTCCTCAGCGCCCGAAGCTTGTTGACGGGATCATTCCCTTCCCTTCCTCACCTGTTCCCTATTCTTCAGACAGTTCTTCTTCCTGCCCATTTCAGCAACACCACAGAAATAATTCATTGCTACGACGTCTTATATTGCTGGAAGCTCCAGCTGATATTGCCATGGATTTTGACTACATGGATGGGCTGCTTTTAGATGATTGTTGGTTAGAAACTGCGGATGGTACTGTGTTTCTTCATCCTAACCTCTCAAGCTTTGGTGCTAACTTAGACCCTTTGATTGGGTGGCCTGCTACAGAGATGAATGGTGTCTTCAACACCAACTTGATTACAAGGAGTGATCAAGAAGAACCGAGGAACATGTTGAGCAATGAGGCGTCTCCGGGGCGGGAAAGAGTAGATGTCGGGCAAGAGGGATGCTCCGATCAATCCGAAAACAACGCGCTTGAAGGTTCTGAATTGTGCAGAAGACTGGGGATGGGAGCTGGGGAGCATATGGGGTCTGCACCTTCCGTGATGGAGAGACTAATCATGGCGGTTGGGTATATAAAAGATATTGTGAGAGACAAAGATGTTCTTGTACAAGTTTGGGTGCCTGTAAGTAGAGGGGGAAGAAGTGTTCTCATCACAAATCAGCTGCCGTTCTCTCAGAATTCCAGCTGCACAAGACTTGCAAAGTACAGGGACGTCTCTGTGAACTATGAATTCACAGCTGACGAGGATTCCAAAAAGGCTCTGGGATTGCCCGGTCGAGTGTTCTTAAGAAAGGTTCCAGAGTGGACTCCTGATGTTCGATTCTTCAGAAGCGATGAGTACCCGAGAGTTGATCATGCTCACGAGCACGATGTTCGTGGAACTATAGCACTTCCTGTTTTTGAACAAGGCAGCAAAAGTTGTTTAGGGGTGATTGAAGTTGTCATGGTTACCCAACAGATCAAATATGGTTCAGAACATGAGATTCTTTGCAAAGCCCTTCAGGCAGTCAAGCTTAGGAGCTCTGATGTAATCAGCCCACCCAATCAAAAGGTATTTAATAGGTTCAATGAAGCTGTATTATTAGAGATTCGAGACACTTTGAGAACTGCCTGCGAAACTCATGGTTTGCCCTTGGCACAAGCTTGGGCATCATGTATCCAACAAAGTAAAGAGGGTTGCAGGCACTCGGATGAGAACTACAGCTGTTGTGTTTCTACGGTAGACCGGGCTTGCTTCGTGGCTGATACTCGAATTCAAGATTTCCATGAGGCATGCTCTGAGCATCATTTGCTAAAAGGCGAAGGAATCGTTGGGATGGCGTTTAAATCTAACGAACCGTGTTTCTCAAGTGATATTACATCCTTTCGTAACACAGAATATCCTCTGTCTCACCATGCCAAGTTGTTTGGATTACATGCTGCAGTTGCACTACGCCTTCGTTGCATTTTCATTAGTAAAACGGACTTCGTACTCGAGTTCTTCCTGCCTGTCCATTGTAGAGATCCTGAAGAGCAGAGAATCCTGCTCACTTCGTTGTCCACAGTTATACAATACTCTTGCAGGAACCTGCGTCTTGTAACGGATAAGGAGTGTAGGGAGGAAAATATGGAACAACTTCATCCGACAAATTCATTGTTAGCTTCATCTGTTCAAAACATCCAACAATGTAGTGGCTCTGTCTCATTGTTGCAGGAGCTAAATTATGATCAGAATGGGGTTGTTGAGGACAGCGAAGAGTGCCCGACGGTCGGTAATGGTATCTTTGCAGATATAAGTATGGGAAGAACGGGTGAGAAAAGGCGAACCAAGGTCGAGAAAAGTATCACCTTAGAAGTTCTTCGGCAATACTTCGCGGGTAGCTTAAAAGATGCTGCAAAGAGCATTGGAGTTTGTCCTACCACATTGAAAAGGATATGTCGACAACATGGGATCAAACGTTGGCCTTCTCGAAAAATAAAGAAGGTCGGCCACTCGTTGCAGAAGCTCCAACTTGTAATCGACTCGGTGAACAGTGCATCTGGTGCTTTTCAAACTAGCTCCTTGTATTCCAATTTACAGGAGTTGGCCTCTCCATACGTAAGAAAGATGGGAGATGGCCTGAAAGCATCAAGCAACATCCGAGATGCAGCATCAAAAACTGCACCCTCATCGCTCAGCCAGAGCTCGAATTCAAGCCAATGTTTTTCTTTCTGCAGACATCCTGCCACTGGATGTGTAATGCAGACAGCAAAAGAAAGCGATCAAATGAGAGTGAAAGTAAGCTATGGAGAGGAGAGAATCCGGTTTCGAGTGCAGAAATGGTGGAGATACGAAGAGTTAGTGAAGGAAGTAGGAAGACGATTTAATATCAGAGACATAAGTAAATATGATCTCAAGTACTTAGATGATGAATGTGAATGGGTGTTGTTAACAAGTGATGCGTATCTTCAGGACTGCTTTCATATGTACAAATCGTCTCCACTCCAAACCATAAAGCTTCTGCTTCTACCATCTCCACGCCATAAGAGAGAGGAGCCACAAACCCCATCCTTCCCTACATTTTATATGCTATGA 4035 46.02 MQHRPSSAFNAPFWTTNSGAPVWNNNSSMTVGPRGPILLEDYHLVEKLANFDRERIPERVVHARGASAKGFFEVTHDITNLSCADFLRASGVQTPVIVRFSTVIHERGSPETLRDPRGFAVKFYTREGNFDLVGNNFPVFFIRDGMKFPDMVHALKPNPKSHIQENWRILDFFSHHPESLNMFSFLFDDIGIPQDYRHMDGSGVNTYTLINKAGKAHYVKFHWRPTCGVKSLLEEDAIRVGGSNHSHATQDLYDSIAAGNYPEWKLFIQTIDPDHEDKYDFDPLDVTKTWPEDILPLQPVGRMVLNKNIDNFFAENEQLAFCPAIIVPGVYYSDDKLLQTRIFSYADTQRHRLGPNYLQLPANAPKCAHHNNHHEGFMNFMHRDEEVNYFPSRFDPSRHAERYPHPPAVCSGKRERCIIEKENNFKEPGERYRSWTPDRQERFVRRWVDALSDTRVTHEIRSIWISYWSQADRSLGQKLASHLNELEGFKEGGLRAVSLGEGPPQRPKLVDGIIPFPSSPVPYSSDSSSSCPFQQHHRNNSLLRRLILLEAPADIAMDFDYMDGLLLDDCWLETADGTVFLHPNLSSFGANLDPLIGWPATEMNGVFNTNLITRSDQEEPRNMLSNEASPGRERVDVGQEGCSDQSENNALEGSELCRRLGMGAGEHMGSAPSVMERLIMAVGYIKDIVRDKDVLVQVWVPVSRGGRSVLITNQLPFSQNSSCTRLAKYRDVSVNYEFTADEDSKKALGLPGRVFLRKVPEWTPDVRFFRSDEYPRVDHAHEHDVRGTIALPVFEQGSKSCLGVIEVVMVTQQIKYGSEHEILCKALQAVKLRSSDVISPPNQKVFNRFNEAVLLEIRDTLRTACETHGLPLAQAWASCIQQSKEGCRHSDENYSCCVSTVDRACFVADTRIQDFHEACSEHHLLKGEGIVGMAFKSNEPCFSSDITSFRNTEYPLSHHAKLFGLHAAVALRLRCIFISKTDFVLEFFLPVHCRDPEEQRILLTSLSTVIQYSCRNLRLVTDKECREENMEQLHPTNSLLASSVQNIQQCSGSVSLLQELNYDQNGVVEDSEECPTVGNGIFADISMGRTGEKRRTKVEKSITLEVLRQYFAGSLKDAAKSIGVCPTTLKRICRQHGIKRWPSRKIKKVGHSLQKLQLVIDSVNSASGAFQTSSLYSNLQELASPYVRKMGDGLKASSNIRDAASKTAPSSLSQSSNSSQCFSFCRHPATGCVMQTAKESDQMRVKVSYGEERIRFRVQKWWRYEELVKEVGRRFNIRDISKYDLKYLDDECEWVLLTSDAYLQDCFHMYKSSPLQTIKLLLLPSPRHKREEPQTPSFPTFYML 1344
       

Gff information


Chromosome Start End Strand Old_gene Gene Num
1 14430546 14438974 + CmoCh01G020710.1 Cmo01g02071 375554

Annotation


Select Seq ID Length Analysis Description Start End IPR GO
Cmo01g02071 1344 MobiDBLite consensus disorder prediction 615 648 - -
Cmo01g02071 1344 SUPERFAMILY Heme-dependent catalase-like 10 484 IPR020835 GO:0020037
Cmo01g02071 1344 ProSiteProfiles catalase family profile. 11 489 IPR018028 GO:0004096|GO:0006979|GO:0020037
Cmo01g02071 1344 ProSiteProfiles RWP-RK domain profile. 1088 1169 IPR003035 -
Cmo01g02071 1344 SMART PB1_new 1242 1325 IPR000270 GO:0005515
Cmo01g02071 1344 Gene3D Catalase core domain 13 491 - -
Cmo01g02071 1344 CDD catalase_clade_1 13 481 - -
Cmo01g02071 1344 Pfam RWP-RK domain 1101 1149 IPR003035 -
Cmo01g02071 1344 PRINTS Catalase signature 28 51 IPR018028 GO:0004096|GO:0006979|GO:0020037
Cmo01g02071 1344 PRINTS Catalase signature 296 323 IPR018028 GO:0004096|GO:0006979|GO:0020037
Cmo01g02071 1344 PRINTS Catalase signature 112 129 IPR018028 GO:0004096|GO:0006979|GO:0020037
Cmo01g02071 1344 PRINTS Catalase signature 328 354 IPR018028 GO:0004096|GO:0006979|GO:0020037
Cmo01g02071 1344 PRINTS Catalase signature 131 149 IPR018028 GO:0004096|GO:0006979|GO:0020037
Cmo01g02071 1344 PRINTS Catalase signature 91 109 IPR018028 GO:0004096|GO:0006979|GO:0020037
Cmo01g02071 1344 ProSiteProfiles PB1 domain profile. 1242 1325 IPR000270 GO:0005515
Cmo01g02071 1344 Pfam PB1 domain 1243 1322 IPR000270 GO:0005515
Cmo01g02071 1344 Gene3D - 1238 1325 - -
Cmo01g02071 1344 Pfam Catalase 15 395 IPR011614 GO:0004096|GO:0020037
Cmo01g02071 1344 SUPERFAMILY CAD & PB1 domains 1237 1326 - -
Cmo01g02071 1344 Pfam Catalase-related immune-responsive 420 483 IPR010582 -
Cmo01g02071 1344 ProSitePatterns Catalase proximal active site signature. 51 67 IPR024708 GO:0004096
Cmo01g02071 1344 PANTHER CATALASE 3 484 - -
Cmo01g02071 1344 ProSitePatterns Catalase proximal heme-ligand signature. 341 349 IPR002226 GO:0020037
Cmo01g02071 1344 PANTHER CATALASE 3 484 IPR018028 GO:0004096|GO:0006979|GO:0020037
Cmo01g02071 1344 SMART Catalase_2 15 398 IPR011614 GO:0004096|GO:0020037
Cmo01g02071 1344 CDD PB1_NLP 1243 1322 IPR034891 -
       

Pathway


Select Query KO Definition Second KO KEGG Genes ID GHOSTX Score
Cmo01g02071 K03781 katE, CAT, catB, srpA; catalase [EC:1.11.1.6] - cmax:111481076 1552.34
       

WGDs- Genes


Select Gene_1 Gene_2 Event_name
Cmo01g02071 Cmo09g00055 CST
       

Dupl-types


Select Gene1 Location1 Gene2 Location2 E-value Duplicated-type
Cmo01g02071 Cmo-Chr1:14430546 Cmo16g00577 Cmo-Chr16:2791791 5.22E-13 dispersed
Cmo01g02071 Cmo-Chr1:14430546 Cmo12g00616 Cmo-Chr12:3848542 0 wgd
Cmo01g02071 Cmo-Chr1:14430546 Cmo05g00996 Cmo-Chr5:8023898 0 wgd
Cmo01g02071 Cmo-Chr1:14430546 Cmo09g00055 Cmo-Chr9:241552 3.60E-39 wgd
       

Deco-Alignment


Select Vvi1 Blo1 Blo2 Bda1 Bda2 Bpe1 Bpe2 Bma1 Bma2 Cmo1 Cmo2 Cma1 Cma2 Car1 Car2 Sed1 Cpe1 Cpe2 Bhi1 Tan1 Cmetu1 Lac1 Hepe1 Mch1 Lcy1 Cla1 Cam1 Cec1 Cco1 Clacu1 Cmu1 Cre1 Cone1 Cone2 Cone3 Cone4 Lsi1 Csa1 Chy1 Cme1 Blo3 Blo4 Bda3 Bda4 Bpe3 Bpe4 Bma3 Bma4 Sed2 Cmo3 Cmo4 Cma3 Cma4 Car3 Car4 Cpe3 Cpe4 Bhi2 Tan2 Cmetu2 Lac2 Hepe2 Mch2 Lcy2 Cla2 Cam2 Cec2 Cco2 Clacu2 Cmu2 Cre2 Lsi2 Csa2 Chy2 Cme2
Vvi18g95 Blo01g01637 Blo12g00853 . Bda03g00320 Bpe02g00307 Bpe04g00281 . Bma01g02411 . . Cma01g02014 Cma09g00053 Car01g01583 . . Cpe06g00022 . . . . . . . . . . . . . . . Cone4ag2020 Cone7ag1936 . Cone20ag0023 Lsi04g01806 Csa04g02701 . . Blo17g00903 . Bda11g00974 . . . . . Sed01g2434 Cmo01g02071 Cmo09g00055 . . . Car09g00046 . Cpe02g00035 Bhi09g02885 Tan01g5108 Cmetu07g0208 . . Mch11g0056 . Cla11g01823 Cam11g1889 Cec11g1914 Cco11g1922 Clacu11g2054 Cmu11g1859 Cre11g2265 . . Chy07g00393 Cme07g00054
       

Syn-Orthogroups


Select Orthogroup Bda Bhi Blo Bma Bpe Cam Car Cco Cec Chy Cla Clacu Cma Cme Cmetu Cmo Cmu Cone Cpe Cre Csa HCH Hepe Lac Lcy Lsi Mch Sed Tan Vvi Total
OG0003158 2 5 3 1 2 0 2 1 0 1 1 1 2 1 1 2 0 3 2 1 1 1 1 1 1 1 1 4 4 2 48
       

Regulatory proteins


Select Gene Hmm_acc Hmm_name Score E-value Regulatory Factors Family
9167 PF00199 Catalase 8.60E-170 No_clan Cmo TF