Gene search


Sequence information


Select Gene Cds Cds_length GC_content Pep Pep_length
Cre02g0841 ATGGGGAAGAACAAGAAACGTAAGGACGGCGGCGAGAAGGGAGCCGCCGCCGGCGACCACTGCCCTTCCAAGGTCTTCGTCAAGAACTTGCCGTACTCGTTCACCAACTCACAGCTTGAAGAAACATTCAGTGATGTTGGTCCGGTCCGGCGGTGCTTCATGGTTACTCAAAAGGGTTCAACTGAGCATCGCGGTTTTGGATTCGTGCAGTTTGCGGTAGCTGAAGATGCAAATCGAGCAATTGAGCTGAAGAATGGGATGTCTGTTGAAGGACGCAAAATTACTGTTAAACATGCTATGCATCGAGCTCCCCTCGAGCAGCGGCGGTCTAAAGAAAATCAAGCTACTGCATCTAAGTCAACAATTAACGAGGAAGGAGATACTTCTAAAAGGGAAGAGCAAACAATTAACGAGGATAGAGATACTTCTAAAAGGGAAGAACAAACAACTAACGAGGATAGAGATACTTCTGAAAAGGCAGAACAAACAACTTCAACTTCCGAGGGGAAAGAAAGACATTTGAATGCTCGGAAATTAGCTTCACTTTCTAGTTATCTAGAGGATAAAGAGGGTCATTCAGGAAAGCAAAGGATTGCAAGGACTGTTGTATTCGGTGGTCTTCTTAATGCTGACATGGCTGAAGATGTTCACCGCCAAGCAAGAGATGTTGGCGACATATGCTCTATTGTTTATCCTCTTCCCAGAAAACAAGTTGAACAACATGGTCTTTTACGAGATGGATGCAAAATGGATGTTTCAGCTGTACTTTTTGCTAGTGTGAAGTCTGCACGTGCTGCTGTTACCATATTACACCAGAAAGAGATGAAAGGAGGTGTTATATGGGCCCGACAACTGGGTGGAGAGCTTTTAAATATTGGAAGAAGTGACCTCCTGATCGGCTATAAGATTGTGGAGGACAGACTTGCGTTCACTGGAAGATCCAAGTTCCGTCTTTTGTTGTCCCTTATGGAACTTGGTCCAAAGGGGTCCAAAACTCAGAAATGGAAAGTTATTGTTAGAAATCTTCCATTTAAGGCCAAGGAGAAAGAAATAAAGGATACCTTTTCATCTGCAGGATTTGTGTGGGATGTGATGATGCCACATAGTTCAGACACAGGATTATCAAAGGGGTTTGCGTTTGTCAAATTTACATGCAAACAGGATGCTGAGAGTGCTATTAAAAAGTTCAATGGTCAAAAATTTGGTCAAAGGACGATAGCTGTGGACTGGGCTGTTCCAAAGAAGATATATAGCTCGGGTGCTAGTGCTCCAGTTGATTCAGATGACGGGGAACAGACTGAAAGAGACAGAGAAGGTAGCATTAGTAGTGATGATTTCGAAGCTGAAAATACTGCTGTTCATGAGAAATCTCAGTGCTCCAACAAAGATGAAAGTTCTTCAGAGGATTCGGAGAAAGAAGATATTTCCTCGGAGGTTAATTTTGAAGGAGAAGCAGAAATGGCAAGAAAAGTTCTTGAAAATCTAATTTCATCTTCGGCTAAAGAGGCTCTTCCTTCTTCCATTGATGGTAACCCACCATCTAAAGTGAACAAGGAGCCAGATTTTGATTCGTCCAAGAAGTCATCTGATGTGTCTGATAAAGTATCAAATGAACCTGGAAAGTTAAATGAAAGCAAAACATCTATTCTTAAGCAAACAGATGAAGATGATTTGAAGAGAACTGTTTATATAGGCAATCTTCCTTTTGATATTGATAATGAAGAAGTGAAACAGCGGTTTTCTGGATTTGGTGAAGTGCTATCCTTTGTGCCAGTCCTTCATCAGGTTACAAAGCGACCGAAAGGCACTGGTTTTCTCAAGTTTAAAACGGTCAATGCTGCTACTGCTGCTGTTTCTTCTGCAAATGTTGCATCTGGTGTGGGAATATTTCTGAAAGGCAGGCAACTGAAAGTATTGAATGCCCTGGATAGAAAATCAGCTCATGACAAGGAATTGGAAAAGTCCAAAAATGACAATCATGACCACCGGAATCTTTATCTTGCACAGGAAGGTATTATTCTCGAGGGAACTCCAGCTGCTGAGGGAGTTTCTGCTAGTGATATGGAGAAACGTCAAAGGCTGGAAAAGAAAAGAACGACCAAGCTTCAATCTCCAAATTTTCATGTTTCAAGGACTAGGCTCGTTATACACAATTTACCAAAATCAATGAAAGAAAAAGAACTTCAAAAACTTTGCATTGAAGCGGTTACCTCACGAGCTACAAAACAAAAACCCGTGATTCGACAGATTAAGTTCTTAAAGGATGTGAAGAAAGGAAAGCTACTGACAAAAAATCACTCCTGTGGAGTCGCTTTCGTTGAGTTTTCTGAGCATGAGCACGCCCTTGTAGCCCTGCGAGTTCTCAACAACAATCCAGAAACTTTTGGCCCTATAAATCGCCCGATCGTAGAGTTTGCTATTGACAATGTTCAAACGTTGAAGTTGCGTAAAGCAAAGTTACAAGCTTGGTCACAGGACAATACAGCCAATGTTCCCAAAGCCTGGCAAGGGAATGCGAATACTGATACAATTGCTGGGGATGTCCATTCAAACAAGAACAATTCCAGAAAAAGGAAAGCAATGGGCGATAATCGTCCGGTGCGCAACAAAGATGAAAATGACAATCATGTGTCCAATGATGTGGCGATGGAAGAAAATAGAGCTATTAAAAAGAGGAAAACACGTCCAGAAATCGGTAATACAAACAAGTCACTGAGACAAAAACCAGAAGGACGAAGACCAATGCCTGAAAAATCGAGCAACAGATCGGTATCCATGGATTCTGGAAAAATAAAAGCTTCTCAGGAAGCTGATGTACAACACAAAAAGAAGGTAAAACATCAAGTAGAGCAGCAGAGGAAGAGGCCAAAGAAAAACAAGGAACCAATAGGGCGGGATGTTGTCGATAAACTCGACGTGCTTATTGAACAATATCGATCCAAGTTCTTGCAGCAGAGGTCAGACCGAACAGATGGTGAAAAGAAAGGCTCTAAACAGGGCTCCCTTTTGATGGCCAAACCCAAGGCTCCGAGGCAAACCCTAGATTCTTACACTGTCAAACGCATCAACAAAACCATTAAAGCCGGCGATTGCGTGCTTATGAGGCCCTCCGAACCCTCGAAACCTTCGTATGTTGCTAAGATTGAGAAGATTGAGGCTGATTCTCGTGGGGCCAATGTGAAGGTCCATGTTCGCTGGTATTACCGGCCGGAGGAATCAATTGGCGGTCGGAGACAGTTTCATGGCTCGAAGGAGCTGTTTCTCTCCGACCATTATGACGTTCAAAGCGCCGACACTATCGAGGGAAAGTGTACGGTGCATACGTTTAAGAATTATACCAAGCTTGATGCCGTTGGAAATGATGATTATTTTTGCCGTTTCGACTATAATTCCACTACTGGAGCTTTCAATCCCGATCGAGTGGCTGTGTATTGCAAGTGTGAGATGCCTTATAATCCCGATGACCTAATGGTTCAGTGCGAGAGCTGCAGTGACTGGTTCCATCCTGCTTGTATAGAAATGACTGCAGAAGAAGCTAAAAAACTTGACCACTTCTTCTGTGAAAGTTGTTCTTCAGAGGGTCAAAAGAAGTTGCAGAATTCACAGTCTACATCTAAAGTTGCAGAGACTAAGGTGGATACAAAACGACGCCGGAGGTGA 3660 42.9 MGKNKKRKDGGEKGAAAGDHCPSKVFVKNLPYSFTNSQLEETFSDVGPVRRCFMVTQKGSTEHRGFGFVQFAVAEDANRAIELKNGMSVEGRKITVKHAMHRAPLEQRRSKENQATASKSTINEEGDTSKREEQTINEDRDTSKREEQTTNEDRDTSEKAEQTTSTSEGKERHLNARKLASLSSYLEDKEGHSGKQRIARTVVFGGLLNADMAEDVHRQARDVGDICSIVYPLPRKQVEQHGLLRDGCKMDVSAVLFASVKSARAAVTILHQKEMKGGVIWARQLGGELLNIGRSDLLIGYKIVEDRLAFTGRSKFRLLLSLMELGPKGSKTQKWKVIVRNLPFKAKEKEIKDTFSSAGFVWDVMMPHSSDTGLSKGFAFVKFTCKQDAESAIKKFNGQKFGQRTIAVDWAVPKKIYSSGASAPVDSDDGEQTERDREGSISSDDFEAENTAVHEKSQCSNKDESSSEDSEKEDISSEVNFEGEAEMARKVLENLISSSAKEALPSSIDGNPPSKVNKEPDFDSSKKSSDVSDKVSNEPGKLNESKTSILKQTDEDDLKRTVYIGNLPFDIDNEEVKQRFSGFGEVLSFVPVLHQVTKRPKGTGFLKFKTVNAATAAVSSANVASGVGIFLKGRQLKVLNALDRKSAHDKELEKSKNDNHDHRNLYLAQEGIILEGTPAAEGVSASDMEKRQRLEKKRTTKLQSPNFHVSRTRLVIHNLPKSMKEKELQKLCIEAVTSRATKQKPVIRQIKFLKDVKKGKLLTKNHSCGVAFVEFSEHEHALVALRVLNNNPETFGPINRPIVEFAIDNVQTLKLRKAKLQAWSQDNTANVPKAWQGNANTDTIAGDVHSNKNNSRKRKAMGDNRPVRNKDENDNHVSNDVAMEENRAIKKRKTRPEIGNTNKSLRQKPEGRRPMPEKSSNRSVSMDSGKIKASQEADVQHKKKVKHQVEQQRKRPKKNKEPIGRDVVDKLDVLIEQYRSKFLQQRSDRTDGEKKGSKQGSLLMAKPKAPRQTLDSYTVKRINKTIKAGDCVLMRPSEPSKPSYVAKIEKIEADSRGANVKVHVRWYYRPEESIGGRRQFHGSKELFLSDHYDVQSADTIEGKCTVHTFKNYTKLDAVGNDDYFCRFDYNSTTGAFNPDRVAVYCKCEMPYNPDDLMVQCESCSDWFHPACIEMTAEEAKKLDHFFCESCSSEGQKKLQNSQSTSKVAETKVDTKRRRR 1219
       

Gff information


Chromosome Start End Strand Old_gene Gene Num
2 5197937 5218983 - CrPI670011_02g008410.1 Cre02g0841 490122

Annotation


Select Seq ID Length Analysis Description Start End IPR GO
Cre02g0841 1219 CDD BAH_BAHCC1 1025 1160 - -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 984 1015 - -
Cre02g0841 1219 Gene3D - 711 806 IPR012677 -
Cre02g0841 1219 SMART BAH_4 1024 1140 IPR001025 GO:0003682(InterPro)
Cre02g0841 1219 MobiDBLite consensus disorder prediction 100 176 - -
Cre02g0841 1219 FunFam RNA-binding motif protein 28 711 806 - -
Cre02g0841 1219 Pfam BAH domain 1025 1138 IPR001025 GO:0003682(InterPro)
Cre02g0841 1219 MobiDBLite consensus disorder prediction 831 850 - -
Cre02g0841 1219 Gene3D - 986 1136 IPR043151 -
Cre02g0841 1219 ProSiteProfiles Eukaryotic RNA Recognition Motif (RRM) profile. 335 413 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 Gene3D - 325 459 IPR012677 -
Cre02g0841 1219 Gene3D - 2 115 IPR012677 -
Cre02g0841 1219 ProSiteProfiles Eukaryotic RNA Recognition Motif (RRM) profile. 23 101 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 ProSiteProfiles Eukaryotic RNA Recognition Motif (RRM) profile. 712 820 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 MobiDBLite consensus disorder prediction 1 15 - -
Cre02g0841 1219 CDD RRM4_RBM28_like 712 809 - -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 1 20 - -
Cre02g0841 1219 Pfam PHD-finger 1145 1190 IPR019787 -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 831 965 - -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 501 549 - -
Cre02g0841 1219 SUPERFAMILY FYVE/PHD zinc finger 1134 1196 IPR011011 -
Cre02g0841 1219 Gene3D Zinc/RING finger domain, C3HC4 (zinc finger) 1137 1208 IPR013083 -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 851 899 - -
Cre02g0841 1219 CDD RRM1_RBM28_like 24 102 - -
Cre02g0841 1219 PANTHER RNA-BINDING MOTIF PROTEIN 14B 20 999 IPR051945 GO:0003729(PANTHER)
Cre02g0841 1219 MobiDBLite consensus disorder prediction 1193 1219 - -
Cre02g0841 1219 SMART PHD_3 1144 1191 IPR001965 -
Cre02g0841 1219 Gene3D - 536 661 IPR012677 -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 428 481 - -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 519 540 - -
Cre02g0841 1219 ProSiteProfiles Zinc finger PHD-type profile. 1142 1193 IPR019787 -
Cre02g0841 1219 ProSiteProfiles Eukaryotic RNA Recognition Motif (RRM) profile. 560 643 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 SMART rrm1_1 336 409 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 SMART rrm1_1 561 639 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 SMART rrm1_1 713 804 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 SMART rrm1_1 24 97 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 SUPERFAMILY RNA-binding domain, RBD 330 425 IPR035979 GO:0003676(InterPro)
Cre02g0841 1219 MobiDBLite consensus disorder prediction 124 176 - -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 420 481 - -
Cre02g0841 1219 MobiDBLite consensus disorder prediction 1193 1208 - -
Cre02g0841 1219 ProSiteProfiles BAH domain profile. 1024 1140 IPR001025 GO:0003682(InterPro)
Cre02g0841 1219 ProSitePatterns Zinc finger PHD-type signature. 1145 1190 IPR019786 -
Cre02g0841 1219 CDD RRM2_RBM28_like 336 412 - -
Cre02g0841 1219 SUPERFAMILY RNA-binding domain, RBD 23 281 IPR035979 GO:0003676(InterPro)
Cre02g0841 1219 Pfam RNA recognition motif 25 95 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 Pfam RNA recognition motif 337 406 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 Pfam RNA recognition motif 562 622 IPR000504 GO:0003723(InterPro)
Cre02g0841 1219 SUPERFAMILY RNA-binding domain, RBD 560 790 IPR035979 GO:0003676(InterPro)
       

Pathway


Select Query KO Definition Second KO KEGG Genes ID GHOSTX Score
Cre02g0841 K14573 - - csv:101217384 1553.5
       

Dupl-types


Select Gene1 Location1 Gene2 Location2 E-value Duplicated-type
Cre01g0874 Cre-Chr1:11830490 Cre02g0841 Cre-Chr2:5197937 1.90E-91 dispersed
Cre02g0553 Cre-Chr2:2609540 Cre02g0841 Cre-Chr2:5197937 9.40E-75 dispersed
Cre02g0841 Cre-Chr2:5197937 Cre10g1938 Cre-Chr10:34052736 8.00E-09 dispersed
       

Deco-Alignment


Select Vvi1 Blo1 Blo2 Bda1 Bda2 Bpe1 Bpe2 Bma1 Bma2 Cmo1 Cmo2 Cma1 Cma2 Car1 Car2 Sed1 Cpe1 Cpe2 Bhi1 Tan1 Cmetu1 Lac1 Hepe1 Mch1 Lcy1 Cla1 Cam1 Cec1 Cco1 Clacu1 Cmu1 Cre1 Cone1 Cone2 Cone3 Cone4 Lsi1 Csa1 Chy1 Cme1 Blo3 Blo4 Bda3 Bda4 Bpe3 Bpe4 Bma3 Bma4 Sed2 Cmo3 Cmo4 Cma3 Cma4 Car3 Car4 Cpe3 Cpe4 Bhi2 Tan2 Cmetu2 Lac2 Hepe2 Mch2 Lcy2 Cla2 Cam2 Cec2 Cco2 Clacu2 Cmu2 Cre2 Lsi2 Csa2 Chy2 Cme2
Vvi3g8 . . . . . Bpe12g00087 . . Cmo19g00694 . . . . . Sed05g2305 Cpe04g00115 Cpe15g00553 Bhi05g01787 Tan02g0774 Cmetu01g1478 . Hepe02g0245 . . Cla02g00500 Cam02g0510 Cec02g0510 Cco02g0517 Clacu02g0512 Cmu02g0508 Cre02g0841 Cone12ag1172 Cone8ag1219 . . . Csa07g00017 . Cme01g01365 Blo04g00526 Blo13g00542 Bda15g01076 Bda14g00569 Bpe15g00854 . Bma03g00563 Bma08g00787 . . . . . . Car19g00525 . . . . . . . . . . . . . . . . Lsi11g01125 . Chy01g00760 .
       

Syn-Orthogroups


Select Orthogroup Bda Bhi Blo Bma Bpe Cam Car Cco Cec Chy Cla Clacu Cma Cme Cmetu Cmo Cmu Cone Cpe Cre Csa HCH Hepe Lac Lcy Lsi Mch Sed Tan Vvi Total
OG0009278 1 1 1 3 1 1 1 1 1 1 1 1 0 1 2 1 1 2 1 1 1 1 1 1 1 1 1 2 1 1 34
       

Regulatory proteins


Select Gene Hmm_acc Hmm_name Score E-value Regulatory Factors Family
53112 PF01426 BAH 8.40E-22 No_clan Cre TR