Gene Rsph17025_3012 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rsph17025_3012
Symbol
ID	5084612
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Rhodobacter sphaeroides ATCC 17025
Kingdom	Bacteria
Replicon accession	NC_009428
Strand	-
Start bp	3078885
End bp	3079952
Gene Length	1068 bp
Protein Length	355 aa
Translation table	11
GC content	71%
IMG OID	640484585
Product	dihydroorotate dehydrogenase 2
Protein accession	YP_001169203
Protein GI	146279044
COG category	[F] Nucleotide transport and metabolism
COG ID	[COG0167] Dihydroorotate dehydrogenase
TIGRFAM ID	[TIGR01036] dihydroorotate dehydrogenase, subfamily 2

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.294679
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	16
Fosmid unclonability p-value	0.208267
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGAACATCC TGGAACGCGC GGCGCTGACG GCCCTTCACC GGATGGACCC GGAGAAGGCC 
CATGGCCTTT CCCTGTCCGC CCTGCGCTCG GGCCTTGTGC CGCTGCCGGG GCCGGTGACG 
TCTCCTCGGC TGGCCACCTC GGTCGCGGGC CTTTTGCTTC CCAACCCGGT GGGGCTGGCC 
GCCGGCTACG ACAAGAATGC GGTGGCGCTG CCCGCGCTGA TGCGCGCCGG CTTCGGGTTC 
ATCGAGGTGG GCGCGGCGAC GCCCCGGCCG CAGCCGGGCA ATCCGCAGCC CCGGTTGTTC 
CGACTGACCG AGGACCGCGC CGCGATCAAC CGATTCGGCT TCAACAACGA CGGCGCGGCC 
ACGATCTGCG CCCGGCTGGC CATGCGGCCT CGGGGGCCGG TTCCGGTGGG GCTGAACCTG 
GGCGCCAACA AGGACAGCAC CGACCGTGCC GCCGATTTCG GCGCGGTGCT GGCGGCCTGC 
GGTCCGCATG TGGATTTCGC GACGGTCAAT GTCTCGTCGC CCAACACCGA ACGGCTGCGT 
GATCTTCAGG GACGGCAAGC GCTGACCGCC CTCCTTTCCG GCGTCATGGA GGTGCGGGCG 
ACGCTCTCTC TTGCGGTGCC CGTGTTCCTC AAGATCGCGC CGGATCTGTC GGACGCCGAT 
CTGGCGGAGA TTGCCGAGGT GGCGATGGAG TCCGGCATCG CGGGGATCGT GGCGACCAAC 
ACCACCCTCT CGCGCGAGGG GCTGCAGAGC GCGCACGCCG GCGAGGCCGG TGGCCTGTCG 
GGTGCACCCC TCTTCCAACG CTCGACCCGG GTGCTGGCCC GGCTCTCGCA TCTGACCGAA 
GGCCGCCTGC CGCTGATCGG CGTGGGCGGG ATCTCGAGCG CCGAAGAGGC CTATGCCAAG 
ATCCGCGCCG GGGCCTCGGC CGTGCAGCTC TATACGGCCA TGGTCTATGA GGGCGTGGGG 
CTGGCGGCCC GGATCGCCAA GGACCTTGAC CGGCTTCTCG AGCAGGATGG GTTCGGCCAT 
GTCTCCGAAG CCGTCGGGAC CGGCCGCTCG GACTGGCTGT CCGGGTAG

Protein sequence

MNILERAALT ALHRMDPEKA HGLSLSALRS GLVPLPGPVT SPRLATSVAG LLLPNPVGLA 
AGYDKNAVAL PALMRAGFGF IEVGAATPRP QPGNPQPRLF RLTEDRAAIN RFGFNNDGAA 
TICARLAMRP RGPVPVGLNL GANKDSTDRA ADFGAVLAAC GPHVDFATVN VSSPNTERLR 
DLQGRQALTA LLSGVMEVRA TLSLAVPVFL KIAPDLSDAD LAEIAEVAME SGIAGIVATN 
TTLSREGLQS AHAGEAGGLS GAPLFQRSTR VLARLSHLTE GRLPLIGVGG ISSAEEAYAK 
IRAGASAVQL YTAMVYEGVG LAARIAKDLD RLLEQDGFGH VSEAVGTGRS DWLSG