Gene Rsph17025_1931 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rsph17025_1931
Symbol
ID	5084056
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Rhodobacter sphaeroides ATCC 17025
Kingdom	Bacteria
Replicon accession	NC_009428
Strand	-
Start bp	1973809
End bp	1974966
Gene Length	1158 bp
Protein Length	385 aa
Translation table	11
GC content	71%
IMG OID	640483493
Product	hypothetical protein
Protein accession	YP_001168127
Protein GI	146277968
COG category	[S] Function unknown
COG ID	[COG3287] Uncharacterized conserved protein
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.429127
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	21
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

TTGGACGAAC GGTTTGCGAC GGAAGGGGCA CGCTCCGGCG ACAGCGGGGC GCCGGTCGTG 
CTGTCCGAGC CGGCCTGCGC GCCGGATCTG GCCGAGCGGC TGTGCGCGGG GCTTGCGGGG 
GCGGCGCCGG CGGCGGTTCT GCTGTTCTCG TCGCCGGGCG CGGATCTTCC GGCGCTGGCG 
GCGCGTCTGG GCGCGGCGCT GGGGGCCCGG ATCATCGGCT GCTCCTCGGC GGGCGAGTTT 
GCCTGCGGCG GCTATGGCAA CGGGCATGTG GTGGCGGTGG GGCTGCCCGG CGCGCGCTTT 
CACACCGACG CCGTCTGGCT GAGGAACCTC GCGGGGCTGG GCGTGTCGGA CTGGATGGCC 
GAGCTGCGCG CGCTCTTTTC CCGCTTCGAG GGACAGCCGC GTCGGCATCG GTTCGGCCTC 
CTGCTCATCG ACGGGCTGAG CCGGCAGGAA GAGCTGGTGG CGGCCACGGT CGATGCGGTG 
GCGCACCGGC TGCCGGTGCT GGGCGGATCG GCGGGCGACG GGCTGCGGTT CGAGGAGACC 
TGCCTCGTCC TTGACGGCGA CAGCCACCGG GACAGCGCGA TCTTTGCGCT GTTCGAGACG 
GATTTCGCGC TGGAGCAGGT GATCTTCGAC CATTTCACCC CCTCGGGCAG CCGGATGGTG 
GTGACGGCGG CGGTGCCCGA AGAACGGCTG ATCCTCGAGA TCAACGCCGA GCCCGCGGCC 
GAGGAATATG CCCGCCTGAT CGGACTTGCC CCCGAGGCGC TGAACCCGCG TGTCTTCGCC 
GAGAATCCGC TCCTCGTGCG GATGGGCGGG CAGTATCACG TCCGTGCCAT CCGCGAGGTC 
ACGCCCGAGG GCGGGCTCAC GCTCATGTCC TCGATCGAGA GCGGCGTGCT GCTTGCCCTT 
GGCCGTGCCG ACGACCTGAC GCATGGGCTT CAGGCCCGGC TCGAGGCGCT GGGAGAGCGT 
CCGGCGCTGA TCCTGGCCTT CGACTGCATC CTGCGCCGTC TGGCGCTCGA ACAGGCCGGG 
CTGGAACCGG CCGTCGCCCG CCTCTTTGCC GATTGGCGCA TCGCGGGCTT CAACACCTAC 
GGCGAGCAGC ACGGCGGCGT GCACGTCAAC CAGACCTTCG TGGGGCTCGC GCTGATGGGG 
CCCGCCCATG CTGCGTGA

Protein sequence

MDERFATEGA RSGDSGAPVV LSEPACAPDL AERLCAGLAG AAPAAVLLFS SPGADLPALA 
ARLGAALGAR IIGCSSAGEF ACGGYGNGHV VAVGLPGARF HTDAVWLRNL AGLGVSDWMA 
ELRALFSRFE GQPRRHRFGL LLIDGLSRQE ELVAATVDAV AHRLPVLGGS AGDGLRFEET 
CLVLDGDSHR DSAIFALFET DFALEQVIFD HFTPSGSRMV VTAAVPEERL ILEINAEPAA 
EEYARLIGLA PEALNPRVFA ENPLLVRMGG QYHVRAIREV TPEGGLTLMS SIESGVLLAL 
GRADDLTHGL QARLEALGER PALILAFDCI LRRLALEQAG LEPAVARLFA DWRIAGFNTY 
GEQHGGVHVN QTFVGLALMG PAHAA