Gene P9211_12651 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	P9211_12651
Symbol
ID	5730018
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. MIT 9211
Kingdom	Bacteria
Replicon accession	NC_009976
Strand	-
Start bp	1141018
End bp	1142106
Gene Length	1089 bp
Protein Length	362 aa
Translation table	11
GC content	39%
IMG OID	641285634
Product	glycosyl transferase group 1
Protein accession	YP_001551150
Protein GI	159903806
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	8
Fosmid unclonability p-value	0.00148492
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

GTGACAGTTA AAGCATTAAA GCTTTTATTA GTAAGCACTC CGATTGGTTT TTTAGGTAGT 
GGTCAAGGGG GTGGTGTTGA ATTGACTTTG ATCTCTTTAG TTAAAGGTCT TTTAGAACTT 
GGGCATGAAG TTGTTTTAAT TGCTCCAAAT GGTTCAGAAC TTCCAAAAGA ATGCGAAGGC 
GTTGAAATTA GATATGTTTC AGGATTTGAT CAACCAAGTT GGCAACATCA AGATTATGGT 
TCTCCAGTAA TCATTCCAGC TAACGGAGTA CTTCCAATGC TTTGGGAAAA GGCACTTGAT 
GTTGGGAAAG AAGATTTTGA TGCGATTTTG AATTTTGGCT ATGACTGGTT GCCTTTATGG 
CTAACACCTC ATGTTGAGCC AAGATTATTT CATTTGATAA GTATGGGAGC TGTTTCAAAA 
GTGATTAAGG ATCAGATAAT GAAACTATCT AAGACACAAC ATTCTCGACT TGCTTTTCAT 
ACTCATGTTC AGGCTTCAGA TTATGAATTG AGTGATACTC CAACAGTTGT AGGCAATGGC 
TTTGATCTTA ATCAATATAA ATTCCAGTCA AAGTCTGATG GACCTTTAGG TTGGGCTGGA 
AGAGTTGCTC CTGAAAAAGG ATTAGAAGAT GCAGTGGCTG TAGCGGCTCA TTTTGATGAC 
ACTTTGTTGG TATGGGGACT GATTGAAGAT GAAAATTATG CCAGAACAAT TGAAGAATCT 
TACCCGCCTG GAACAATTGA TTGGAGAGGC TTCCTTAAAA CAAATGAGTT TCAGGACCAA 
CTTGGTAAGT GTAGGGCTTT AATTAATACT CCAAAATGGA ATGAAGCTTA TGGAAATGTT 
GTTGTAGAGG CTTTGGCTTG TGGTGTTCCA GTGGTTGCCT ATAAACGAGG CGGCCCAGGT 
GAATTAATCC AATCCGGCAG TACAGGCTGG TTAGTCGCTC CTGATGATTT GGATGCCTTA 
ATCTCTGCCA CATATCGAGT AAATGAAATT GATCGACTTA AGTGTAGAAA TTGGGCTATA 
GACTCAGCTT CTTCCAAAGG ATTTGCTAAA CGAATCACCT CTTGGGTCCA GAAAGATATT 
ATGGAATAA

Protein sequence

MTVKALKLLL VSTPIGFLGS GQGGGVELTL ISLVKGLLEL GHEVVLIAPN GSELPKECEG 
VEIRYVSGFD QPSWQHQDYG SPVIIPANGV LPMLWEKALD VGKEDFDAIL NFGYDWLPLW 
LTPHVEPRLF HLISMGAVSK VIKDQIMKLS KTQHSRLAFH THVQASDYEL SDTPTVVGNG 
FDLNQYKFQS KSDGPLGWAG RVAPEKGLED AVAVAAHFDD TLLVWGLIED ENYARTIEES 
YPPGTIDWRG FLKTNEFQDQ LGKCRALINT PKWNEAYGNV VVEALACGVP VVAYKRGGPG 
ELIQSGSTGW LVAPDDLDAL ISATYRVNEI DRLKCRNWAI DSASSKGFAK RITSWVQKDI 
ME