Gene SbBS512_E4331 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	SbBS512_E4331
Symbol
ID	6272778
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Shigella boydii CDC 3083-94
Kingdom	Bacteria
Replicon accession	NC_010658
Strand	+
Start bp	4046835
End bp	4047821
Gene Length	987 bp
Protein Length	328 aa
Translation table	11
GC content	48%
IMG OID	641728139
Product	serine/threonine protein kinase
Protein accession	YP_001882554
Protein GI	187732270
COG category	[R] General function prediction only
COG ID	[COG2334] Putative homoserine kinase type II (protein kinase fold)
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	43
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAACAACA GCGCTTTTAC TTTCCAGACA CTACACCCGG ATACCATCAT GGATGCTCTA 
TTTGAGCAAG GGATCCGGGT GGATTCCGGT CTTACCCCGC TTAACAGCTA TGAAAACCGT 
GTCTATCAAT TTCAGGACGA AGATCGTCGA CGTATTGTCG TCAAATTTTA TCGCCCTGAA 
CGTTGGACAG CCGATCAAAT CCTCGGAGAA CATCAATTTG CGTTGCAGTT GGTAAATGAT 
GAAGTTCCGG TCGCAGCACC TGTGGCCTTT AACGGTCAGA CTTTATTGAA TCATCAGGGA 
TTTTATTTCG CTGTTTTTCC AAGCGTCGGT GGTCGCCAGT TCGAAGCTGA TAATATCGAT 
CAGATGGAAG CGGTTGGGCG TTATTTAGGG CGTATGCACC AGACGGGGCG CAAACAGCTT 
TTTATCCATC GCCCGACCAT CGGTCTGAAT GAATATCTCA TTGAGCCACG CAAGCTGTTT 
GAGGACGCTA CACTGATACC TTCCGGGTTG AAAGCGGCAT TCCTGAAAGC GACAGATGAG 
CTGATCGCCG CCGTTACAGC GCACTGGCGG GAAGATTCCA CCGTTCTGCG CTTACATGGA 
GACTGCCACG CCGGGAATAT TCTCTGGCGC GATGGTCCAA TGTTTGTTGA TCTGGATGAT 
GCACGTAATG GTCCAGCTAT TCAGGATTTG TGGATGTTGC TCAATGGCGA TAAAGCCGAG 
CAGCGGATGC AACTGGAAAC TATTATTGAA GCTTATGAAG AATTTAGCGA GTTCGACACC 
GCTGAAATCG GACTGATTGA ACCTTTACGC GCCATGCGTT TGGTTTATTA TCTTGCCTGG 
CTAATGCGGC GTTGGGCTGA TCCCGCGTTC CCGAAAAATT TCCCGTGGTT AACCGGGGAA 
GATTACTGGC TGCGACAAAC GGCGACTTTT ATAGAACAGG CAAAAGTTCT ACAAGAACCC 
CCTTTACAAT TAACACCTAT GTATTAA

Protein sequence

MNNSAFTFQT LHPDTIMDAL FEQGIRVDSG LTPLNSYENR VYQFQDEDRR RIVVKFYRPE 
RWTADQILGE HQFALQLVND EVPVAAPVAF NGQTLLNHQG FYFAVFPSVG GRQFEADNID 
QMEAVGRYLG RMHQTGRKQL FIHRPTIGLN EYLIEPRKLF EDATLIPSGL KAAFLKATDE 
LIAAVTAHWR EDSTVLRLHG DCHAGNILWR DGPMFVDLDD ARNGPAIQDL WMLLNGDKAE 
QRMQLETIIE AYEEFSEFDT AEIGLIEPLR AMRLVYYLAW LMRRWADPAF PKNFPWLTGE 
DYWLRQTATF IEQAKVLQEP PLQLTPMY