Gene P9211_09751 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	P9211_09751
Symbol	leuB
ID	5730573
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. MIT 9211
Kingdom	Bacteria
Replicon accession	NC_009976
Strand	+
Start bp	867003
End bp	868085
Gene Length	1083 bp
Protein Length	360 aa
Translation table	11
GC content	38%
IMG OID	641285342
Product	3-isopropylmalate dehydrogenase
Protein accession	YP_001550860
Protein GI	159903516
COG category	[C] Energy production and conversion [E] Amino acid transport and metabolism
COG ID	[COG0473] Isocitrate/isopropylmalate dehydrogenase
TIGRFAM ID	[TIGR00169] 3-isopropylmalate dehydrogenase

Plasmid Coverage information

Num covering plasmid clones	14
Plasmid unclonability p-value	0.945321
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	9
Fosmid unclonability p-value	0.00220334
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGAAAACAT ACAATGTTGT TTTATTACCA GGCGACGGAA TAGGTCCAGA AATAATGGAT 
GTGGCAACAA AAACAATAGA TTATGTAGCT CAGAAATATA ACTTTGGAAT TGAATATGAA 
CAAAAACTAA TAGGTGGTTC AGCTATAGAT AAATATAATG ATCCGTTGCC AGAAGAAACT 
TTAAAAGCCT GTAAGAGCAG TGACGCTGTC TTACTTTCAG CAATAGGCAG CCCAAAATAT 
GATGCTCTAC CCAGAGAAAA AAGGCCTGAG TCTGGTTTAC TTAATTTAAG ATCAGGTCTA 
GGATTATTTG CAAATATTAG GCCAGTAAAA GTCTGGCCAG CACTAATTAG TGAAAGTTCT 
CTAAAGCAGG AGATAGTCCA AAATGTTGAT CTTGTTGTGG TAAGAGAACT AACAGGCGGC 
ATCTACTTTG GGCAACCAAA AGGAAGATTA CAAAGTGAGA ATGGTGAGAG AGCTTTTAAT 
ACTATGACCT ACTCAACAAT GGAAATAGAT AGGATTGCCA GAGTTGCATT TGAACTTGCT 
ACCGATAGAA AAAAGAAACT ATGTTCTATA GATAAAGCCA ATGTTTTAGA TGTAAGCCAA 
TTATGGAGAG AAAGAGTAAT AGAACTAAGC TACAACTTTC CAAAAGTTGA ATTAAATCAT 
TTATATGTAG ACAATGCAGC AATGCAACTT ATAAGACAAC CAGACCAATT TGATGTAATT 
CTAACTGGCA ATCTGTTTGG AGATATTATT AGTGATGAAG CAGCTATGTT GACTGGTTCA 
ATTGGAATGC TTCCTTCCGC ATCATTACGA CTTGAAGGTC CTGGACTTTT TGAACCAGTT 
CATGGATCAG CTCCAGATAT AGCAAATAAG GATATCGCCA ACCCAATGGC CATGGTCCTT 
TCAGCAGCAA TGATGTTAAG GGTTGGTCTA AAAGAGAACA ACGCAGCTGA TGACCTAGAG 
AATGCGATAG ATAAGGTCCT TAAAGATGGT TATAGAACAT CAGATCTTAT GACTAATGGC 
AAAAAGGTGC TTGGATGCAG GGAAATGGGG GAGCAAATTC TTATGAGTCT TGCAGCTGCA 
TAA

Protein sequence

MKTYNVVLLP GDGIGPEIMD VATKTIDYVA QKYNFGIEYE QKLIGGSAID KYNDPLPEET 
LKACKSSDAV LLSAIGSPKY DALPREKRPE SGLLNLRSGL GLFANIRPVK VWPALISESS 
LKQEIVQNVD LVVVRELTGG IYFGQPKGRL QSENGERAFN TMTYSTMEID RIARVAFELA 
TDRKKKLCSI DKANVLDVSQ LWRERVIELS YNFPKVELNH LYVDNAAMQL IRQPDQFDVI 
LTGNLFGDII SDEAAMLTGS IGMLPSASLR LEGPGLFEPV HGSAPDIANK DIANPMAMVL 
SAAMMLRVGL KENNAADDLE NAIDKVLKDG YRTSDLMTNG KKVLGCREMG EQILMSLAAA