Gene Mlg_2604 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Mlg_2604
Symbol
ID	4269237
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Alkalilimnicola ehrlichii MLHE-1
Kingdom	Bacteria
Replicon accession	NC_008340
Strand	-
Start bp	2952736
End bp	2953860
Gene Length	1125 bp
Protein Length	374 aa
Translation table	11
GC content	66%
IMG OID	638127363
Product	2-methylcitrate synthase
Protein accession	YP_743434
Protein GI	114321751
COG category	[C] Energy production and conversion
COG ID	[COG0372] Citrate synthase
TIGRFAM ID	[TIGR01800] 2-methylcitrate synthase/citrate synthase II

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.121252
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	20
Fosmid unclonability p-value	0.000290432
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGAGCGATA AGAAACTGGG CGGTGCCGGC CTGCGCGGCC AGTCCGCTGG CCAGACCGCG 
CTGTGTACCG TGGGCAAGGG CTCCGGCCTG ACCTACCGCG GCTACGATGT CCGCGAACTG 
GCCGAAGGCG CCACCTTCGA AGAGGTGGCC TACCTGCTGT TGAAGGGTGA TCTGCCCACC 
AAGGCGGAGC TTGCGGCTTA CACCGAGAAA CTGAAGGGCA TGCGCGATCT GCCCGATGCG 
CTGAAGGCCG TGCTCGAGCA GATCCCGGCC GACGCCCACC CCATGGACGT AATGCGCACC 
GGCGCCTCCA TGCTGGGTAA CCTGGAGACC GAGCAGAGCT TCGATGAGCA GCAGGAGGCC 
ACCGACCGCC TGCTGGCCGT GCTGCCCGGG ATCATCACCT ACTGGTACCG CTACAGCCAC 
GACGGCGTGC GCATCGACAC GGCCACCGAC GATGACTCCA TCGGTGCGCA TTTCCTGCAC 
CTGCTGCGGG ACGAGAAGCC CAACAGCCTG CACGAGAAGG TGATGCACGC CTCGCTGATC 
CTCTATGCGG AGCACGAGTT CAACGCCTCC ACCTTCACCG CCCGGGTCTG CGCCTCCACC 
CTGTCCGACA TCCACTCCTG CGTCACCGGC GCCATCGGCT CCCTGCGCGG CCCGCTGCAT 
GGCGGCGCCA ACGAGGCGGC CATGGCCATG ATCGAGCAGT GGAACAGCCC GGACGAGGCC 
GAGCGCGAGC TCAAGGGCAT GCTCGAGCGC AAGGAGAAGG TGATGGGCTT CGGCCACGCC 
ATCTACCGCG TCTCCGACCC TCGCAACGAG ATCATCAAGG CCTGGTCCAA GAAGCTGGCC 
GACGAGGTGG GCGACACCGT GCTCTACCCG GTCTCCGAGC GGGTGGAGCA GGTGATGTGG 
GACGAGAAGA AGCTCTTCCC CAACGCCGAT TTCTACCACG CCTCCGCCTA CCACTTCATG 
GGCATCCCCA CCAAGCTGTT CACCCCCATC TTCGTGATGT CGCGGGTCAC CGGCTGGTGT 
GCCCACGTTT TCGAGCAGCG GGCCAACAAC CGCATCATCC GCCCGAGCGC GGACTACACC 
GGCCCCGAGG AGCGGCCCTT CACCCCCATC GATCAACGGG GCTGA

Protein sequence

MSDKKLGGAG LRGQSAGQTA LCTVGKGSGL TYRGYDVREL AEGATFEEVA YLLLKGDLPT 
KAELAAYTEK LKGMRDLPDA LKAVLEQIPA DAHPMDVMRT GASMLGNLET EQSFDEQQEA 
TDRLLAVLPG IITYWYRYSH DGVRIDTATD DDSIGAHFLH LLRDEKPNSL HEKVMHASLI 
LYAEHEFNAS TFTARVCAST LSDIHSCVTG AIGSLRGPLH GGANEAAMAM IEQWNSPDEA 
ERELKGMLER KEKVMGFGHA IYRVSDPRNE IIKAWSKKLA DEVGDTVLYP VSERVEQVMW 
DEKKLFPNAD FYHASAYHFM GIPTKLFTPI FVMSRVTGWC AHVFEQRANN RIIRPSADYT 
GPEERPFTPI DQRG