Gene Mlg_1797 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Mlg_1797
Symbol
ID	4268716
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Alkalilimnicola ehrlichii MLHE-1
Kingdom	Bacteria
Replicon accession	NC_008340
Strand	-
Start bp	2051890
End bp	2053017
Gene Length	1128 bp
Protein Length	375 aa
Translation table	11
GC content	46%
IMG OID	638126553
Product	hypothetical protein
Protein accession	YP_742631
Protein GI	114320948
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	52
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCTTGAGG GCTGCTTAAT GTTAAGAAAT GAACTAGAAA CCGCAAAGCG ATCAGTTGTT 
ACCGATAGTT TGCAAATCTC CATTGGGGAG ATCGCTTCCA TGTATGCGGC GGAGGAGCTA 
GATATTATCC CTGATTTTCA GAGATTATTT CGTTGGTCTC CTGAAAAGAA GACGGCTTTT 
ATCGAATCGA TTTTGATTGG AATCCCTGTG CCCCCGGCTT TCGCATATGA AAAGCCAGAT 
GGAACATGGG AGCTGATAGA CGGGTTACAA CGTATCTCCA CAGTGCTCGA GTTCATGGGC 
GTTTTGCGCG AACCAGATAA TCCTGCAGAG AAGATGCCGC CTTCTACTCT GACAACTGCA 
ACCTATCTTC CGTCCTTAGA TGGTGTCGTG TGGCCAACAG AAGGAGGAGA TGGAGGTGCT 
CAAGTTCTTG AAAAATCTCT TCAGCTTTTC TTTCGTCGGT CACGCTTGGA TTTCCAGATA 
CTTAAACACC CAAGTGACGC AAAAACGAAA TTTGATTTGT TTCAGCGATT GAATCGGGGT 
GGCGAGTACG CTAATGAGCA GGAAGTCCGC ACTTGTTCAA TGGTGCTTGG AAATGCAGAT 
GCTACCGCTC GAATAAGGAA TCTGGCAAGA AGCGAAGAAT TTATAAATAT TTTTAAAATT 
ACGGAAGAGC AGAATTTAAA ACAAAAAGAT GTTGAATATG CGGTTCGTGC TATTGTTCAT 
ACAGTCGAAG ATTTTGGCTC AGATGCTGAT GTTCAGGAGT TCCTCGACCG AAGTATTGCG 
CGAATTATCG TGGATCAAGA TCCGAATGAT GTGATCCATA CGGTGGAATG GGCCGTCAAT 
AGCTTGCATA GCTTATTCGG GGGCGATGCC TTGATTCCTC ATGACGAGGC TTATCAAGGA 
ATAGCCAAAA GATTTTCTCT GCGTGCACTG GAAGCGATAT TGGTAGGGGT CGCCAGAAAC 
AAAGAAAAAA TTCAGGACTT GGAAGACCCG GATGGTTTTT TGCGTGAGCG CGTCGATCGG 
TTCTGGCGAG AAAGAGATGT CGCCGAGTTG AGTGCGTCAG GCTTGCGAGG GACTACTCGG 
ATCCAAAGAA CCGTACCATT TGGTGAGAAT TGGTTTTCTC CACAATGA

Protein sequence

MLEGCLMLRN ELETAKRSVV TDSLQISIGE IASMYAAEEL DIIPDFQRLF RWSPEKKTAF 
IESILIGIPV PPAFAYEKPD GTWELIDGLQ RISTVLEFMG VLREPDNPAE KMPPSTLTTA 
TYLPSLDGVV WPTEGGDGGA QVLEKSLQLF FRRSRLDFQI LKHPSDAKTK FDLFQRLNRG 
GEYANEQEVR TCSMVLGNAD ATARIRNLAR SEEFINIFKI TEEQNLKQKD VEYAVRAIVH 
TVEDFGSDAD VQEFLDRSIA RIIVDQDPND VIHTVEWAVN SLHSLFGGDA LIPHDEAYQG 
IAKRFSLRAL EAILVGVARN KEKIQDLEDP DGFLRERVDR FWRERDVAEL SASGLRGTTR 
IQRTVPFGEN WFSPQ