Gene EcSMS35_1696 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	EcSMS35_1696
Symbol
ID	6146311
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Escherichia coli SMS-3-5
Kingdom	Bacteria
Replicon accession	NC_010498
Strand	+
Start bp	1698310
End bp	1699320
Gene Length	1011 bp
Protein Length	336 aa
Translation table	11
GC content	53%
IMG OID	641616572
Product	alcohol dehydrogenase
Protein accession	YP_001743750
Protein GI	170681593
COG category	[R] General function prediction only
COG ID	[COG1064] Zn-dependent alcohol dehydrogenases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	20
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	61
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAGGCTG CAGTTGTTAC GAAGGATCAT CATGTTGACG TTACGGATAA AACACTGCGC 
TCACTGAAAC ATGGCGAAGC CCTGCTGAAA ATGGAGTGTT GTGGTGTATG TCATACCGAT 
CTTCATGTTA AGAATGGCGA TTTTGGTGAC AAAACCGGCG TGATTCTGGG ACACGAAGGT 
ATTGGTGTGG TGGCAGAAGT TGGCCCAGGT GTCACTTCAT TAAAACCAGG CGATCGTGCC 
AGCGTGGCGT GGTTCTATGA AGGATGCGGT CATTGCGAAT ACTGTAACAG TGGTAACGAA 
ACGCTCTGCC GTTCAGTAAA AAATGCCGGA TACAGCGTTG ATGGCGGGAT GGCTGAAGAA 
TGCATCGTGG TCGCCGATTA CGCGGTTAAA GTGCCGGATG GCCTGGACTC GGCGGCGGCC 
AGCAGCATTA CCTGTGCGGG GGTCACCACC TACAAAGCCG TTAAGCTGTC AAAAATTCGT 
CCAGGGCAGT GGATTGCTAT CTACGGTCTT GGCGGTCTGG GTAACCTCGC CCTGCAATAC 
GCGAAGAATG TCTTTAACGC CAAAGTGATC GCCATTGATG TCAATGATGA GCAGTTAAAA 
CTGGCAACCG AAATGGGCGC TGATTTAGCG ATTAACTCAC GCACCGAAGA CGCCGCCAAA 
ATTGTGCAGG AAAAAACCGG TGGCGCTCAC GCTGCGGTGG TGACAGCGGT AGCTAAAGCT 
GCGTTTAACT CGGCAGTTGA TGCTGTCCGT GCAGGCGGGC GTGTTGTGGC AGTCGGTCTG 
CCGCCGGAGT CTATGAGCCT GGATATCCCA CGCCTTGTGC TGGATGGTAT TGAAGTGGTC 
GGTTCGCTGG TCGGCACGCG CCAGGATTTA ACTGAAGCCT TCCAGTTTGC CGCCGAAGGC 
AAAGTGGTAC CGAAGGTCGC CCTGCGTCCG TTAGCGGACA TCAACACAAT CTTTACTGAG 
ATGGAAGAAG GCAAAATCCG TGGCCGTATG GTGATTGATT TCCGCCGCTA A

Protein sequence

MKAAVVTKDH HVDVTDKTLR SLKHGEALLK MECCGVCHTD LHVKNGDFGD KTGVILGHEG 
IGVVAEVGPG VTSLKPGDRA SVAWFYEGCG HCEYCNSGNE TLCRSVKNAG YSVDGGMAEE 
CIVVADYAVK VPDGLDSAAA SSITCAGVTT YKAVKLSKIR PGQWIAIYGL GGLGNLALQY 
AKNVFNAKVI AIDVNDEQLK LATEMGADLA INSRTEDAAK IVQEKTGGAH AAVVTAVAKA 
AFNSAVDAVR AGGRVVAVGL PPESMSLDIP RLVLDGIEVV GSLVGTRQDL TEAFQFAAEG 
KVVPKVALRP LADINTIFTE MEEGKIRGRM VIDFRR