Gene Franean1_1497 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Franean1_1497
Symbol
ID	5669901
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Frankia sp. EAN1pec
Kingdom	Bacteria
Replicon accession	NC_009921
Strand	-
Start bp	1798672
End bp	1799706
Gene Length	1035 bp
Protein Length	344 aa
Translation table	11
GC content	70%
IMG OID	641240417
Product	alcohol dehydrogenase
Protein accession	YP_001505843
Protein GI	158313335
COG category	[E] Amino acid transport and metabolism [R] General function prediction only
COG ID	[COG1063] Threonine dehydrogenase and related Zn-dependent dehydrogenases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	8
Fosmid unclonability p-value	0.0703519
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGCCACGTG CGATCGTGTT CAAGGGTGAC GAGACCTGGG AGCTTCGAGA GGTCCCGAAG 
CCGGCGTTAA GGCCGGGATG CGCGGTGCTG CGGGTCGAGG CGGTCGGCAT CTGTCACAGC 
GATGTCGACC AGTTCAGGGG GCACGCGCCG GTGCCGTCGG GTGGGGTGTT CCCCGCCGTT 
CCCGGTCACG AGATCGTCGG TCGGATCGAA GAGATCACCC CGGAGGCGCA GGAAGAGTTC 
GGCGTCCGGG AAGGCGACCG GGTCGGGGTC CGTTCAGTGG TGCGCGGGCC TACCGGGAGC 
AGGGTGTACG GGTTCGACTT TCCTCTCGAT GAGGGCTCCG GGCTCTTCGG CGGCTATGCC 
GACTACATGG AGCTCGTGCC CGGCTCGGAG GTCCACCGGC TTCGCGACGA CCTGCCGGCG 
ACCGAGTTGA CGGTCTACGA GTGCCTGACC AACGCGATCA CGTGGATCCG GCCGGTGCAG 
CCCGGCCAGA CTCTGGTGGT GGAGGGCCCT GGCCACATGG GGCTGGCCGC GATCGTCGGC 
GCCCGTGCGG CCGGCGCTGG AACGATCATC GTGACCGGGC TGGCCGGCGA CCGGCTCCGA 
CTCGACACCG CGCTCAAGGT CGGCGCGGAT CACGCCATCG ATGTGGAGAA CGAGGACGTG 
GTCGCCCGCG TCGCCGAGAT CACCGGCGGA GCGATGGCGG ACGTCGTCCT CGACGCCGCG 
TCAGGCAACC CGGTGACGCT GAAGACCGCC ATGCGGATCG CCCGGACCGG CGCCACGATC 
GTCGCGGCCG GGATGAAGGA CCGACTTCTC GACGGATTCG ACGTCAGTCA GATCCCGCTG 
CGTCATCTGA CCATCGCGCC CGGCGGCGGC CTCGACCTGG CCGGCGCCTG CACAATGATC 
AACGAGGGGA CGGTGCCCAC CGGCGTGCTC CACGGCGCGT CGTTCCCGCT GGAACAGTTC 
GAAGACGCGC TGGCGCTGGC CGATCGACGC GTGCCCGGCC AGGACGCGGT ACGCGTTTCC 
CTCAAGGTGG CCTGA

Protein sequence

MPRAIVFKGD ETWELREVPK PALRPGCAVL RVEAVGICHS DVDQFRGHAP VPSGGVFPAV 
PGHEIVGRIE EITPEAQEEF GVREGDRVGV RSVVRGPTGS RVYGFDFPLD EGSGLFGGYA 
DYMELVPGSE VHRLRDDLPA TELTVYECLT NAITWIRPVQ PGQTLVVEGP GHMGLAAIVG 
ARAAGAGTII VTGLAGDRLR LDTALKVGAD HAIDVENEDV VARVAEITGG AMADVVLDAA 
SGNPVTLKTA MRIARTGATI VAAGMKDRLL DGFDVSQIPL RHLTIAPGGG LDLAGACTMI 
NEGTVPTGVL HGASFPLEQF EDALALADRR VPGQDAVRVS LKVA