Gene Sare_4846 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Sare_4846
Symbol
ID	5707625
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Salinispora arenicola CNS-205
Kingdom	Bacteria
Replicon accession	NC_009953
Strand	-
Start bp	5502127
End bp	5503167
Gene Length	1041 bp
Protein Length	346 aa
Translation table	11
GC content	70%
IMG OID	641274242
Product	alcohol dehydrogenase
Protein accession	YP_001539587
Protein GI	159040334
COG category	[E] Amino acid transport and metabolism [R] General function prediction only
COG ID	[COG1063] Threonine dehydrogenase and related Zn-dependent dehydrogenases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	17
Plasmid unclonability p-value	0.475925
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	7
Fosmid unclonability p-value	0.0130408
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAGGTCG TACGCTTCCA CGCTCCCGGT GACGTCCGGA TCGAGGACGC CCCCGAGCCC 
ACTCCCGGGC GGGGAGAGGT GAAGCTTCGC GTCCGTAACT GTTCCACCTG CGGGACCGAT 
GTGAAGATCT CCCGGTTCGG CCACCATCAC ATCGTGCCGC CCCGCGTGAT GGGGCACGAG 
ATCGCCGGCG AGGTGGTGGA GGTCGGCGCC GCAGTGGACG GCTGGTCGCC CGGCGACCGG 
GTCCAGGTCA TCGCCGCCAT TCCCTGCGGG CAGTGCGGCG AGTGCCAGCA GGGTCGCCGG 
ACGGTCTGCC CCAACCAGGA GTCGATGGGC TACCACTACG ACGGTGGGTT CGCCGAGTAT 
CTCGTGGTGC CGAGCACAGT GCTCGCCGTC GACGGGCTCA ACCGTATCCC GGACGGGGTC 
AGCTACGCCG AAGCGTCGGT CGCCGAACCG CTGGCGTGCG TCCTCAACGG GCAGAACCTC 
GCTCAGGTCG GTGCCGGGGA CGACGTGGTG GTGATCGGTT CCGGCCCGAT CGGCTGTCTG 
CACGTACGGC TGGCCCGGGC CCGGGGTGCC AGGAGTGTGG TCCTGGTCGA CCTCAACCAG 
GACCGGCTCA GTCAGGCCGC GGCGCTGGTC GCGCCGGACG CGACGATCTG CGCGGCCGAC 
ACCGACCCGG TCGACGCCGT GCTCAAGTTC ACCAACGGGC GCGGCGCCGA CGTCATCATC 
ACCGCCGCGG CCTCCGGCGC CGCTCAGGAA CAGGCCGTTC AGATGGCCGC CCGGCAGGGC 
CGGATCAGCC TCTTCGGTGG GCTGCCGAAG GACCGGCCAG TCATCGGCCT GGACGCCAAC 
CTGGTGCACT ACCGGGAGCT GACACTGGTC GGCGCGAACG GGTCGAGCCC CGCCCACAAC 
GCCGAGGCGC TGCGCCTCAT CGCCTCCGGT GAGGTGCCGG TCGCCGACCT CATCACCCAC 
CGGTTGCCGC TGGACGGCGC CATCGACGCC TTCGAACTGG TCGCCACCGG TGAGGCGATC 
AAGGTGACGA TCGAGCCCTG A

Protein sequence

MKVVRFHAPG DVRIEDAPEP TPGRGEVKLR VRNCSTCGTD VKISRFGHHH IVPPRVMGHE 
IAGEVVEVGA AVDGWSPGDR VQVIAAIPCG QCGECQQGRR TVCPNQESMG YHYDGGFAEY 
LVVPSTVLAV DGLNRIPDGV SYAEASVAEP LACVLNGQNL AQVGAGDDVV VIGSGPIGCL 
HVRLARARGA RSVVLVDLNQ DRLSQAAALV APDATICAAD TDPVDAVLKF TNGRGADVII 
TAAASGAAQE QAVQMAARQG RISLFGGLPK DRPVIGLDAN LVHYRELTLV GANGSSPAHN 
AEALRLIASG EVPVADLITH RLPLDGAIDA FELVATGEAI KVTIEP