Gene Dret_1335 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Dret_1335
Symbol
ID	8419164
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Desulfohalobium retbaense DSM 5692
Kingdom	Bacteria
Replicon accession	NC_013223
Strand	+
Start bp	1560413
End bp	1561402
Gene Length	990 bp
Protein Length	329 aa
Translation table	11
GC content	58%
IMG OID	645037911
Product	aldo/keto reductase
Protein accession	YP_003198201
Protein GI	258405459
COG category	[C] Energy production and conversion
COG ID	[COG0667] Predicted oxidoreductases (related to aryl-alcohol dehydrogenases)
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	24
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	21
Fosmid unclonability p-value	0.546872
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGAATACG TCACGCTCCC GAATTCAGAT CTCACTGTGA GCCGGGTCGC TCTGGGCACC 
TGGGCCATCG GAGGATGGAT GTGGGGCGGA ACCGATGTCG AACAATCAAT CCGGACCATT 
GAAGCCGCCC TGGACCAGGG CATCACCATG ATCGACACCG CCCCGGTCTA CGGTTTCGGA 
CGCTCCGAAG AAATTGTCGG CGAGGCCCTG CGCCGTTCCG GACGGCGCCA GGAGGTCGCT 
CTGGCCACCA AAGTCGCCCT GGAATGGACC GAGGATGGCG CGGTGCGCCG CAATTCGACA 
CCCCAGCGCA TCCGCCAGGA AGTCGAGGAT TCCCTGAAGC GGCTGCAAAC CGACGTCATT 
GATCTCTACC AGATCCATTG GCCGGACAAG CTGGTTCCCT TCGAGGAAAC CGCTGCAGTT 
ATGCAACAGC TCAAAGACGA AGGCAAAATC CGCGCCGTCG GAGTCAGCAA TTATAGTCCT 
GAACAGATGG ACGATTTCCG GCAAAAAGCG GAATTGACCA ATTGCCAGCC GCCCTACAAT 
CTCTTTGAAC GCAAGATCGA GGACGATGTC CTGCCGTATT GTCAAGAAAA TACAATCGCT 
CTGGTCACCT ATGGCGCCCT CTGCCGGGGC CTTTTGAGCG GGCGCATGAG CGCGGACCGA 
ACTTTCACCG GCGACGACCT GCGTAAAGTG GACCCCAAAT TCCAATCCCC CCGTTTCAGC 
CAATATCTGC AAGCTGTTAC GGCCCTGGAC CAATGGGCCA AGGAAAAATA CGACAAACGG 
ATCCTGCACC TGGCTGTGCG CTGGATCCTG GATCAGGGTG TCCATGTCGC CTTGTGGGGG 
GGCAGACGGC CGGAACAGAT GGAACCGCTC CCGGAAATCT TCGGTTGGAC ACTCAAAGAG 
CACGACAAAG AAGATATCGA GACCATTCTC CGCACTCACA TCACTGATCC GGTGGGTCCG 
GAATTCATGG CCCCGCCGCA CCGGCAATAG

Protein sequence

MEYVTLPNSD LTVSRVALGT WAIGGWMWGG TDVEQSIRTI EAALDQGITM IDTAPVYGFG 
RSEEIVGEAL RRSGRRQEVA LATKVALEWT EDGAVRRNST PQRIRQEVED SLKRLQTDVI 
DLYQIHWPDK LVPFEETAAV MQQLKDEGKI RAVGVSNYSP EQMDDFRQKA ELTNCQPPYN 
LFERKIEDDV LPYCQENTIA LVTYGALCRG LLSGRMSADR TFTGDDLRKV DPKFQSPRFS 
QYLQAVTALD QWAKEKYDKR ILHLAVRWIL DQGVHVALWG GRRPEQMEPL PEIFGWTLKE 
HDKEDIETIL RTHITDPVGP EFMAPPHRQ