Gene Saro_3643 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Saro_3643
Symbol
ID	5077791
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Novosphingobium aromaticivorans DSM 12444
Kingdom	Bacteria
Replicon accession	NC_009427
Strand	-
Start bp	271827
End bp	272870
Gene Length	1044 bp
Protein Length	347 aa
Translation table	11
GC content	70%
IMG OID	640481366
Product	alcohol dehydrogenase
Protein accession	YP_001166028
Protein GI	146275868
COG category	[E] Amino acid transport and metabolism [R] General function prediction only
COG ID	[COG1063] Threonine dehydrogenase and related Zn-dependent dehydrogenases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	25
Plasmid unclonability p-value	0.826426
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGGCCGGAA CAGCCAAGAT GCGCCTCGCG CGCGTCCACG GGCCGGGCGA CGTGCGACTG 
GACGAAGTGC CGGTGCCGCA TTGCGGGCCC GGCGAGGCAC TGGTGCAAGT TGCCGCCTGC 
GGGGTCTGCG GAAGCGACCT AGGCTATATC GCGCAGGGCG GACTGGGCGG CGTCGAGCCG 
CTGTCCGCGC CGCTGCCGAT CGGGCACGAA TTTGCCGGAA CCGTCGTTGC GGTGGGCCAA 
TGCGTGACGA GCGTGGCGCC GGGAATGCGC GTCGCGGTGA ACCCGGACCG CGCCTATATC 
GGCGGTGGCG GGCCGGACGG TGCGATGGCG GCCTTCATTC GCGTGGCCGG AGCCGAAATC 
GGCGAAACGC TGTTCCCCCT GCCCGACCAC CTGCCCTTTG CCGAAGCATC GCTGGCCGAA 
CCGCTTTCGG TGGGCCTGCA CGGCCTGCGG GTGGCCGGAG CGAAAACGGA AGACCGGATC 
GCGATCCTGG GCGCGGGCCC CATCGGGCTG TGCGCGCTGG TCATGGCACG ACACCTTGGG 
GCGCGCGACG TGGCCATCTT CGACCGCGTG CCGGAACGGC TGGAGCGTGC CAGGGCGCTC 
GGCGCGGGGC TGGCGGTGGA TGTAACGCAG GAGTCGCTGA CAGAAGCGTT GGCGCGGTTC 
CACGGATCGG GCGAGCGGTT CGGGGCGAAG TTCGTGGGCA CGGACGTGTT CGTCGATTGC 
GCCGGGTCGG CGGCGGCGCT GGAAGAAGTT GTCGCGGTGG CGAAGTACCG CGCGCGCATC 
GCGGTCGTCG CGCTGCACCA CAAGCCACTC GCGCTCGACC TGTGGCGGAT GATGGCTAAC 
GAGATCAGCC TTGCAGGCTC CATCGCCGAT GCGCGCTCCG AAGAGTTCGG CGAGGCAGTG 
GCGATGCTGG CGGCGGGGGG GCAGGCGCTG TCCCCGCTCA TCAGCCACCG CTTCGACTTC 
TCCCGCTTTC ACGAAGCCCT TGCCGTGGCC GCCGACGGCG CACGCGCGGC AAAGGTGATC 
CTGACCTTTC CGGAGGCCGC ATGA

Protein sequence

MAGTAKMRLA RVHGPGDVRL DEVPVPHCGP GEALVQVAAC GVCGSDLGYI AQGGLGGVEP 
LSAPLPIGHE FAGTVVAVGQ CVTSVAPGMR VAVNPDRAYI GGGGPDGAMA AFIRVAGAEI 
GETLFPLPDH LPFAEASLAE PLSVGLHGLR VAGAKTEDRI AILGAGPIGL CALVMARHLG 
ARDVAIFDRV PERLERARAL GAGLAVDVTQ ESLTEALARF HGSGERFGAK FVGTDVFVDC 
AGSAAALEEV VAVAKYRARI AVVALHHKPL ALDLWRMMAN EISLAGSIAD ARSEEFGEAV 
AMLAAGGQAL SPLISHRFDF SRFHEALAVA ADGARAAKVI LTFPEAA