Gene Ndas_0621 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Ndas_0621
Symbol
ID	9244463
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nocardiopsis dassonvillei subsp. dassonvillei DSM 43111
Kingdom	Bacteria
Replicon accession	NC_014210
Strand	-
Start bp	761922
End bp	763079
Gene Length	1158 bp
Protein Length	385 aa
Translation table	11
GC content	78%
IMG OID
Product	Mandelate racemase/muconate lactonizing protein
Protein accession	YP_003678574
Protein GI	297559600
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	21
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	18
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGGCACACA CCGGCTCGGC GACCGCGACC CGGATCGTCG AACTCGAGCT GATCCGGCTG 
CGGCCCCCGG CCGGCGGCCG AGGCCCCGGC GCCGACGGCC CCGTCCTGGT CCGGGTGGCC 
GACGGTGACG GCGTGAGCGG CTGGGGAGAA CTGCCGGAGG CCAGCGGAGC CCAGTGGGAC 
GCCCTGACCG GCGCCTTCGC CCCCGCCCTG CTCGGCCACT CCTGGCGGCG TCCGACCGAG 
GCGGGCGAGG CCTGGGCCGA CCTGTCCTGG GACCCGGCCG TGGCCGGGGC CCTGGACACC 
GCGTGCTGGG ACCTGTGGAG CCGCCAGCGC GACACCCCGC TCTCGCATGC CCTGGGCGGA 
GAGCGCACCG CGCTCACCGC CGGGGTGACG CTGCCCCGCC AGGTGGCCGT GGAGTCGGTG 
GTCACGGAGG TGAACCGCCA GGTGGGGGCG GGGTTCCGGC GGATCCGGCT GGAGATCGCC 
CCGGGCTGGG ACGCGGACGT GGTGCGCGCG GTGCAGTCGA GCTTCCCGTT CCTGGTCCTC 
CAGGCGGACG CGGGCTGCCG CTACACCGAG TCCCCCGCCG ACCTGGACGC GCTGCGCGTC 
CTGGACGGGC TCGGTCTGCT CGCGGTCGAG GACCCCTTCG CCCCGGGCGA TCTGGCCGCG 
CACGCCCGGC TGTCCGCCGA ACTGCGCACG CCGGTGGCGC TGGGCCGGTC CCTGGAGTCG 
GTGGACGACC TCACCGAGGC GATCCGGGCC GAGGCGGGCG GCGCGGTGAA CGTGGACCCG 
ACCCGCATGG GCGGCCTCAC GGCGGCCCGC CGCGCGGTGG ACCGCGCCGT GGACGCTGGC 
TGGCGGGTGT GGTGCGGTTC GTCGGCGGTG ACGGGGATCG GCCGCGCCGC GACGGTCGCG 
CTGGGCTCGC TGTCGGGGGC CTCGCTGCCG GTGGAGATGC CCGGAGCCGG GAGCCGGGGC 
CGCGACCTGA TGCTCCCGCC CGTACGCGCG CACGACGGGG TGGTGCCGGT TCCGCTGACC 
GAGAGCGGCC TGGGGCACAC GGTGGACCGC GCGGCGGTGG CCGAGCGCAC CGCCCGGGCC 
CTGGTCGTGG ACGCCGACGG CCCGCGCGAG GCCCGCGTGG AGCGCGGGCG CGCCAACGGC 
GCCCGACGGC GGCGCTGA

Protein sequence

MAHTGSATAT RIVELELIRL RPPAGGRGPG ADGPVLVRVA DGDGVSGWGE LPEASGAQWD 
ALTGAFAPAL LGHSWRRPTE AGEAWADLSW DPAVAGALDT ACWDLWSRQR DTPLSHALGG 
ERTALTAGVT LPRQVAVESV VTEVNRQVGA GFRRIRLEIA PGWDADVVRA VQSSFPFLVL 
QADAGCRYTE SPADLDALRV LDGLGLLAVE DPFAPGDLAA HARLSAELRT PVALGRSLES 
VDDLTEAIRA EAGGAVNVDP TRMGGLTAAR RAVDRAVDAG WRVWCGSSAV TGIGRAATVA 
LGSLSGASLP VEMPGAGSRG RDLMLPPVRA HDGVVPVPLT ESGLGHTVDR AAVAERTARA 
LVVDADGPRE ARVERGRANG ARRRR