Gene Ndas_4555 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Ndas_4555
Symbol
ID	9248436
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nocardiopsis dassonvillei subsp. dassonvillei DSM 43111
Kingdom	Bacteria
Replicon accession	NC_014210
Strand	-
Start bp	5397189
End bp	5398289
Gene Length	1101 bp
Protein Length	366 aa
Translation table	11
GC content	74%
IMG OID
Product	cytochrome P450
Protein accession	YP_003682448
Protein GI	297563474
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	22
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGGTTGTTC GGGCGCTGAC CGGCCACGAC GTCATCATGG AGGCCCTCGC CCACCCCGGC 
GTGCGCAAGG AGGCGCGGCA CTGGCGGGCG TGGGCGCAGG GCGAGATCCC CATGGACTGG 
CCGCTGATCT CCTGGGTGGC CCCGGACAAC ATGCTCACCG CGGACGGCGA CCGCCACCGG 
CGCCTGCGGA CCCTGGTCTC ACAGGCGTTC ACCCCGCGCC GGGTGGAGGA GCTGCGCCCG 
AGGATCACCG AGATCACCGC CGAACTGCTC GACGGCCTCG CCGCCGCCGG GCCGGGACCG 
GTGGACCTCA AGGCGGCGCT GTCGCTGCCG CTGCCCATGA CGGTCATCTC CGAGCTGTTC 
GGGGTCGGGG CGGAGCACCG CGGCACCCTC CACACCCTGA TGCACCGGGT CTTCGACGCG 
ACCACCACCC CGGAGGTGGC GGCACGGACC AACGCCGACA TGCAGGCCTT CCTGGCGGAG 
CTGGCCGAGC GCAAGTCCCG TGAGCCGGGC GACGACCTCA CCAGCGCGCT GCTCCAGGCG 
CGGGCGGAGG GCGACGAGCG GCTCTCCCAC ACCGAACTGG TGTGGACGCT GATCCTCATG 
ATCGGCGCGG GCTACGAGAC CACGATGAAC CTCATCACCA ACGCCGTGCA CGCGCTGCTC 
ACCCACCGGG ACCAGCTGGA GCTGGTGCGG TCCGGCGGCG CCTTCTGGGC CGACGCGGTC 
GAGGAGACCC TGCGCTGGGA CGCCAGCATC CAGTACCTGC CGCTGCGCTA CACGGCCGAG 
GACGTCACCC TGGCGGGCAC GCGCGTGCCC GCGGGGGAGG CGCTGCTCAT GGGCTTCGGC 
GCGGCGGGGC GCGACCCGGG GCGCCACGGC GAGGACGCGC ACGCCTTCGA CCTGCGGAGG 
GAGCAGCGGG GGCACCTGGC CTTCTCGCAC GGTCCGCACT TCTGCCTGGG CGCGGGGCTG 
GCCCGGCTGG AGGGCGTGAC CGCGCTGGAG GCGCTCTTCA CGCGCTTCCC GGACCTGCGC 
CTGGCCGAGG GGGCGGAGGT GGAGCAGGCC CCGTCCATCG TGGCGAGCGG TCGGGCCGCG 
CTCCCCGTCG TCTGGGGCTG A

Protein sequence

MVVRALTGHD VIMEALAHPG VRKEARHWRA WAQGEIPMDW PLISWVAPDN MLTADGDRHR 
RLRTLVSQAF TPRRVEELRP RITEITAELL DGLAAAGPGP VDLKAALSLP LPMTVISELF 
GVGAEHRGTL HTLMHRVFDA TTTPEVAART NADMQAFLAE LAERKSREPG DDLTSALLQA 
RAEGDERLSH TELVWTLILM IGAGYETTMN LITNAVHALL THRDQLELVR SGGAFWADAV 
EETLRWDASI QYLPLRYTAE DVTLAGTRVP AGEALLMGFG AAGRDPGRHG EDAHAFDLRR 
EQRGHLAFSH GPHFCLGAGL ARLEGVTALE ALFTRFPDLR LAEGAEVEQA PSIVASGRAA 
LPVVWG