Gene Ndas_3104 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Ndas_3104
Symbol
ID	9246960
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nocardiopsis dassonvillei subsp. dassonvillei DSM 43111
Kingdom	Bacteria
Replicon accession	NC_014210
Strand	-
Start bp	3718479
End bp	3719780
Gene Length	1302 bp
Protein Length	433 aa
Translation table	11
GC content	75%
IMG OID
Product	dihydroorotase, multifunctional complex type
Protein accession	YP_003681019
Protein GI	297562045
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	8
Plasmid unclonability p-value	0.0529728
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	27
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCCCGACA CCCACGGACC GCACCTGATC CGCGGCGCCC GCCCCCTCGG CGGCGACCCC 
GTCGACCTGC TCCTGGCCGA CGGCCGGATC GCCGCGACCG GCCGGGACCT GGACGCCCCC 
GAGGGCGCCC GGACCGTCGA CGCCACCGGC CTGATCGCCC TGCCCGGTCT GGTGGACCTG 
CACACCCACC TGCGCGAGCC CGGCCGCGAG GACGCCGAGA CGGTCGCCAG CGGCTCCCGC 
TCCGCCGCCA TGGGCGGCTA CACCGCCGTC CACGCCATGG CCAACACCGA CCCCGTCGCC 
GACACCGCCG GGGTCGTCGA ACAGGTCTGG CGCCTGGGCC GCGAGGCCGG GTACTGCGAC 
GTGCGCCCCG TCGGCGCCGT CACCGTCGGC CTGGCCGGGG AGCGCCTCTC CGAGATCGGC 
GCCATGGCCG ACTCCGCCGC GGGCGTGCGC GTCTTCTCCG ACGACGGCAT CTGCGTCTCC 
GACGCCCTGC TCATGCGCCG CGCCCTGGAG TACGTCAAGG CCTTCGACGG CGTCATCGCC 
CAGCACGCCC AGGAGCCGCG CCTGACCCAG GGCGCCCAGA TGAACGAGGG CTCCGTCTCC 
GACCGCCTCG GCCTGCCCGG CTGGCCCGCG GTCGCCGAGG AGGCGATCAT CGCCCGCGAC 
TGCCTGCTCG CCCAGCACGT GGGCTCGCGC CTGCACGTGT GCCACGTCTC GACCAGGGGC 
TCGGTCGACA TCATCCGCTG GGCCAAGGCC CGCGGCTGCG ACGTCACCGC CGAGGTCACA 
CCCCACCACC TCCTGCTGAC CGAGGAGCTG GTGGAGGGCT ACGATCCCGT CTACAAGGTC 
AACCCGCCCC TGCGCACCGC CGAGGACGTC CAGGCGCTGC GCGAGGGCCT GGCCGACGGC 
ACCATCGACA TCGTCGCCAC CGACCACGCC CCCCATCCCG CGGAGGCCAA GGAGACCGAG 
TGGTCCACCG CCGCCATGGG AATGGTCGGG TTGGAGACGG CGTTGGCGGT CGTGCAGCGC 
ACGATGGTCG ACACCGGCCT GCTGACCTGG GCCGACGTCG CCGACCGCAT GTCCGCGGCA 
CCGGCCCGCA TCGGCCGGGT CCACGACCAC GGGCGTGACC TGGCGGTCGG CCAGCCCGCC 
AACGTGGTCC TGTACGACCC GGCCGCCGCC GTCGACGTGG ACGGCGCGGC CATGGTCAGC 
AAGAGCGGCA ACACCCCCTT CCGGGGCATG ACCCTGCCCG GCCGGGTGCG CGCCACGTTC 
CTGCGCGGCA CCCCGACCGT CCTGGAGGGG AAGATCCAGT GA

Protein sequence

MPDTHGPHLI RGARPLGGDP VDLLLADGRI AATGRDLDAP EGARTVDATG LIALPGLVDL 
HTHLREPGRE DAETVASGSR SAAMGGYTAV HAMANTDPVA DTAGVVEQVW RLGREAGYCD 
VRPVGAVTVG LAGERLSEIG AMADSAAGVR VFSDDGICVS DALLMRRALE YVKAFDGVIA 
QHAQEPRLTQ GAQMNEGSVS DRLGLPGWPA VAEEAIIARD CLLAQHVGSR LHVCHVSTRG 
SVDIIRWAKA RGCDVTAEVT PHHLLLTEEL VEGYDPVYKV NPPLRTAEDV QALREGLADG 
TIDIVATDHA PHPAEAKETE WSTAAMGMVG LETALAVVQR TMVDTGLLTW ADVADRMSAA 
PARIGRVHDH GRDLAVGQPA NVVLYDPAAA VDVDGAAMVS KSGNTPFRGM TLPGRVRATF 
LRGTPTVLEG KIQ