Gene Ndas_3464 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Ndas_3464
Symbol
ID	9247333
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nocardiopsis dassonvillei subsp. dassonvillei DSM 43111
Kingdom	Bacteria
Replicon accession	NC_014210
Strand	-
Start bp	4152904
End bp	4154037
Gene Length	1134 bp
Protein Length	377 aa
Translation table	11
GC content	68%
IMG OID
Product	integrase family protein
Protein accession	YP_003681371
Protein GI	297562397
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	21
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	26
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGCGTAGGC GAGTAGCGAT GGCGGTGGAC GTGCGCACCG AACCACCCAC CCTCGCCGCA 
TGGCTGGGGG AGTGGTTGGC GGGCAGGCCC GATCTGGCCG CGGGTACCCG GGCCTCCTAC 
GCCAGGCACA TCCGCACCTA CCTTTCCCCG CACCTGGGCC GGCTCCGGGT GGACAAGCTC 
CAGGCCCGCC ACGTCGAGAC CATGTTCAAC CTCATTGAGG AGACCAACGC TCACATCCTG 
GAGTGCCGCG AGTCCGACGA TGTGAAGGTG CGGGCCTCGG TCAGGGGGCG CCGGGTGATC 
TCGCTGTCCA CCAAGCACCG GATCCGCGAG ACTCTCCGGA GTGCGTTGTC CGAAGCCGTC 
AGGCGTCCGG ACTTGCCGGT GTCGGTGAAC ATCGCCTCAC ACGTGCGGTT GCCCTCGTGT 
CCGAGGAAGC GTCCGTTGGT GTGGACTTCG GACCGGGTGC GGCAGTGGAA GAAGGACGGG 
ACCGTGCCGG GGGAGGTCAT GGTGTGGGCC CCGGAGCAGA CCCGCGCTTT CCTGGTGCAC 
GCGAGGAGGT ATCCGTGGCT GTACCCGATG TTCCACCTGG TCGCGGTCAA GGGCCTGCGG 
CGAGGAGAAG CGGTCGGCCT GCCCTGGTCC AACACGAGGT TGACCGACGG GCAGATCGAC 
ATCCGCGTCC AGGTCGTACA ACTCGCGTGG GAGACGATCA CCTCCACCCC GAAAAGCGCG 
GCCGGGCAGC GCACCATCAC ATTGGACACC GACACCATCA AAGTGCTGCG GGCCTGGAAG 
CGGTTCCAGA ACGAAGCCCG CCTCAAAGCC GGAACAGCGT GGACGGACAC CGGTTTGGCC 
TTCACCAAGG AGAACGGCGC AGGATGGCAC CCAGGTCAGG TCAGTGACTG GTTCCTGCGC 
ATCGCCAGGG CAGCGGGGCT GCCGCCGATC ACGTTGCACG GGCTCCGCCA CGGAGCCGCC 
TCGCTGGCGT TGGCCGCGGG AACGGACGTG AAGATCGTCT CCAGCGAGCT CGGGCACGCG 
ACCACGCACT TCACCCAGGA CACCTACCAG TCGGTGTTCC CCGACGTGGC CAAAGCGGCG 
GCCGAGGCCA CCGCCGCGCT GCTACGAGGC CCGTCTCCGG TGAGGGCCGG GTAG

Protein sequence

MRRRVAMAVD VRTEPPTLAA WLGEWLAGRP DLAAGTRASY ARHIRTYLSP HLGRLRVDKL 
QARHVETMFN LIEETNAHIL ECRESDDVKV RASVRGRRVI SLSTKHRIRE TLRSALSEAV 
RRPDLPVSVN IASHVRLPSC PRKRPLVWTS DRVRQWKKDG TVPGEVMVWA PEQTRAFLVH 
ARRYPWLYPM FHLVAVKGLR RGEAVGLPWS NTRLTDGQID IRVQVVQLAW ETITSTPKSA 
AGQRTITLDT DTIKVLRAWK RFQNEARLKA GTAWTDTGLA FTKENGAGWH PGQVSDWFLR 
IARAAGLPPI TLHGLRHGAA SLALAAGTDV KIVSSELGHA TTHFTQDTYQ SVFPDVAKAA 
AEATAALLRG PSPVRAG