Gene Ndas_4460 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Ndas_4460
Symbol
ID	9248339
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nocardiopsis dassonvillei subsp. dassonvillei DSM 43111
Kingdom	Bacteria
Replicon accession	NC_014210
Strand	+
Start bp	5299850
End bp	5301154
Gene Length	1305 bp
Protein Length	434 aa
Translation table	11
GC content	72%
IMG OID
Product	major facilitator superfamily MFS_1
Protein accession	YP_003682355
Protein GI	297563381
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	21
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	28
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGGCCAATC CGCGCCTCGA CAACACACCT GACAACGGAG ACCACGAGTC TTCGAGCGCC 
CCCAACAACG ACGACTGGCG GAGCAGCTAC CGCGACGTCA TGGCGATCGC CGAGTTCCGG 
TCCGTCTGGC TCGCCCACGC GCTCTCGGTG ATCGGCACGA ACCTGCTGAA CATCGCCACC 
AGCGTGCTCG TCTTCCAGAT CACCGGCTCC GCGCTGGCCG CGGGCGTCAC CCTTGCCCTG 
ACCTTCCTGC CCCCGGTCAT CAGCCCCCTC ATCTCCGGAC TCGCCGACCT CCTGCCGCGC 
CGCCGCGTCA TGATCGCCTG CGACCTCGCG CGCGCGGCCG TGATCGTGCT CATCGGCATC 
CCCGGCATGC CGATCTGGGC CGTCTGGATA CTGCTCTTCT GCTCGGTGGT GCCGTCGGTC 
CCCTTCGCCG CGGCCCGCGC CGCGATGATG GCCGAGATCG TCCAGGGCGA GCGCTACGTC 
GCCAGCACGG CCATCATCCA GCTCACCTCG CAGCTGGGCA TGCTCGCCGG TCTGGTCGCC 
GGCGGCCTGA TCGTCGCCGC CATCGGCCCC AACATCGCCG TGATGTCGAC CGGCGTCCTC 
TTCGTGCTGT CCGCGCTCGT CGTGCTGCTG GGTGTGGCCG CGCGTCCGGC TCCCCGCGGG 
GAGCGGTCGG AACGCCCGGG GTTCGTCGCC ATGACCCGCG ACGGGGCCAA GCTGGTCTTC 
GCCGACCGCA GGCTGCGCAC CCTGGCGCTG CTCGCCTGGC TCGCCGGCCT GTACGGCATC 
CCCTACGGGC TCGCCAACCC GATGGCCGAG GAGATCGGCG CCGGAGCGGC GGCGGCCGGG 
TTCATCATGG CGGGCTCGGC GATCGGCGGG TTCGTCGGCG GGTTCGTCCT GACCCGGTTC 
GTCCCGCCGC CCGTCCGCAT GCGCCTGCTC GGCCCGCTGG CCGTCCTGGC CTCGGCGCCG 
CTGCTGCTGT GGCTGACCGA ACCGCCGCTG TGGCTGATGG TGTCCGCCCT CGCGCTCTGC 
GGCGTCGCGG GCTCCTACCA GTTCGTGGCC AACGCGGCGT TCGTGCTGTG CGTGCCCAAG 
GAGGGCCGCA GTCTGGCCTT CGGGCTGGTC GCGGCCGGGC TCCAGGCCGC CCAGGGCGTG 
GGCATCCTGG TCGCCGGGTT CTTCGCCGAG AAGTTCGGCA CCGGTGTCGT CATCGCCGCG 
GCCGGCGCCC TCGGCGTGGT CTGCGCGCTG CTCCTGGCCC TGCCGTGGTC GCGGATGGCC 
GGCGAGACCA TCGACCGGAT GAACGCGACC GGGGGCGGCG CCTAG

Protein sequence

MANPRLDNTP DNGDHESSSA PNNDDWRSSY RDVMAIAEFR SVWLAHALSV IGTNLLNIAT 
SVLVFQITGS ALAAGVTLAL TFLPPVISPL ISGLADLLPR RRVMIACDLA RAAVIVLIGI 
PGMPIWAVWI LLFCSVVPSV PFAAARAAMM AEIVQGERYV ASTAIIQLTS QLGMLAGLVA 
GGLIVAAIGP NIAVMSTGVL FVLSALVVLL GVAARPAPRG ERSERPGFVA MTRDGAKLVF 
ADRRLRTLAL LAWLAGLYGI PYGLANPMAE EIGAGAAAAG FIMAGSAIGG FVGGFVLTRF 
VPPPVRMRLL GPLAVLASAP LLLWLTEPPL WLMVSALALC GVAGSYQFVA NAAFVLCVPK 
EGRSLAFGLV AAGLQAAQGV GILVAGFFAE KFGTGVVIAA AGALGVVCAL LLALPWSRMA 
GETIDRMNAT GGGA