Gene ECD_01943 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	ECD_01943
Symbol	wzx
ID	0
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Escherichia coli BL21(DE3)
Kingdom	Bacteria
Replicon accession	CP001509
Strand	-
Start bp	2007194
End bp	2008621
Gene Length	1428 bp
Protein Length	475 aa
Translation table	11
GC content	30%
IMG OID
Product	O antigen translocase (Wzx)
Protein accession	ACT43794
Protein GI	253978124
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	14
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

TTGATGAATA ACAAACTAGC CAGGCAAGGA TTATTATGGA GCACAATTGA AAGGCTAGGA 
ACGCAAGCCA TACAATTATT ATTAATGTTG TATTTGGGTA GGGTTCTTGG ACCAAGCTCT 
TTTGGTTATG TTGGTATGCT AACTTTATTT CTATCATTAG CTCAGGTTCT AATTGATAGT 
GGATTTAGTG CAGCATTAAT TAGAAAATCG GAGCGTACTG AAAAAGATTA TTCGACAGTA 
TTTATATTTA ATATTTGTCT ATCAATACTA ATATATATTG TACTTTATTG TTTATCTTCT 
TATATTGCTT TATTCTATCA AATACCTCTG CTGGAATCTT TACTTGATAT TTTAGCATTA 
ACAGTTATAG CAAATGGTCT AACTTTAATC CCCAAAATTC AACTCACTGT AGACGTGAAT 
TTTAAGATCC AAGCTAAAAG TTCACTTATC GCTATTACCA GTAGTAGTGT AATAGCGATA 
ACGTTAGCTG CTTTGGGTTA TGGAGTATGG ACATTGGTTT TCCAATCGTT ATCCTATAGT 
GTCATAAATT GTATTGTACT GAATATTTAT AATCCATGGT ATCCAAAAGA GAAATTTTGC 
TATGAAACAT TCAAAAAGCT ATTTTCATTT AGCAGTAACT TACTAATTGC TGGAGTACTT 
GAAGCTTTTT ATTCAAATAT ATATCAATTA ATTATAGGGA AATTTTTTAC ACCACAGCTT 
GTAGGGCAAT TTACACAGGC TATTCAGATC TCTAGCGTAC CTGCAATGAC ACTTACTAAT 
ATTATTCAGA GAGTAACTTA TCCACTTTTT TGTAATATTT ATAATGGCAA AGGGAAAATA 
GATGATGCTT ATTTAAACAC ACTTAAAATT GCAGGCGTTG TAGTTTTTCC AATTCTATTA 
GGAATAGGTT TAATCTCGAA GCCATTAGTC TCTGTATTAT TAGGAAGTGA GTGGAAATTT 
ACATCTGATA TTCTGTTTCT ACTTTGTATT GCATTTATGA TTTATCCTAT ACATGCAATA 
AATATTAATA TCCTACAGGT TCATGGGCGA AGTGATCTTT TTTTGCGTTT GGAAATACTA 
AAAAAGACAT TGATGACAAT TATTCTTGTC ATTACGATGC AAATAAATAT AAATGCAATG 
GTGATTGGTT TAGTTTTACA CTCATATCTT TCGTGGTTTT TAAATGGATT ATTTAGCCAG 
AAAGTATCAA CGATCACAAT AAGGAAGCAG TTAAAAGAGT TACTACCTAT ATGGTGTCTA 
TGTTTAATTA GTGGGTTAGG TTCTAACTAT ATTATAAATG AAATAAGTAT GGAACCTTTA 
TTAAATATAA TATTTACTAT TTTATTAAAT GCCATTATAT ACATCACACT AATTCGAATT 
ATGTACAAAG AAATATTTAT GACTATTATT TCTCTTATAA AAAAATAA

Protein sequence

MMNNKLARQG LLWSTIERLG TQAIQLLLML YLGRVLGPSS FGYVGMLTLF LSLAQVLIDS 
GFSAALIRKS ERTEKDYSTV FIFNICLSIL IYIVLYCLSS YIALFYQIPL LESLLDILAL 
TVIANGLTLI PKIQLTVDVN FKIQAKSSLI AITSSSVIAI TLAALGYGVW TLVFQSLSYS 
VINCIVLNIY NPWYPKEKFC YETFKKLFSF SSNLLIAGVL EAFYSNIYQL IIGKFFTPQL 
VGQFTQAIQI SSVPAMTLTN IIQRVTYPLF CNIYNGKGKI DDAYLNTLKI AGVVVFPILL 
GIGLISKPLV SVLLGSEWKF TSDILFLLCI AFMIYPIHAI NINILQVHGR SDLFLRLEIL 
KKTLMTIILV ITMQININAM VIGLVLHSYL SWFLNGLFSQ KVSTITIRKQ LKELLPIWCL 
CLISGLGSNY IINEISMEPL LNIIFTILLN AIIYITLIRI MYKEIFMTII SLIKK