Gene Dole_1654 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Dole_1654
Symbol
ID	5694491
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Desulfococcus oleovorans Hxd3
Kingdom	Bacteria
Replicon accession	NC_009943
Strand	-
Start bp	1965543
End bp	1967807
Gene Length	2265 bp
Protein Length	754 aa
Translation table	11
GC content	60%
IMG OID	641264249
Product	O-antigen polymerase
Protein accession	YP_001529535
Protein GI	158521665
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG3307] Lipid A core - O-antigen ligase and related enzymes
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	22
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGCTTTCAA TAAGCCGGTT TCTGTTTTTA GCAACCCTGG CCTTTGCGCC CCTGGCATTC 
GGCAGCGTGG AGCCATGGGC ATTCTTCGTG CTGGTGCTGC TGGTCGGCGC CGCCATCACT 
CTTTTCCTGG CCGACACCCT GCGCCATGCC ACCCCTCTCT ACCGGGTGCC CTGCCTCCTG 
CCCCTGGCCC TGCTGGGCCT TTACATCCTT TTCCAGATCG TTCCCCTGCC CCAGCCCTTC 
CTCTCCCTGG TTTCGCCCAG GGCTGCGGCC CTTCGCCAGG CCACCATCGG TATCCTTCTG 
CCGGACCAGG CCTGGCCCCT TACACTGAAT CTTCACGCCA CCCTGTTCGA GCTCTGCCGC 
TGGCTGTTGT GGGTCGGCTT CTACTGGCTT TCCGTTCAGC TTCTGTCCGA CAAAACCATG 
CTGCGCCGCA CCCTGCTTTT TCTGGCTTTT TTTGGTGGCC TGTTTGCCCT CTCTTCCATT 
CTTCAGAACA TTTTCACCGA AGATCATGCG CTCTGGTTCC GCTACGTTCC TGACAACTCC 
ATGGTGTTTG GGTCCTATGT CTGCCACAAC CACTACGCCG GCCTTATGGC CATGATCTTC 
GGCCCGGTGC TGGCCCTGGT TCTGGCCCAT CGCCCGCCCC GCCAGTTCGG CTCCCCGCGG 
GAAAAAGTAC TGGGTTTTTT TGAAGAAGAA GAGACCCCCC TGTTCATACT GCTGATCGTG 
TCAGCCGCGG TCATTGCCAT GTCAATTTTC GCCAGCCTCT CCAGGGGCGG CATCCTCAGC 
CTGTGCGCGT CCATGCTTTT TTTCGCCCTG GCCCTTTTCG GCAGAGCCTT TCCGGACCGG 
CGCATCAACC GCCGCGCCAG CGCCGTGCTG CTGCTGTGCG CCGTAATCGC GGCCGTCACA 
TGGTTCGGCT GGGAAAGAAT CGACAACCGT TTTGCAAAAA TCTATGCGGC GGATAACTTT 
ACAGACAGCG AGGGCCGGTT CCATTTCTGG GCTGACAGCC TGAAGATGGT ATCCGACTTT 
CCCGCCACCG GCGTGGGGTT CGGGGCCTTC GGTAATGTGA TCCCCGCTTA CCAGAACCGC 
TACCTGGGCC GCATCCTGGA CCATGCCCAC AACGACTACC TGGAGCTGCT GGCAGAGGGC 
GGTATTCCCG GTGTGGTACT GGCCCTGGCG TTTTTTATCT GCCTTTTTAA AACTGTTCGA 
AAAGTCCTGA AAAAACGCAA AGAGCCCTAT ACCATCCTGG TCTGCGCGGG AACCGCCACC 
GGGATCCTGG CCATTCTGCT GCACGGCGTC ACCGACTTCA ACCTGCATAT TCCGGCCAAC 
GCCCTTTATC TGGCCTTTCT CTGCGGTTTA CTGGCAGCCG CGGCCCACAC GCGCCTGCGC 
GACCGGGTAA CTCCCGTCAC CTATCTGCAA GCCCACGCTC CGGGCATTGC CAAAAAAATA 
ACCGTTCCAA TTCTTCTGAT CTGGCTTGCC CTGGCGGGCC TGGCCCTTGG CCGATGGACA 
ATTCCCGCTT TTGATCTCTG GAGCCCCGAT CCTCACATTG CTGCTGGTGA TACGGCCCTG 
GCTGCAGGCC TGCCGTCAAC GGCCCTGGAA AACTACCAGC AGGCCCTGGG TTTTTCCCCG 
ACGCGATCCG CCCTGCTTCA AAAAACCGGC ACAGCCGCCC TGAAGGCCGG CCTGCCCGTC 
TCCCGGGCCG AGGCCCTGAT GGCCGCCGGC GTCACCCTTT TTCCCATGCG GCCCGGCGCT 
TATGGAGCGT ATGCGGGGTT TCTGCTTGAA ACCGATCGAA AAGCAAAAGC CCTGTCCGTG 
ATCCGGTCCG GCCTCGAGGC CCATCCTGCC CAGGCCGACC TGTTTTTTGC CCTCATGGCC 
CATACCGGTC TCTCCCCGGC GGAAATGTTT ACCACCCTGC CCGCCCACTC CCTGGTGCTG 
ACAAAATTTG CAGCCCATGT TCAAGACACC GGTTACGACT TCATGCGAAA AGCCATCCTT 
ACCGCAGCCG TGGAGGCCGC CGATCAGGAA GCTGAACCCG TGCCGTGGGC CTATACCGGC 
CTGGCCCATC TCTACCTGCG GGAAAAGGAC CCTGACCAGG CCATCACCGT TCTGGAGCGT 
GGCGTTGCCC GCCTGCCGGA CAACCCCTAC CTGCTTTACC TGCTGGCCCG GACCTATGAA 
CAGAACCATA TATCCTACAA GGCCCTGGAC CTCTATAAAA AGCTCCAGCT TCTTTCCCCC 
GGCTACCGCG ACACCGAACA ACGCCTCAAA GCCCTTCAGC GGTAG

Protein sequence

MLSISRFLFL ATLAFAPLAF GSVEPWAFFV LVLLVGAAIT LFLADTLRHA TPLYRVPCLL 
PLALLGLYIL FQIVPLPQPF LSLVSPRAAA LRQATIGILL PDQAWPLTLN LHATLFELCR 
WLLWVGFYWL SVQLLSDKTM LRRTLLFLAF FGGLFALSSI LQNIFTEDHA LWFRYVPDNS 
MVFGSYVCHN HYAGLMAMIF GPVLALVLAH RPPRQFGSPR EKVLGFFEEE ETPLFILLIV 
SAAVIAMSIF ASLSRGGILS LCASMLFFAL ALFGRAFPDR RINRRASAVL LLCAVIAAVT 
WFGWERIDNR FAKIYAADNF TDSEGRFHFW ADSLKMVSDF PATGVGFGAF GNVIPAYQNR 
YLGRILDHAH NDYLELLAEG GIPGVVLALA FFICLFKTVR KVLKKRKEPY TILVCAGTAT 
GILAILLHGV TDFNLHIPAN ALYLAFLCGL LAAAAHTRLR DRVTPVTYLQ AHAPGIAKKI 
TVPILLIWLA LAGLALGRWT IPAFDLWSPD PHIAAGDTAL AAGLPSTALE NYQQALGFSP 
TRSALLQKTG TAALKAGLPV SRAEALMAAG VTLFPMRPGA YGAYAGFLLE TDRKAKALSV 
IRSGLEAHPA QADLFFALMA HTGLSPAEMF TTLPAHSLVL TKFAAHVQDT GYDFMRKAIL 
TAAVEAADQE AEPVPWAYTG LAHLYLREKD PDQAITVLER GVARLPDNPY LLYLLARTYE 
QNHISYKALD LYKKLQLLSP GYRDTEQRLK ALQR