Gene BTH_II0452 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	BTH_II0452
Symbol
ID	3845293
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Burkholderia thailandensis E264
Kingdom	Bacteria
Replicon accession	NC_007650
Strand	+
Start bp	539936
End bp	541078
Gene Length	1143 bp
Protein Length	380 aa
Translation table	11
GC content	66%
IMG OID	637837757
Product	sulfotransferase domain-containing protein
Protein accession	YP_438652
Protein GI	83716768
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	0.279842
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGACGCATG CAGCAACCAG CGGCGCGACC GCCGCCGCCC GTCCCCGTCC CGTGCTGATG 
ATTCCGCTGA GGCGCTGCGG CAGTCACGCG CTGCGGCTGC GGCTGAATCT CAATTCGCAG 
TTCTATTCGC CGTATCCGCT GCATGTCGTC GACTTCATGC CGCTGTTGCC GCTGTACGGC 
GATCTCGCCG ACGACCGCGC GTACTTCCGG CTCGTCGCCG ACGTCGTCGG CCTGCAGGCG 
GCGAGCATGG TCAAGTGGCC CGGCGTAGCG TTCGATCCGG TCGAGATTTT CGACGCGGTC 
CGGCACGCGC CGCGCAGCGT TCACCGCATC GTCTGGGAGC TGCTGTTGCG CGCGGGCGAG 
CACGAGGGCG CGCGCGTCGT GATGGACAAG TCGCTCGACA GCGTGCACTA CGCCGACGAA 
CTGATGGCAT TGTTTCCGGA CATGCTGTTT CTGAACGTCG TGCGCGATCC GCGCGCGCAG 
GTTGCGTCGA TGAACCGCGC GATCATTCAT GATTTCGACA CGCTGCTCAA CGCGCGCACG 
TGGGTCGCCG CGCATCGCGC GGCCGACGCC GTGATCGCGC GCCATCCGCA GCGCGTGCTG 
ACGATCCGCT ATGAAGACTT CCTGTCGGAT CAGGCGGGCA CGCTGCAGCG CATATGCGCA 
TTCTTCGGCA TCGATTTCCT GCCGAGGATG CTCGACGTCG CGAATTCGCA CGAGGCGCTG 
CGCATCTCGC GCATGTCCGC GTTGTGGGCG TCGAACTGTT TCGCGCCGAT CGCGGCGAAC 
GCGGACAAGT TCAAGCAGCA ACTGTCGATC GCCGAAATCG CGACGATCGA AACGCTCACG 
CATGAATACA TGCAACGCTA CGGCTATCAG CGGATGACCG ACGCGAGCGC GCCGCCCGAT 
GCATTCGCGG CCGCCGCCGC GCGCCGCCGC TCCGATGCGC GGCGGCGGCA CGCGTGGCGC 
GAGCTCGAGC AATCGAATTT TCGCGATTTC GTGCTGCGCC GGCATCGCGC CGATTATCTG 
GAGGCGGTGC GCGCCCGATT GCAGCGGCAC GCGGGCACGC ACCTGGATTC GGACGGCAAT 
TCGCACGCCG GCGCACCCGG GCGGCTCGAT ACGCTGACCG CGGCATTCGA CGTAACCGAC 
TGA

Protein sequence

MTHAATSGAT AAARPRPVLM IPLRRCGSHA LRLRLNLNSQ FYSPYPLHVV DFMPLLPLYG 
DLADDRAYFR LVADVVGLQA ASMVKWPGVA FDPVEIFDAV RHAPRSVHRI VWELLLRAGE 
HEGARVVMDK SLDSVHYADE LMALFPDMLF LNVVRDPRAQ VASMNRAIIH DFDTLLNART 
WVAAHRAADA VIARHPQRVL TIRYEDFLSD QAGTLQRICA FFGIDFLPRM LDVANSHEAL 
RISRMSALWA SNCFAPIAAN ADKFKQQLSI AEIATIETLT HEYMQRYGYQ RMTDASAPPD 
AFAAAAARRR SDARRRHAWR ELEQSNFRDF VLRRHRADYL EAVRARLQRH AGTHLDSDGN 
SHAGAPGRLD TLTAAFDVTD