Gene BURPS1106A_A2688 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	BURPS1106A_A2688
Symbol
ID	4904956
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Burkholderia pseudomallei 1106a
Kingdom	Bacteria
Replicon accession	NC_009078
Strand	+
Start bp	2626173
End bp	2627501
Gene Length	1329 bp
Protein Length	442 aa
Translation table	11
GC content	69%
IMG OID	640145790
Product	putative cellulase
Protein accession	YP_001076717
Protein GI	126457279
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	13
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAAGCGCT CCACGCCCAA CCCGCGCCGC CGGCTGCTCG TCGCGCTCGC GGGCACGATG 
CTCACCGTGC CCGGCCTGCC GCGCGCGGCC ACGCGCATCG TGCTCGACGC CGCCCGCACG 
AACGCCGACG CGACGCGCGG CTATATCGAC TTGCCCGGCT TCGCCGCGTC GCGCAAGAAC 
ACCGGCATCG CCGTGCATGC GATCGACGAC ACGTCACTGC TCGATGCGGT GAAGGACGCC 
GGCTTCTCGT TCGTGCGCGC GGACCTGTTC TGGGAAGCAG TCGACACGCC GCACGGCTGG 
GATTTCTCAC GGTACGACAC GCTCGTCGCC GAGCTGTCCG AGCGCGGGCT CGGCGCGCTG 
TTCATCCTCG GCGGCATCCA TCGCGTGCAC AGCCCGAACC GGCCGCCCAC GACGCCCGCG 
CAGCTCGCCG CGTTCCGCCG CTATGTGTTC AACGCCGCGC AGCGCTACAA GGGCAAGCCG 
GTGCGCTTCG AGGTATGGAA CGAGCAGGAC CACAAGACCT ACTGGCACGG CGAGCCGTCG 
CCCGTCGCGT ACCGGAACGT GCTGAAGCTC GCGGTGCAGG CGGTGAAGGC CGCGGATCCC 
GACGCGATCG TCGCGACGGG CGGCGTGCAG CAGGTCAACC GCACCTTCAT CCGCGCGGTC 
GGCGACATCG CCAGCCCGGC GCAGCCCGCG CCCGACGCGG TCAGCGTGCA CCCGTACCGG 
CAAACCGAGC CGGAAACGGT GTTCGCCGAC TACGCGGCGC TGCGCCGTGA CCTGTCGTCT 
TACCGCAGGC CGCCGCAGAT CTGGGCGACC GAATGGTCGT ACCCGAGCTA CGGCTACAAC 
TACGTGGCCG ACATCGGCGA CGGCCATTCG AGCGTCGCGC GCGCGCGCCA GGCGAACTAC 
GCGGTGCGGC TGCTGCTCGC GAACTGGATT TCGCAGATCG GGCTCACGTC GTACTACGAC 
ATTCGCGACG ACGGCCGCGA CCGCACGAAC ATGGAGCACA ACTTCGGACT CCTCGATGCG 
GACGACGCGC CGCTGCCCGC GTACATCGCG GTTCGGCGGC TGTTCGCGTT CACCGCGGAT 
GCCGTGCGCG CCCGGTATTT TCTGGATCCG GACGCGCGCT ACGTGGTGCT GAAGCTGAGC 
GCCGCGCGTG CAACGAAATA CGCGCTCTGG TGCTATGGCG ACGGCAATGC GATCAGTGTC 
GATCTGTCGC GGCTGCCCGC CGGCGCCACG GTGACGAACA TGTACGGCGC CGCGCTCGAC 
GCCGGCAACC GCAGGCGGCT CGACGTGCCG GAGGCACGCG GGCCGGTATT CATCACGATC 
GAAGCATGA

Protein sequence

MKRSTPNPRR RLLVALAGTM LTVPGLPRAA TRIVLDAART NADATRGYID LPGFAASRKN 
TGIAVHAIDD TSLLDAVKDA GFSFVRADLF WEAVDTPHGW DFSRYDTLVA ELSERGLGAL 
FILGGIHRVH SPNRPPTTPA QLAAFRRYVF NAAQRYKGKP VRFEVWNEQD HKTYWHGEPS 
PVAYRNVLKL AVQAVKAADP DAIVATGGVQ QVNRTFIRAV GDIASPAQPA PDAVSVHPYR 
QTEPETVFAD YAALRRDLSS YRRPPQIWAT EWSYPSYGYN YVADIGDGHS SVARARQANY 
AVRLLLANWI SQIGLTSYYD IRDDGRDRTN MEHNFGLLDA DDAPLPAYIA VRRLFAFTAD 
AVRARYFLDP DARYVVLKLS AARATKYALW CYGDGNAISV DLSRLPAGAT VTNMYGAALD 
AGNRRRLDVP EARGPVFITI EA