Gene BamMC406_4052 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	BamMC406_4052
Symbol
ID	6180941
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Burkholderia ambifaria MC40-6
Kingdom	Bacteria
Replicon accession	NC_010552
Strand	+
Start bp	1075804
End bp	1077366
Gene Length	1563 bp
Protein Length	520 aa
Translation table	11
GC content	64%
IMG OID	641683822
Product	extracellular solute-binding protein
Protein accession	YP_001810733
Protein GI	172063082
COG category	[E] Amino acid transport and metabolism
COG ID	[COG0747] ABC-type dipeptide transport system, periplasmic component
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	0.544759
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	29
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAACAAGC CGCATTCGTT CCCGGTGTTC CGTCCACGCG CACTTTTCGC CGCGGGGGCA 
GGCGCGCTCG CGCTGTCGGT CGCGGCACCC GCGTTCGCGC AACAGAACGT CGTGGTCGCC 
GTGTACTCGA CGTTCACGAC GATGGACCCG TACGACGCGA ACGACACGGT GTCGCAAGCG 
GTCGTCAAGT CGTTCTACGA AGGGCTGTTC GGCTTCGACA AGGACATGAA GCTCGTCAAC 
GTGCTCGCGA CGGGCTATCA GGCGTCGCCC GATGCGAAGG TCTATACGGT CAAGCTGCGC 
GACGGCGTGA AGTTCCAGGA CGGCACCGAC TTCAACGCCG CCGCGGTGAA GGCGAACTTC 
GACCGCGTGA CCGATCCGGC GAACAAGCTG AAGCGTTACG GGCTGTTCCG CGTGATCGAG 
AAGACCGAGG TGGTCGATCC GATGACGGTG AAGTTCACGC TGCGCGAGCC GTTCTCCGCG 
TTCATCAACA CGCTCGCGCA CCCGTCGGCG GTGATGATTT CGCCGGCCGC GCTGAAGAAG 
TGGGGGCGCG ACGTATCGCT GCATCCGGTC GGCACGGGCC CGTTCGAGTT CGTCGAATGG 
AAGCAGACCG ACGACATGAA GGTGAAGAAG TTTGCGGGCT ACTGGAAGAA GGGCTATCCG 
AAGGTCGATT CGATCGACTG GAAGCCGGTG GTCGACAACA ACACGCGCGC CGCGCTGCTC 
AAGACCGGCG AGGCGGATTT CGCGTTCACG ATTCCGTTCG AGCAGGCCGC CGACCTGAAG 
AGCAACCCGA AGGTCGAGCT GATCGAGCGG CCGTCGATCA TCCAGCGCTA CATCTCGCTG 
AACACGCAGA AGAAGCCGTT CGACAATCCG AAGGTGCGTG AGGCGCTGAA CTACGCGGTC 
AACAAGGAAG CGCTGGCGAA GGTCGTGTTC GCCGGCTATG CGACGCCGCA GACGGGAGTC 
GCACCGATCG GCGTCGAATA CGCGACCAAG CTCGGGCCGT GGCCGTACGA TCCGGCGAAG 
GCGCGCGCGT TGCTGAAGGA GGCCGGCTAT CCGAACGGCT TCGAATCGAC GCTCTGGTCC 
GCGTACAACC ATTCGACGGC GCAGAAGCTG ATCCAGTTCG TGCAGCAGCA GCTCGCGCAG 
GTCGGCGTGA AGGTGCAGGT GCAGGCGCTG GAAGCCGGCG AGCGGGTCGC GAAGGTCGAG 
AGCGCGCAGG ATCCGGCCGC GGCGCCGGTG CGGATGTACT ACAGCGGCTG GTCGGCATCG 
ACGGGCGAGG CGAACTGGGC GCTGTCGCCG CTGCTCGCGT CCACGTCGGC GCCGCCGAAG 
CTCTACAACA CGGCGTACTA CAAGAACAGT GCGGTCGACG ATGCGCTCGC GAAGGCGCTC 
GAGACGACCG ACCGTGCGAA GAAGGCCGCC CTGTACGCCG ACGCGCAGAA GCAGGTGTGG 
GCCGACGCGC CGTGGATTTT CCTGGTGCAG GAGAAGATCG TTTATGCGCG TAACAAGCGC 
CTGCACGGCA TGTACGTCAT GCCGGACGGT TCGTTCAACT TCGACGAAAT CTCGGTGAAA 
TGA

Protein sequence

MNKPHSFPVF RPRALFAAGA GALALSVAAP AFAQQNVVVA VYSTFTTMDP YDANDTVSQA 
VVKSFYEGLF GFDKDMKLVN VLATGYQASP DAKVYTVKLR DGVKFQDGTD FNAAAVKANF 
DRVTDPANKL KRYGLFRVIE KTEVVDPMTV KFTLREPFSA FINTLAHPSA VMISPAALKK 
WGRDVSLHPV GTGPFEFVEW KQTDDMKVKK FAGYWKKGYP KVDSIDWKPV VDNNTRAALL 
KTGEADFAFT IPFEQAADLK SNPKVELIER PSIIQRYISL NTQKKPFDNP KVREALNYAV 
NKEALAKVVF AGYATPQTGV APIGVEYATK LGPWPYDPAK ARALLKEAGY PNGFESTLWS 
AYNHSTAQKL IQFVQQQLAQ VGVKVQVQAL EAGERVAKVE SAQDPAAAPV RMYYSGWSAS 
TGEANWALSP LLASTSAPPK LYNTAYYKNS AVDDALAKAL ETTDRAKKAA LYADAQKQVW 
ADAPWIFLVQ EKIVYARNKR LHGMYVMPDG SFNFDEISVK