Gene Caci_2108 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Caci_2108
Symbol
ID	8333453
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Catenulispora acidiphila DSM 44928
Kingdom	Bacteria
Replicon accession	NC_013131
Strand	+
Start bp	2392296
End bp	2393588
Gene Length	1293 bp
Protein Length	430 aa
Translation table	11
GC content	67%
IMG OID	644955258
Product	extracellular solute-binding protein family 1
Protein accession	YP_003112868
Protein GI	256391304
COG category	[G] Carbohydrate transport and metabolism
COG ID	[COG2182] Maltose-binding periplasmic proteins/domains
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	25
Fosmid unclonability p-value	0.553068
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCGACGGA AGCGCGGCGC CGCGATTGCG GCGATAGCGG TAGTGGCTCT CGCTGCAAGT 
GCTTGCAGCA GCAGCAAGTC GGGTGGCTCC TCGGCCGCCG CCAAGGATCC GGGCTCGGTG 
AAGGGGAGCG TCACCTGGTG GGACACCTCT GATGCCACCA ATGAGGCGCC GAACTACCAG 
CCGATCATCA AGGCGTTCGA GGCCAAGTAC CCGAACATCA AGGTGAACTA CGTCAACGTG 
CCGTTCTCGG ACGCCAAGGA CAAGTTCAAG ACCGCCGCGC AGTCCGGCAG CGGGGCTCCG 
GACGTGCTGC GCGCGGACGT CGGCTGGACG CCCGCGTTCG CGCAGCTGGG CTACCTGCAG 
CCGCTGGACG GGACGCCCGC GCTGCAGGAC GCCGCCGACT ACATGCCCGG GCCGTACGCC 
TCGGACCACT ACAACGGCAA GATTTACGGC GTGCCGCAGG TCACCGACAC GCTCACGCTG 
CTGTACAACA AGGACCTGCT CACCAAGGCC GGCATCACCA CGCCGCCGAA GACCTGGGCC 
GAGCTGAAGA GCGACAGCCT GCAGATCAAG GCCAAGACCG GGGTGGACGG CACGTTCCTG 
GACGCCGCGT CCTACTACCT GCTGCCGTTC ATCTACGGCG AGGGCGGCGA CATCATCGAC 
GCCTCGGCCA AGAAGATCAC GGTCAACGAC GCGACCACGC TCAAGGCCGT GGGCATCGCG 
CAGGACCTGG TGAAGTCCGG CGCGGCGGTC ACCGACGTGA CCAAGGACGG CTACACCAAC 
ATGCAGACCG CCTTCAAGGA CGGCAAGGTC GCCATGGTCA TCAACGGCCC GTGGTCCACC 
TCCGACGACC TGAAGGGCTC GGCCTTCGGC AGCGCCGACA ACCTCGGCAT CGCCACCGTC 
CCGGCCGGCT CGGTCAAGGC CGGCGCCCCG GTCGGCGGCC ACAACCTGGT CGTCTACGCG 
GGCTCGAAGA ACCTCGACGC CACCTACCTG TTCGTGGCGT TCCTGAACGA CGCGCAGAAC 
CAGGCGACCA TCGCGGCCAA GAACAACGTG CTGCCGACCC GCACCTCGGC CTACTCCGAC 
CCGCAGGTCG CGAACAACAA GATCCTGTCG GCCTTCGAGG GCCCGCTGAA GAACGCGGTC 
GGCCGTCCGC CGGTCGCCGG CGCCTCGGAC CTGTTCACCC CGCTGGACAC CGACTACCAG 
GCGATCCTCG GCGGTCAGAA GAGCGCCCAG GACGGGCTGA ACGACGCCGC GACGCAGTTC 
GCGCAGATCC TGCCGGACTT CAGCAAGAGC TGA

Protein sequence

MRRKRGAAIA AIAVVALAAS ACSSSKSGGS SAAAKDPGSV KGSVTWWDTS DATNEAPNYQ 
PIIKAFEAKY PNIKVNYVNV PFSDAKDKFK TAAQSGSGAP DVLRADVGWT PAFAQLGYLQ 
PLDGTPALQD AADYMPGPYA SDHYNGKIYG VPQVTDTLTL LYNKDLLTKA GITTPPKTWA 
ELKSDSLQIK AKTGVDGTFL DAASYYLLPF IYGEGGDIID ASAKKITVND ATTLKAVGIA 
QDLVKSGAAV TDVTKDGYTN MQTAFKDGKV AMVINGPWST SDDLKGSAFG SADNLGIATV 
PAGSVKAGAP VGGHNLVVYA GSKNLDATYL FVAFLNDAQN QATIAAKNNV LPTRTSAYSD 
PQVANNKILS AFEGPLKNAV GRPPVAGASD LFTPLDTDYQ AILGGQKSAQ DGLNDAATQF 
AQILPDFSKS