Gene GBAA_5036 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	GBAA_5036
Symbol
ID	2814739
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Bacillus anthracis str. 'Ames Ancestor'
Kingdom	Bacteria
Replicon accession	NC_007530
Strand	+
Start bp	4567061
End bp	4568038
Gene Length	978 bp
Protein Length	325 aa
Translation table	11
GC content	38%
IMG OID	637791702
Product	ABC transporter substrate-binding protein
Protein accession	YP_021684
Protein GI	47530335
COG category	[P] Inorganic ion transport and metabolism
COG ID	[COG0715] ABC-type nitrate/sulfonate/bicarbonate transport systems, periplasmic components
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	23
Plasmid unclonability p-value	0.647768
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGTTATTAG CTGTTTTTAC ATTTGCTGCT TGCAGTAGTA AAAAAGAAGG TACGAAAGAA 
CAAACTCAAA ACATTCGCAT CGGCGAAGTT ACCCACTCTC TCTTCTATGC CCCGTTATAT 
GTCGGGATTG AAAAAGGATT TTTTAAAGAT GAAGGATTAA ATGTTGACCT ACAAACAACA 
GCTGGCGGAG ATAAAACGAT GACGGCCCTA TTATCTGGCG GTATTGATAT CGCCCTCGTC 
GGTTCTGAAA CGTCCATTTA CGTTCATCAA CAAGGAGCAA AAGATCCTAT CATTAACTTC 
GCACAACTTA CACAAACAGA TGGAACATTT TTAGTTTCGC GTAAAAAATT AGATTCTTTT 
AATTGGAATG ACGTAAAAGG TGTTACGTTT TTAGGACAGC GTAAAGGCGG TATGCCGCAA 
ATGGTTGGAG AATACGTTTT AAAGAAAAAT GGCATTGATC CTCACAAAGA TACAAACTTA 
ATTCAAAACA TTGAATTTGC TAACATTGCA AATGCCTACG CATCTGGTAC GGGGGAATTT 
GTCCAGCTCT TTGAACCGAC TGCAAGTATA TTCGAAAAAG AAGGAAAAGG TTATATCGTC 
GCTTCGTTCG GAAATGAATC TGGTACCGTT CCTTATACCT CTTTCATGGC AAAAGAAAGT 
TTTCTGAAAA AGGATAAAGC TGCTGCTGAA AAATTCACAC GAGCACTCTA TAAAGCACAA 
CAATGGGTTG ATACTCACAG TCCAGAAGAG ATTGCTGATG CCGTTTCTCC GTTATTTAAA 
GACACTTCAA AAGACATTAC AGAAAAAGTA ATTGAACGGT ATAAAAAGCA ACATTCTTAT 
GCGACAAATC CGCTATTAGA TGCTGAAGAA TGGAAACAGC TCCAAACGAT TATGAAAGAA 
GCTGGCGAAT TACAAAAAGA AGTTCCACAT GAAGCGCTCG TCAATACAAA AATTGCCGAG 
AGCGTTATTA AGAAATAG

Protein sequence

MLLAVFTFAA CSSKKEGTKE QTQNIRIGEV THSLFYAPLY VGIEKGFFKD EGLNVDLQTT 
AGGDKTMTAL LSGGIDIALV GSETSIYVHQ QGAKDPIINF AQLTQTDGTF LVSRKKLDSF 
NWNDVKGVTF LGQRKGGMPQ MVGEYVLKKN GIDPHKDTNL IQNIEFANIA NAYASGTGEF 
VQLFEPTASI FEKEGKGYIV ASFGNESGTV PYTSFMAKES FLKKDKAAAE KFTRALYKAQ 
QWVDTHSPEE IADAVSPLFK DTSKDITEKV IERYKKQHSY ATNPLLDAEE WKQLQTIMKE 
AGELQKEVPH EALVNTKIAE SVIKK