Gene B21_01987 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	B21_01987
Symbol	gatZ
ID	8115508
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Escherichia coli BL21
Kingdom	Bacteria
Replicon accession	NC_012892
Strand	-
Start bp	2072176
End bp	2073438
Gene Length	1263 bp
Protein Length	420 aa
Translation table	11
GC content	49%
IMG OID	644848201
Product	hypothetical protein
Protein accession	YP_002999774
Protein GI	251785470
COG category	[G] Carbohydrate transport and metabolism
COG ID	[COG4573] Predicted tagatose 6-phosphate kinase
TIGRFAM ID	[TIGR02810] D-tagatose-bisphosphate aldolase, class II, non-catalytic subunit

Plasmid Coverage information

Num covering plasmid clones	20
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAAAACGT TAATTGCCCG GCATAAAGCT GGTGAACATA TCGGCATATG TTCAGTCTGT 
TCTGCCCATC CGTTGGTTAT CGAAGCGGCG CTGGCATTTG ATCGCAACAG CACGCGCAAA 
GTGCTGATTG AAGCAACGTC AAACCAGGTC AATCAATTTG GCGGTTATAC CGGAATGACA 
CCGGCAGACT TTCGCGAATT TGTTTTTACG ATTGCCGATA AAGTTGGGTT TGCACGCGAA 
CGCATTATTC TCGGCGGCGA TCATCTGGGG CCAAACTGCT GGCAGCAAGA AAATGCGGAT 
GCGGCGATGG AAAAATCCGT CGAGCTGGTA AAAGCATATG TTCGTGCTGG CTTCAGTAAA 
ATTCATCTTG ATGCGTCAAT GTCCTGCGCG GGGGATCCCA TACCGTTAGC ACCAGAAACG 
GTTGCGGAAC GAGCTGCTGT GCTTTGCTTT GCTGCGGAAA GTGTGGCGAC AGATTGCCAG 
CGTGAGCAAC TGAGCTATGT CATTGGTACC GAAGTTCCGG TTCCGGGCGG TGAGGCCAGC 
GCCATTCAGT CAGTACACAT CACCCAGGTT GAAGATGCCG CCAATACTTT ACGCACGCAT 
CAAAAGGCCT TTATTGCCCG TGGGCTGACA GAGGCGTTAA CACGCGTGAT TGCCATTGTG 
GTGCAGCCGG GCGTGGAATT TGATCACAGC AATATTATCC ATTATCAGCC GCAGGAAGCG 
CAGCCGCTGG CGCAATGGAT AGAAAACACC CGAATGGTTT ATGAAGCACA TTCTACCGAT 
TACCAGACCC GGGCGGCTTA TTGGGAATTA GTCCGCGATC ACTTTGCAAT ATTGAAAGTC 
GGTCCCGCAT TAACCTTTGC TTTACGCGAG GCGATATTTG CACTGGCACA AATTGAGCAG 
GAACTTACCG CCCCCGAAAA TCGCAGCGGT TGCCTGGCGG TAATTGAAGA AGTGATGCTC 
GACGAACCGC AATACTGGAA AAAATATTAT CGTACGGGTT TTAACGATTC ATTACTGGAT 
ATTCGTTACA GCCTGTCGGA TCGTATTCGT TATTACTGGC CGCATAGTCG GATTAAAAAT 
AGCGTCGAAA CGATGATGTT GAATCTGGAA GGCGTGGACA TCCCACTGGG CATGATTAGT 
CAGTATCTTC CCAAACAATT TGAACGCATT CAGTCCGGGG AATTATCAGC AATACCGCAT 
CAGCTGATTA TGGATAAAAT TTATGATGTT TTGCGCGCCT ATCGCTACGG CTGTGCGGAA 
TAA

Protein sequence

MKTLIARHKA GEHIGICSVC SAHPLVIEAA LAFDRNSTRK VLIEATSNQV NQFGGYTGMT 
PADFREFVFT IADKVGFARE RIILGGDHLG PNCWQQENAD AAMEKSVELV KAYVRAGFSK 
IHLDASMSCA GDPIPLAPET VAERAAVLCF AAESVATDCQ REQLSYVIGT EVPVPGGEAS 
AIQSVHITQV EDAANTLRTH QKAFIARGLT EALTRVIAIV VQPGVEFDHS NIIHYQPQEA 
QPLAQWIENT RMVYEAHSTD YQTRAAYWEL VRDHFAILKV GPALTFALRE AIFALAQIEQ 
ELTAPENRSG CLAVIEEVML DEPQYWKKYY RTGFNDSLLD IRYSLSDRIR YYWPHSRIKN 
SVETMMLNLE GVDIPLGMIS QYLPKQFERI QSGELSAIPH QLIMDKIYDV LRAYRYGCAE