Gene EcHS_A0166 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	EcHS_A0166
Symbol	cdaR
ID	5591883
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Escherichia coli HS
Kingdom	Bacteria
Replicon accession	NC_009800
Strand	+
Start bp	181334
End bp	182491
Gene Length	1158 bp
Protein Length	385 aa
Translation table	11
GC content	53%
IMG OID	640919352
Product	carbohydrate diacid transcriptional activator CdaR
Protein accession	YP_001456947
Protein GI	157159629
COG category	[K] Transcription [T] Signal transduction mechanisms
COG ID	[COG3835] Sugar diacid utilization regulator
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	72
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGGCTGGCT GGCATCTTGA TACCAAAATG GCGCAGGATA TCGTGGCACG TACCATGCGC 
ATCATCGATA CCAATATCAA CGTAATGGAT GCCCGTGGGC GAATTATCGG CAGCGGCGAT 
CGTGAGCGTA TTGGTGAATT GCACGAAGGT GCATTGCTGG TACTTTCACA GGGACGAGTC 
GTCGATATCG ATGACGCGGT GGCACGTCAT CTGCACGGTG TGCGGCAAGG GATTAATCTA 
CCGTTACGGC TGGAAGGTGA AATTGTCGGC GTAATTGGCC TGACAGGTGA ACCAGAGAAT 
CTGCGTAAAT ATGGCGAACT GGTCTGCATG ACGGCTGAAA TGATGCTGGA ACAGTCGCGG 
TTGATGCACT TGTTGGCTCA GGATAGCCGT TTGCGGGAGG AACTGGTGAT GAACCTGATT 
CAGGCAGAGG AGAATACTCC CGCACTTACT GAATGGGCGC AACGGCTGGG GATCGATCTC 
AATCAACCGC GAGTGGTGGC TATTGTTGAG GTCGACAGCG GTCAGCTTGG TGTGGACAGC 
GCAATGGCGG AGTTACAACA ACTGCAAAAC GCGCTGACTA CGCCCGAGCG TAATAATCTG 
GTGGCGATTG TCTCGCTAAC CGAAATGGTG GTGTTGAAAC CGGCGTTGAA CTCTTTTGGG 
CGCTGGGATG CAGAAGATCA TCGTAAGCGA GTTGAACAAC TGATTACCCG CATGAAAGAG 
TACGGCCAGC TGCGTTTTCG CGTTTCACTG GGCAACTATT TTACCGGTCC TGGCAGTATT 
GCCCGATCCT ATCGTACGGC GAAAACGACG ATGGTGGTGG GTAAACAGCG GATGCCAGAA 
AGTCGCTGCT ATTTTTATCA GGATCTGATG TTACCTGTGT TACTCGACAG TTTGCGTGGC 
GACTGGCAGG CCAACGAACT GGCGCGACCG CTGGCGCGGC TGAAAGCGAT GGACAATAAC 
GGCTTGCTGC GACGAACGCT GGCGGCGTGG TTTCGTCACA ATGTGCAACC GCTGGCAACG 
TCAAAGGCGT TGTTTATTCA TCGTAATACT CTGGAGTATC GGCTTAATCG TATATCGGAA 
CTGACCGGGC TTGATTTGGG TAATTTTGAT GACAGGTTGC TGCTGTATGT GGCGTTGCAG 
CTGGATGAAG AGCGGTAG

Protein sequence

MAGWHLDTKM AQDIVARTMR IIDTNINVMD ARGRIIGSGD RERIGELHEG ALLVLSQGRV 
VDIDDAVARH LHGVRQGINL PLRLEGEIVG VIGLTGEPEN LRKYGELVCM TAEMMLEQSR 
LMHLLAQDSR LREELVMNLI QAEENTPALT EWAQRLGIDL NQPRVVAIVE VDSGQLGVDS 
AMAELQQLQN ALTTPERNNL VAIVSLTEMV VLKPALNSFG RWDAEDHRKR VEQLITRMKE 
YGQLRFRVSL GNYFTGPGSI ARSYRTAKTT MVVGKQRMPE SRCYFYQDLM LPVLLDSLRG 
DWQANELARP LARLKAMDNN GLLRRTLAAW FRHNVQPLAT SKALFIHRNT LEYRLNRISE 
LTGLDLGNFD DRLLLYVALQ LDEER