Gene Hoch_2452 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Hoch_2452
Symbol
ID	8544839
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Haliangium ochraceum DSM 14365
Kingdom	Bacteria
Replicon accession	NC_013440
Strand	-
Start bp	3380724
End bp	3381824
Gene Length	1101 bp
Protein Length	366 aa
Translation table	11
GC content	73%
IMG OID	646387152
Product	histidine kinase
Protein accession	YP_003266881
Protein GI	262195672
COG category	[T] Signal transduction mechanisms
COG ID	[COG0642] Signal transduction histidine kinase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	9
Plasmid unclonability p-value	0.11773
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	23
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGGATCCC AGCCAGTGAG CGAAGCGATA GAGCCCGGAC CCGGGTCCGG GCCGCTGGCG 
CGTGTGGCGC TGTGTCTCGA CAACGCGGCC GAGCGCGAGG CCCTGGCCCA GTGGCTGCAA 
GACGCGCCCA ATCTCAACCT GGCCACCGAC GTCGAGGCGC CCGACACCGA CGTGGTCCTC 
GCCGACCCGC GCGGCCTCGG CATGCACCGC GACCGCCTGA CCGCGCTCCG GGCCGAGCAG 
TATCCCCGGG TGCTGCCCGT GCTCCTGCTG GTGCCCGCGA ACCAGCCGCT CGACGCCCTG 
AGCGCCGACC TGCTCGAGCT GAGTGACGAT CTCGTGCGCG TGCCGGTCTC GCCCGCCGAC 
CTGCGCTTTC GCCTCAAGAG CGCGCTGCGC ACCCGCGAGA TGTCGCTCGC GCTCAGCCAG 
AGCATTCAGT TCGAGCAGCG CCTGGTCGGC GTGGTCGGCC ACGACATGCG CTCGCCGCTG 
TCGGTGCTGA GCATGGTCGC CGACATGCTC GGCGACGCCG ACACCGAGCT GCCCCCCCAC 
CTGCGCCGCC TGGGCGGGCG GGTGAAGCGC GCGGCCACCA CGCTCACCCA CCTGGCCGAG 
GATCTCCTGC TGGTGGCGCA CGGGCGCTCG GGCGCGCAGT TGAAGCTCGA GCGCGTGCCC 
TGCGAACTCG AGCCGGTGCT GGCCGACGCC ATCCAGCTCA CGGCCAGCAG CTCGCGGGTA 
ACGCTGAGCA GCGTGGGCGA CTGCGCCGCC GAGGTCGACG CGCAACGCGT GCAGCAGGCG 
GTCATCAACT TGCTGCAGAA CGCCCTACGC CACGGTACCC CCGACGGTGA AGTCGCCGTG 
CACGTCGACG GCAGCGCGCC CGACAGCGTC GCCATCGCGG TGAGCAACGA CGGCTCGCTC 
GGCGACGTCG CCCCCGAGCA GTTGTTCGAC TCGTTTCACC AGGGCGCCAA GGCCAGCGGC 
GGCGGCGTCG GCCTCGGCCT GTACATCGTG CGCCACCTCG CGCGCGCCCA CGGCGGCACC 
ATCGAGGCCC GCAGCGCCGA GGGCACGGTC ACCTTCACGC TGCATCTACC CAGGCAGGCG 
CCTCAGGGCA CGGGCGCGTA G

Protein sequence

MGSQPVSEAI EPGPGSGPLA RVALCLDNAA EREALAQWLQ DAPNLNLATD VEAPDTDVVL 
ADPRGLGMHR DRLTALRAEQ YPRVLPVLLL VPANQPLDAL SADLLELSDD LVRVPVSPAD 
LRFRLKSALR TREMSLALSQ SIQFEQRLVG VVGHDMRSPL SVLSMVADML GDADTELPPH 
LRRLGGRVKR AATTLTHLAE DLLLVAHGRS GAQLKLERVP CELEPVLADA IQLTASSSRV 
TLSSVGDCAA EVDAQRVQQA VINLLQNALR HGTPDGEVAV HVDGSAPDSV AIAVSNDGSL 
GDVAPEQLFD SFHQGAKASG GGVGLGLYIV RHLARAHGGT IEARSAEGTV TFTLHLPRQA 
PQGTGA