Gene Hoch_1406 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Hoch_1406
Symbol
ID	8543788
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Haliangium ochraceum DSM 14365
Kingdom	Bacteria
Replicon accession	NC_013440
Strand	+
Start bp	1892179
End bp	1893369
Gene Length	1191 bp
Protein Length	396 aa
Translation table	11
GC content	65%
IMG OID	646386118
Product	hypothetical protein
Protein accession	YP_003265853
Protein GI	262194644
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	7
Plasmid unclonability p-value	0.0332746
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	26
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGATGTCCT ACAGGTTAGT GCTTCTATGC CTCGTCTACG TGTCTATGCT GGCCGCATGC 
CAGTCGGGCG CAAACGAGGA GGTCGCCGCA GCGAACCCGG CGACTCACAC CGCGCTTGCC 
GCGCACAGCG AAGCGGGAGC GGCAGACGGC GGCGATGGCG AGTGCGTGGC GGCGCTGAGC 
GACGTGTCCG TTGCCGAGGA CGGCGAGTGC ACGGGCAGCG TGGGCGATTC CGCGTACTGC 
GATAGCTGCG AATGCGGCTA TGGCGAGGGC GACTGCGACG GCGACTCTGA ATGTGCGCCC 
GGGCTGTATT GCTACAAGGA CGTGGGCGCG GACTTCGGCT ATGCGTCCGA CGTCGACGTG 
TGTCTGGGCG AGTGCGAGGA TTACAGTGGT CACTGGGAGG CATCCTGCAC CAGCGAGTGC 
CCCTGCGAGG CCGGCGAGGG CGACTGCGAC ACCGACGCCG ACTGCGCGGA AGGCTACCGC 
TGCATGCACG ATACCGGTGC GCTCTACGGC ATGGATCCGG AGCTCGATAC CTGCGAGCTT 
CTGTGTTCTT CGGTCGGCCT GGGCACGACC ACGTTCTGCT CGTCGGAGTG CCTGTGTGAC 
GCGGGCGAGG GCGATTGCGA CTCCGATTCC GACTGTCTGC CGGGGCTGCG CTGCGCGCGC 
GATGTCGGCG CACGGTACGG GTTCGACCCG GAGACCGACG TCTGTGAGGG CATCTCGACC 
TGCGATCTCA CCGACGGGGC CGGCGACGAA CCCGCGCTGG CCTACCCCTT GAGCTTCGAT 
TACGTGAATT CCTGGGCCGC CGGGCTGCGC ATGGACAAAG GCTTTCTGTG CAGTGGCGAA 
GACGATTGGT ACCGTTTTCC CAACTCGGCG GCAGGATTTA CCCCGGTATT TCTGGCGGTC 
CGCGCCGAGG CCCGCGGCGC CGATTATTGC GGCCCGGGTT GCGATGGCCT GACCTTGCCC 
GATGCGCCCG AGAACAGCAT CACCATCGAA GTCTACGACG AGTCCATGAA CACCTTGTTG 
TCCACGCGCT CCGATACCGA TGGAACGCTT TTCTTCGATG TCTCGCTCGA GGGCATGGAG 
TACACGGACG ACCTGCTTAT CCACGTGACC GGCGCCGCGG AAGCCACCTA TCCGTATGAG 
CTGACCCTGT GGGTGCAGCC GTTCGACGGT GAAGACGAAT GCGAGTGTTG A

Protein sequence

MMSYRLVLLC LVYVSMLAAC QSGANEEVAA ANPATHTALA AHSEAGAADG GDGECVAALS 
DVSVAEDGEC TGSVGDSAYC DSCECGYGEG DCDGDSECAP GLYCYKDVGA DFGYASDVDV 
CLGECEDYSG HWEASCTSEC PCEAGEGDCD TDADCAEGYR CMHDTGALYG MDPELDTCEL 
LCSSVGLGTT TFCSSECLCD AGEGDCDSDS DCLPGLRCAR DVGARYGFDP ETDVCEGIST 
CDLTDGAGDE PALAYPLSFD YVNSWAAGLR MDKGFLCSGE DDWYRFPNSA AGFTPVFLAV 
RAEARGADYC GPGCDGLTLP DAPENSITIE VYDESMNTLL STRSDTDGTL FFDVSLEGME 
YTDDLLIHVT GAAEATYPYE LTLWVQPFDG EDECEC