Gene Hhal_1573 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Hhal_1573
Symbol
ID	4709833
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Halorhodospira halophila SL1
Kingdom	Bacteria
Replicon accession	NC_008789
Strand	+
Start bp	1712998
End bp	1714083
Gene Length	1086 bp
Protein Length	361 aa
Translation table	11
GC content	63%
IMG OID	639856037
Product	glycosyl transferase, group 1
Protein accession	YP_001003139
Protein GI	121998352
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	21
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAGGATCC TGTTTGTCTC CACGCTCAGT CACATCCCAC AGCGAGCGAG CGGGGCCAAT 
AGCTCAACCG ATCAGCTCTG CCGCGGACTC TCATCGAGGG GGCACCACGT GGCTGTCCTA 
TCGAGTCTGA GAGGTGGAGA CCGACTCGCT TGGTGGAACC GCCTACGGCA CCACCTGACA 
CCGGGGCAGA ACCTCCCACC GGACCGGGCA TGCGGCTACC TGACCTACCG CGGTTATGCT 
CCCCTGAAAG ATCTCGATGA GGCCTTGGGT GACTTCCGGC CCGACATTGC CGTTGCTGAT 
GTCGGAAAGA CCAGCCGTAT CGCTGAAGCG CTACGGGCGC GCAGAGTCCC CACAGTGGCC 
TATCTACGCG ACCTGGAACC GGAGACGTTC TCGGATCACC CCGTCACTGA TCCACAGGTG 
AGCTTCATCG CCAATTCTCA GTTCACTGCC TCAGCCTATG CACAGCACCG CGACCTCCAG 
TGTCAGATTA TCCGCCCGCT GGTTCACCCG GAGTATTACC GCGTGAATTC AACGCGCGAA 
GTCGCACTCC ACATCAACCC CTCCCCGAAG AAAGGCATCG ACATCACGCT GAATCTGGCC 
GAGGCTCGCC TGGACATCCC GTTCCTGCTG GTCGAAACCT GGAGTCTGGC GCGCGAGCTG 
CGCGAGCACT ACCGCCGCCG TGCCGCCGAA TTGCCCAACG TGCGTGTCGT CCCGACTCAA 
AGGGATATGC GAGCCTATTA CGGGCGCACC CGGGTCGTCC TGGCGCCGAG TATCTGGCCG 
GAGACTTGGG GTCGCATTGC TACAGAGGCT CATATCAGCG GCATCCCGGT CTTGGCCAGC 
ACACGCGGCG GCCTGCCCGA GTCGGTGGGT CCGGGCGGAA CGCTGCTGGA TCCCGAAGCG 
CCTTTGGAGC AGTGGGTCGA GGCCCTCGGC AGGCTTTGGG ACGATAGGAC GGTCTACGCA 
AGGCTAAGCC GTGCCGCCCT GGACCACGCC GACCGGCCGG AGATTCACCC CAAACGGGTT 
TTGGATGACT TTTCAGGCGT TCTCGAACAA ACCCGCGCGA TGGCCACAGC GTCGACTCCC 
GCCTAA

Protein sequence

MRILFVSTLS HIPQRASGAN SSTDQLCRGL SSRGHHVAVL SSLRGGDRLA WWNRLRHHLT 
PGQNLPPDRA CGYLTYRGYA PLKDLDEALG DFRPDIAVAD VGKTSRIAEA LRARRVPTVA 
YLRDLEPETF SDHPVTDPQV SFIANSQFTA SAYAQHRDLQ CQIIRPLVHP EYYRVNSTRE 
VALHINPSPK KGIDITLNLA EARLDIPFLL VETWSLAREL REHYRRRAAE LPNVRVVPTQ 
RDMRAYYGRT RVVLAPSIWP ETWGRIATEA HISGIPVLAS TRGGLPESVG PGGTLLDPEA 
PLEQWVEALG RLWDDRTVYA RLSRAALDHA DRPEIHPKRV LDDFSGVLEQ TRAMATASTP 
A