Gene RoseRS_1104 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	RoseRS_1104
Symbol
ID	5208051
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus sp. RS-1
Kingdom	Bacteria
Replicon accession	NC_009523
Strand	-
Start bp	1379801
End bp	1380991
Gene Length	1191 bp
Protein Length	396 aa
Translation table	11
GC content	60%
IMG OID	640594717
Product	glycosyl transferase, group 1
Protein accession	YP_001275461
Protein GI	148655256
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	9
Plasmid unclonability p-value	0.0552505
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	3
Fosmid unclonability p-value	0.00694846
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGAAGATTA CTCTGATCGG TCCGACCTAC CCGTTCCGTG GCGGCATTGC GCACTATACG 
ACCCTGCTGA CGCATCATCT GCGCCAGCGC CACGATGTGC GGTTGATTTC CTACATCAAG 
CAGTATCCGA AGTGGCTCTA TCCCGGCAAC ACAGCAATGG ATCCCAGCCC CGACGAAAGC 
GCGCTGCGTG TGGAGTGCGA CCGGGTGCTG ACGCCAATGA ATCCGCTGAC ATGGTGGCGC 
GCCTTTCGTA TGATCCAGCG CGATAACCCG GATCTGCTGC TGCTCCAGTG GTGGACGCCG 
TTCTGGTCGC CGATGCTGTT TGTGCTGACC CGTCTGGTGC GACGTTATAC GAATGTGCGC 
ATTCTGTTCT TGTGTCATCA CGTCATCGCT CCCGACGGCG GCATGTTCGA CTGGTATCTG 
GCACGGCGCA TTCTGTGGCG CGGTCACGCA TTCATTGTGA TGAGCGAGGA GGATTTTGCC 
CTGCTCCGGC GTGCGCTTCC GTGGGCGCGC ATCCGGGGTG TCACCCATCC ACCCTACGAT 
GTGTTCAGTC GCACATCGCT ACTGCGCGTC GAGGCGCGCG CCCGCCTTGG GTTGGATCCG 
GATGAACCGG TGCTGCTCTT CTTTGGCTTC GTGCGACGCT ACAAAGGGTT GCGTCACCTG 
ATCCAGGCGC TGCCGCTGAT ACGACAGCAT GTTCCGGTGC GTTTGCTGGT CGTTGGCGAG 
TTCTGGGAAG ATGACCGCCC CTACCGCGAA CTGGTGCGGA ACCTGAATCT TGGTGATGTG 
GTGCATTTCC ACAGCGAATA TGTCCCCAAC GAGCAGATTG CAGTCTACTT CTCCGCCTGC 
GATGCGGTCG TTTTGCCCTA TCTGGAAGCG ACCCAGAGCG GCGTGGCGCA ACTGGCGATC 
GGGTTCGAGA AGCCGATGAT CGCCACCTCT GTCGGCGGTA TGCCCGAAAC GATTCATAAC 
GGTGAAACCG GGTTGATCGT GCCTCCCGGT GACAGTGCAG CGCTGGCGGA TGCAGTGGTG 
CGCTTTTTTC GCAATGGACT GGCTGAGCCG TTCACCCGGA ATATCCGCAC GGTGCGCGAG 
CGCGACTCCT GGCTGCCGCT GGTGCATCTG ATCGAGGAAC TGGCAGAACC GGCGAGTGCG 
CCGCAAACTG AACAACCTGC GCCGCAAACA GCGTCGCCAA GAGTGCTGTA G

Protein sequence

MKITLIGPTY PFRGGIAHYT TLLTHHLRQR HDVRLISYIK QYPKWLYPGN TAMDPSPDES 
ALRVECDRVL TPMNPLTWWR AFRMIQRDNP DLLLLQWWTP FWSPMLFVLT RLVRRYTNVR 
ILFLCHHVIA PDGGMFDWYL ARRILWRGHA FIVMSEEDFA LLRRALPWAR IRGVTHPPYD 
VFSRTSLLRV EARARLGLDP DEPVLLFFGF VRRYKGLRHL IQALPLIRQH VPVRLLVVGE 
FWEDDRPYRE LVRNLNLGDV VHFHSEYVPN EQIAVYFSAC DAVVLPYLEA TQSGVAQLAI 
GFEKPMIATS VGGMPETIHN GETGLIVPPG DSAALADAVV RFFRNGLAEP FTRNIRTVRE 
RDSWLPLVHL IEELAEPASA PQTEQPAPQT ASPRVL