Gene Rcas_1988 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_1988
Symbol
ID	5539466
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	2552774
End bp	2553898
Gene Length	1125 bp
Protein Length	374 aa
Translation table	11
GC content	65%
IMG OID	640894123
Product	glycosyl transferase group 1
Protein accession	YP_001432094
Protein GI	156741965
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.590311
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	13
Fosmid unclonability p-value	0.0366847
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAGCCGCA CATCTATCGT GCCGACGCTG TCGGATCACT GCTCCACCCC TCATCTTTCC 
GTCGTCTGGC AGTCGCGCTG GGGCATCCCC ATCGGATACG CTGTCTCTTC CGAGGCGCTG 
GCGCTCGCAC TGGCTGCGCG CGGCGTCGAG TTGTCGTACC GCCCGACGCC GTGGCATATG 
CCGGGAACAA TCCGCTACCC GGCGCTGCTG GCTGCCGCAG CGCGCGCGCC GCGCGACGAC 
GTGCCGCAGG TCAGCTACGA CCAGGCAGAC CTGTTCTACA CCCGTCACGC GGGGTACAAA 
ATCGGTTACA CCATGCTGGA AGTCGATGGA CTGCCGCGTG AGTGGGTCGC GGCGTGCAAT 
GCCATGGACG AGGTCTGGAC GCCAAGCCGC TGGGGTGCGA CGGTCTTTGC CAATGCCGGA 
GTGACGCGCC CGATCTATGT CATGCCGCTG GGGTATGATC CGGTGTGTTT TCGACCGGAT 
GGACCGGCGC GCCGGATTGC GGAACGCTTC ACGTTTCTCT CGGTCTTTGA GTGGGGCGAA 
CGCAAAGCGC CGGACATCCT GCTGCGCGCC TATGCAGCGT CGTTCACGCG ACGCGATGAC 
GTGGCGCTGC TGTTGCGGGT GAACAATTTT GACGCAGAGG TCGATGTTGC GCGACAGATC 
GCCGCGCTGC GCCTTCCCGC CGATGCTCCG CCGATTGCCC TGCTCTACAA CCGTTACATC 
AGCGACGAGA GCCTGGGAGC GCTCTACCGC AGCGCCGATT GTTTTGTGCT GCCGACGCGC 
GGTGAAGGAT GGGGGCTGCC GATCCTCGAA GCGATGGCGT GTGGGTTGCC GGTGATTGCC 
ACCGACTGGA GCGGGCAAAC CGAATTCTTC CACGGCGGAG TCGGGTACCC GGTGCGGGTG 
CGGCGGCTGG TTGCCGCCGA CGCCAAATGC CCCTACTACC TGGGCTGGCG CTGGGCGGAG 
CCGGACATCG AGCACCTGAT CGCGCTGATG CGCCATGTGT ACGAGCATCC CAACGAAGCG 
CGGGTGGTTG GCGCGCGCGC GGCGCAAGAA GCGGCAACGC GCTGGACGTG GGCGCACGCA 
GCGGAGCGGA TTCACAGGCG GTTAATGGAT GCGACTGATG GGTAA

Protein sequence

MSRTSIVPTL SDHCSTPHLS VVWQSRWGIP IGYAVSSEAL ALALAARGVE LSYRPTPWHM 
PGTIRYPALL AAAARAPRDD VPQVSYDQAD LFYTRHAGYK IGYTMLEVDG LPREWVAACN 
AMDEVWTPSR WGATVFANAG VTRPIYVMPL GYDPVCFRPD GPARRIAERF TFLSVFEWGE 
RKAPDILLRA YAASFTRRDD VALLLRVNNF DAEVDVARQI AALRLPADAP PIALLYNRYI 
SDESLGALYR SADCFVLPTR GEGWGLPILE AMACGLPVIA TDWSGQTEFF HGGVGYPVRV 
RRLVAADAKC PYYLGWRWAE PDIEHLIALM RHVYEHPNEA RVVGARAAQE AATRWTWAHA 
AERIHRRLMD ATDG