Gene Rcas_3098 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_3098
Symbol
ID	5540594
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	4015214
End bp	4016389
Gene Length	1176 bp
Protein Length	391 aa
Translation table	11
GC content	64%
IMG OID	640895217
Product	glycosyl transferase group 1
Protein accession	YP_001433170
Protein GI	156743041
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	8
Plasmid unclonability p-value	0.1957
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	42
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCCTGGCT TCAACGGCGT CCGGTGTCTG GAAGGGAAGT CTGTGACCGA CCGTATTCGC 
ATCTTGCTGC TCATCGAAAC ACTCTGGCTC GGCGGGGCGC AGCGCTTGCT TCCCGGATTG 
GTGACCGGCC TCGATCCGCT GCGTTTTGAA GGGCATATCG TGGCGTTGCA CGATGGACCG 
CTGCGCCAGG AGTTCGAAGC CGCGCGCCTG CCGCTGACGG TGCTGGGTGC GCGTCGTTTC 
TATGAGCCGC GCGTCGTGTC TGCTATCGCT CGCCTGGTGC GCGCGCAGCA GATCGATGTG 
ATCCATACCC ATCTGACCGG CGCCGATATT GTGGGGCGAA TGGTTGGCGC ACTCACCAGC 
GTGCCGGTCG TTTCGACGAT GCACAATGTT CCGCACGATT ACGATCACCA GAAATGGCAC 
CGTCGCGCGC TGCAACGCCT GACTGCGCGG ACGCTCGCTG CGCGCCTGGT GATGGTCGCG 
CCGGGGATTG GCGTCGAGTA TATGCGCCGG TGGGGTATTC CGGCTTCGCG CGTGGTTACG 
ATCAATAATT CTGTTCCTAT GGAACCGTAT CTGGCGATTG CCGAAGGGGT TGCTCCTCAT 
GTTCCGCCGA CGGTGACGAC GATTGGGAGG TTGACCGAGC AGAAGGCGTA CCATCTGCTC 
CTCGATGCTG CGCGTCTGGT GGTGCGCATA CGCCCCGACA CCCGCTTCCG CATGGTCGGC 
GAGGGGCGCC TGGAGGCGGC GCTGCGTCGG CAGGCGCAGG ACCTCGGCAT TGCGCGTGCC 
GTATCGTTCG ATGGATTGCG GCACGACATC CCGGACATTC TGGCGGAAAC GCACGTTTTT 
GTGCTCTCGT CGCTCTGGGA AGGGTTGCCG GTGACGGCAG TCGAAGCCAT GGCAGCGGCG 
CGTCCGGTTG TACTGACCGA TGTTGGCGGC TGTCGCACCC TGGTGACGCC GGGAGTCGAG 
GGGTGGCTTG TGCCGCCGGG GAATGTCGAA GCGCTGGCAG CAGCGCTCCT CGATGCGCTC 
GACAATCCTG AGCGCCAGCG CCTGTTTGGT CGGCGTGGAC GCGAGAAAGT GCGCCGCGCA 
TTCGGATTGG AACAGTATGT GCGTGGGCAC GAACAGTTGT ATGAATCGCT GGCAGTGGTG 
CGCGCTCAGG CGCGCGTCGC GCGCCTGCAC CGCTGA

Protein sequence

MPGFNGVRCL EGKSVTDRIR ILLLIETLWL GGAQRLLPGL VTGLDPLRFE GHIVALHDGP 
LRQEFEAARL PLTVLGARRF YEPRVVSAIA RLVRAQQIDV IHTHLTGADI VGRMVGALTS 
VPVVSTMHNV PHDYDHQKWH RRALQRLTAR TLAARLVMVA PGIGVEYMRR WGIPASRVVT 
INNSVPMEPY LAIAEGVAPH VPPTVTTIGR LTEQKAYHLL LDAARLVVRI RPDTRFRMVG 
EGRLEAALRR QAQDLGIARA VSFDGLRHDI PDILAETHVF VLSSLWEGLP VTAVEAMAAA 
RPVVLTDVGG CRTLVTPGVE GWLVPPGNVE ALAAALLDAL DNPERQRLFG RRGREKVRRA 
FGLEQYVRGH EQLYESLAVV RAQARVARLH R