Gene Rcas_0496 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_0496
Symbol
ID	5537959
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	637727
End bp	638956
Gene Length	1230 bp
Protein Length	409 aa
Translation table	11
GC content	68%
IMG OID	640892658
Product	glycosyl transferase group 1
Protein accession	YP_001430644
Protein GI	156740515
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	32
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCGCGTGG TTGTGTCGCT GGAACATCAC TTTGATCGCA CGCCGGACGG CGTGGTATGG 
ACGCAGACGC AGTTTCCGTA CCGCTTCTGG CAGCGGTATC TGGAAGTCTT CGATCAGGTG 
CGCGTCGTTG CGCGGGTGCG CGATGCGCAG CGGGCAGCCC CCGACTGGCA GCGCGCCGAT 
GGGCGGCGCG TCTCCTTTGC CGCCATCCCG GAGTACCTGG GTCCGCAGCA ATACCTGCTG 
CGCCTGCCGC AGATTCGCGC GGCGGCACGC CGCGCGATCG GCAACGAGGA TGCCGTCATT 
CTGCGGGTCA GTTCGCAGAT CGCCGGTCTG CTCCACCCTT CCCTGCGGCG TGAAGGACGG 
CCGTATGGCG TTGAAGTGGT CAGCGATCCG TATGACGTGT TTGCGCCCGG TGCGGTCCGG 
CATCCGCTGC GCCCGTTCTT CCGCTGGCTG TTTCCGTATC GGCTACGGCA ACAGTGCGCG 
AACGCCACGG CGGCATGCTA TGTCACCGAG CAGGCGCTCC AACGGCGCTA TCCGTGCCCA 
TCGTTTGCGG TGGCGGCGTC GGATGTCGAG TTGCCCGAAG AGGCGATTGT CCCGGCGCCG 
CGCCCGCTGC ACGCCCCCGG CGCCCCTTGT CGCCTGATCT TCGTCGGCAC ACTGGGGCAG 
TTGTACAAAG CGCCGGATGC GGTGATCGAC GCAGTGGCGG CATGCGCGCG CGCAGGCGTC 
GATCTGTCTC TCACGCTGGT CGGCGACGGC AAACATCGTT CGGAGATGGA AGAGCGCGTC 
CGCGCGCTGG GCATTGCAGA CCGGGTGACC TTTCGCGGGC AGGTGACGAC GGGCGCAGCG 
GTGCGCGCCG AACTCGACGC GGCGGATCTG TTCGTGCTGC CGTCGCGGCA GGAAGGCATG 
CCGCGCGCGA TGATCGAGGC GATGGCGCGC GCGCTTCCCT GCATTGGCTC GACAGTCGGC 
GGCATCCCCG AACTGTTGCC GCCGGAAGAC CTCGTTCCTC CCGGCGATGC CCTGGCGCTG 
GCGCAGGTTA TCCGTGAGAT GGTCGCCAGC CCGGAGCGGA TGGCACGCGC CTCAGCGCGC 
AACCTCGAAC GCGCGCGGTC ATTCGCCGAG TCCCGGTTGC GCGAGCAACG ACTGGCGTTC 
TTCCAGCGGG TGCGCGAACA GACCGAAGCC TGGCTCGCCG ACCGTCACGC AGCGACCGTA 
TGGACGGCGG GACGTCGCAC CCTGCCGTGA

Protein sequence

MRVVVSLEHH FDRTPDGVVW TQTQFPYRFW QRYLEVFDQV RVVARVRDAQ RAAPDWQRAD 
GRRVSFAAIP EYLGPQQYLL RLPQIRAAAR RAIGNEDAVI LRVSSQIAGL LHPSLRREGR 
PYGVEVVSDP YDVFAPGAVR HPLRPFFRWL FPYRLRQQCA NATAACYVTE QALQRRYPCP 
SFAVAASDVE LPEEAIVPAP RPLHAPGAPC RLIFVGTLGQ LYKAPDAVID AVAACARAGV 
DLSLTLVGDG KHRSEMEERV RALGIADRVT FRGQVTTGAA VRAELDAADL FVLPSRQEGM 
PRAMIEAMAR ALPCIGSTVG GIPELLPPED LVPPGDALAL AQVIREMVAS PERMARASAR 
NLERARSFAE SRLREQRLAF FQRVREQTEA WLADRHAATV WTAGRRTLP