Gene Rcas_2958 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_2958
Symbol
ID	5540449
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	3838009
End bp	3839109
Gene Length	1101 bp
Protein Length	366 aa
Translation table	11
GC content	63%
IMG OID	640895078
Product	glycosyl transferase group 1
Protein accession	YP_001433036
Protein GI	156742907
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	9
Plasmid unclonability p-value	0.298871
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	7
Fosmid unclonability p-value	0.000213048
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGCGCATCT TGATGCTTTC CAAAGCGCTG GTCAACGGCG CATACCAGAA GAAGTGCGAA 
GAATTGGCAG CATTGCCAGA CGTTGAACTG ATCGTCGCCG TGCCACCTGC CTGGCGTGAA 
CCGCGTGTCG GCGTCATTCC GCTCGAACGG CGCTTCACCC GCGGCTATCG CCTTGTCACG 
CTGCCGATTG TACTCAACGG TCGCCACCAT CTCCACTTCT ACCCCACGTT CAGCCGGTTG 
GTGCGCCAGG TGCGCCCCGA TATTCTGCAC GCCGATGAAG AATCGTTCAA TCTGGCGACA 
TTTCTGGCAC TCCGCGCTGG CGTACAGCAC GGCGCGCGCT GCTGCTTCTA CAACTACGCC 
AATATCGACC GCTACTACCC GCCGCCGTTC AACCTGTTCG AACGCTACGC CTTTCGGCAC 
GCCGCTCACG CCTTCGCATG CAGCGCAGAG GCGGAAGCGA TCATGCGTCG CCACGGCTAC 
GCCGGACCGC TCACCATCCT GCCGCAGTTT GGCGTCGATC CCGATCTGTA CGCTCCGGCG 
CAGCGCGACC GCTCGAACGC GGCGACGATT GTCGGGTACA TCGGGCGTCT GGTGCCGGAA 
AAGGGAGTGC TCGACCTGGT GGAAGCCGTG GCGCGTGTGC CGTCGGTGCG CCTGCGGCTG 
ATCGGCGACG GCGCGCTACG TCCGTTCATC GAGGCGCGGA TCGCTGCACT CGACATTGGC 
GAGCGCATCG AACTCCACCC CGCCATCCCA TCGACCCGCG TTCCCGATGA ACTGCGCCGT 
CTCGACGCGC TCGTGTTGCC CTCACACACA ACGCGCACTT GGAAGGAACA GTTCGGGCGC 
ATCCTGATTG AAGCCATGAG CTGCGCAGTT CCGGTCATCG GCTCCTCATC GGCTGCCATC 
CCCGACGTCA TCGGCGACGC CGGGATCATC TATCCCGAAG GCGACATTGC CGCACTCGCA 
GGAGCATTGC GACGGGTAGC GGACGATCCG GCGCTGCGCA ACGACCTCGG ACGGCGCGGA 
CGGGAACGTG TGCTGGCGCA GTTCACGCAG GCGGCGATTG CCCGTGCGTA TCATGACGCA 
TATCGTTCGA TGCTGAATTG A

Protein sequence

MRILMLSKAL VNGAYQKKCE ELAALPDVEL IVAVPPAWRE PRVGVIPLER RFTRGYRLVT 
LPIVLNGRHH LHFYPTFSRL VRQVRPDILH ADEESFNLAT FLALRAGVQH GARCCFYNYA 
NIDRYYPPPF NLFERYAFRH AAHAFACSAE AEAIMRRHGY AGPLTILPQF GVDPDLYAPA 
QRDRSNAATI VGYIGRLVPE KGVLDLVEAV ARVPSVRLRL IGDGALRPFI EARIAALDIG 
ERIELHPAIP STRVPDELRR LDALVLPSHT TRTWKEQFGR ILIEAMSCAV PVIGSSSAAI 
PDVIGDAGII YPEGDIAALA GALRRVADDP ALRNDLGRRG RERVLAQFTQ AAIARAYHDA 
YRSMLN