Gene Rcas_2539 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_2539
Symbol
ID	5540021
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	3277577
End bp	3278935
Gene Length	1359 bp
Protein Length	452 aa
Translation table	11
GC content	65%
IMG OID	640894669
Product	peptidase S8/S53 subtilisin kexin sedolisin
Protein accession	YP_001432636
Protein GI	156742507
COG category	[O] Posttranslational modification, protein turnover, chaperones
COG ID	[COG1404] Subtilisin-like serine proteases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	8
Fosmid unclonability p-value	0.000815252
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGTTAATGT CTTCCTATCG CGGTTCCTCA CGTTCAACCC TTCTTCTGAT CCTTCTGCTG 
ATCGGCGCGC TGACCCTCCC AAACGTTTCA GGGCAGGCGG AGTCCGCTGG CAGCGCGCGG 
GTCATTGTCG TTCTGCGCGC GCCGGCGGCG GCAGAGGGGG ACACAAGCGC GGCGCACTTC 
GGAATCACAC AGGCGCAGGA CCATGTTGCC GCTGCCGCAA CCGCCGCCGG CGCGCGCGAG 
GTTGCTCGCC TGCGCACGTT GCCGGTACTG GTGCTGGAAG CGCCGCATAC CGCGATTGAG 
CGCCTGGAAC AGCATCCACA GGTCGTCGCT GTCGCGGAGG ATATGCTGGC AGCGCCGCAC 
CTGACCGGCA GCGTCGCGCT GATCCACGCC GATCTGGTGC ACCCTGAGTC TACCGGCGCT 
GGCGCGGCGA TTGCCATTCT CGACACCGGT ATCGACGCTA CCCACCCATT CCTTGGCGGG 
CGCGTGGTTG CCGAAGCGTG TTTCTCGACC AACAACTCTG GTGATGGCGC TGTCTCCCTC 
TGTCCAGGCG GCGCAACGGA AGTCATTGGT CCTGGCGCGG CTGCGCCGTG TACCGTCACG 
GGGTGCGACC ACGGCACGCA CGTTGCCGGC ATCGCTGCCG GGAACGGCGG CGTAGCGCCG 
GGGGCGTCGA TCATTGCGGT GCAAGTCTTT TCGAAGATTA ACAATTGCTC GGCATTCTCG 
CTCCCCTCGC CGTGCGCGTT GAGTTATGTC TCCGACCAGT TGCGCGCGTT GGACTGGCTG 
GCATCGACAT CCTTCACCCC GCCGCTGGCA GTGGTCAACC TGAGCGTCGG CGCGGGAACG 
TTCAGCAGTG TTGCAGCCTG TGAAGGCAGT GCGGTGGGTG CCGCCCTGAA ACCTGCGATC 
ACAGCCCTGC GCGCCGGGGG CGTGCTTACC GTTGCATCAT CAGGCAACGG CGGCGCCGCC 
AACGCACTCA GCCTGCCCGC ATGTCTGTCG AACGTCGTCA GCGTTGGCGC GACGACCAAG 
ACAACCCCGG AGCAGGTGGC GTGGTTCTCG AACAGTGCGC TGTTCCTGAC CCTGCTAGCG 
CCGGGTGTCG CCATCACGTC TTCTGTGCCG GGGGGCGGGT CTGCGTCCAA ATCGGGGACA 
TCGATGGCAG CGCCACACGT GGCGGGAGCA ATTGCACTGC TGCGCAGTGC GCGACCCGGC 
CACACACCGG ATAGTTACGT GGCGGCGTTG ATTACCACCG GCGTGCCGAT CACCGACACG 
CGCAACGGAC TGACAAAGCC ACGCATCGAT GTGTTTGCCG CCGTCGAGTC GCTGGCGCCG 
CTCGAACCGA AAGCGTTCCT GCCACTCGTG GCACGGTAA

Protein sequence

MLMSSYRGSS RSTLLLILLL IGALTLPNVS GQAESAGSAR VIVVLRAPAA AEGDTSAAHF 
GITQAQDHVA AAATAAGARE VARLRTLPVL VLEAPHTAIE RLEQHPQVVA VAEDMLAAPH 
LTGSVALIHA DLVHPESTGA GAAIAILDTG IDATHPFLGG RVVAEACFST NNSGDGAVSL 
CPGGATEVIG PGAAAPCTVT GCDHGTHVAG IAAGNGGVAP GASIIAVQVF SKINNCSAFS 
LPSPCALSYV SDQLRALDWL ASTSFTPPLA VVNLSVGAGT FSSVAACEGS AVGAALKPAI 
TALRAGGVLT VASSGNGGAA NALSLPACLS NVVSVGATTK TTPEQVAWFS NSALFLTLLA 
PGVAITSSVP GGGSASKSGT SMAAPHVAGA IALLRSARPG HTPDSYVAAL ITTGVPITDT 
RNGLTKPRID VFAAVESLAP LEPKAFLPLV AR