Gene Rcas_2066 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_2066
Symbol
ID	5539546
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	2652305
End bp	2653483
Gene Length	1179 bp
Protein Length	392 aa
Translation table	11
GC content	62%
IMG OID	640894201
Product	peptidase M24
Protein accession	YP_001432170
Protein GI	156742041
COG category	[E] Amino acid transport and metabolism
COG ID	[COG0006] Xaa-Pro aminopeptidase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	13
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	20
Fosmid unclonability p-value	0.804468
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCTCTACT ATCAGAAAGC TGCTCAGGCA GAGGCATTGC TTGCCGAAAC CAATCTCGAT 
GCCTGGCTCA TCTTCGCACG TGAAAGCGTG ATCCGTCCTG ACCCAGGCAT CGAACTCGTT 
GTTGGTGTTG ATGTGACGTG GGACTCGGCA TTCATCTTTG GGCGCAATGG GCAGCGCGTC 
GCGCTTGTGG GGCGTTACGA CGTCGCCGGT GTGCGCGAGT CGGGGCTGTT TCCGACGATC 
ATTGGCTATG ATGAAAGCAT CCGCGATCAT CTGATCGATG TCCTGCGCCG CCTTGATCCG 
CTGACTATCG GGTTGAACTA TAGCCTCGAC GACCCGACAG CCGATGGACT GACTCACGGC 
ATGTTTCTGC ATCTCTGCGA CCTGTTGGCA GACACGCCCT TTCCGTCACG TTTTGTGAGC 
GCCGCGCCCC TGCTGGCGAA GTTGCGTTCG CGTAAGACGC CAGCCGAGGT GGAGCGCATT 
CGCGCTGCCG TCGCCGTCAC CGAAGAGATC GTCGATCTGG TTGCACAACA GATTCGCCCT 
GGCGTCAGTG AGGCGCAGAT CGCCGCTTTC GTTCATGAGG AGTTTCGCCG CCGCAATCTG 
GCGAGCGCCT GGTCATGGGA TGCCTGCCCG ATTGTGAATA GCGGTCCCGA ATCAGAAGTC 
GGTCATGGCG GTCCGCGTAA TGACATCGTG GTGCAGCCGG GGCATCTGGT GCACATTGAT 
CTGGGCGTTC AGCGCGAGGG GTACTGCTCG GATATTCAGC GCATGTGGTA TGTGCGTCGT 
CCTGGTGAAA CGGCGCCCCC GCCGGACGTT CAGCGCGCTT TCGAGACGGT GGTGCGGGCG 
ATCGAGGCGG GCGCAGCGGC GCTGCGCCCC GGCGCGCGCG GATACGCGGT GGACGCAGCG 
GCGCGTCAGG TCATTGTTGC AGCGGGATAC GACGAGTACC GCCACGCACT GGGGCATGGT 
CTGGGGCGCG CCTGTCACGA CGGCGGTCCG TTGCTCGGTC CGCGCTGGCC TCGCTACGGC 
AAAACGCCGG AAATGCATGT CGAGGCGGGG AATGTCTACA CCCTTGAACT GGGTGTCGTC 
ACTGCGGCAG GGTATATCGG CATCGAGGAA GATGTGCTGG TGACTGACAA AGGCGTAGAG 
TTTCTCTCGA CCTTTCAGCG CAGGTTGTGG GAGGTGTGA

Protein sequence

MLYYQKAAQA EALLAETNLD AWLIFARESV IRPDPGIELV VGVDVTWDSA FIFGRNGQRV 
ALVGRYDVAG VRESGLFPTI IGYDESIRDH LIDVLRRLDP LTIGLNYSLD DPTADGLTHG 
MFLHLCDLLA DTPFPSRFVS AAPLLAKLRS RKTPAEVERI RAAVAVTEEI VDLVAQQIRP 
GVSEAQIAAF VHEEFRRRNL ASAWSWDACP IVNSGPESEV GHGGPRNDIV VQPGHLVHID 
LGVQREGYCS DIQRMWYVRR PGETAPPPDV QRAFETVVRA IEAGAAALRP GARGYAVDAA 
ARQVIVAAGY DEYRHALGHG LGRACHDGGP LLGPRWPRYG KTPEMHVEAG NVYTLELGVV 
TAAGYIGIEE DVLVTDKGVE FLSTFQRRLW EV