Gene Rcas_3312 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_3312
Symbol
ID	5540810
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	4322582
End bp	4323610
Gene Length	1029 bp
Protein Length	342 aa
Translation table	11
GC content	59%
IMG OID	640895430
Product	membrane dipeptidase
Protein accession	YP_001433381
Protein GI	156743252
COG category	[E] Amino acid transport and metabolism
COG ID	[COG2355] Zn-dependent dipeptidase, microsomal dipeptidase homolog
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	0.965789
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	20
Fosmid unclonability p-value	0.649064
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGACATCAG CACTGCCAGT CTTCGATGGT CATAATGACA CTTTACTGCG TCTCTACACC 
GCAGAACACA ACGACTCATT CTTTTCATCA CCACACGGAC ACCTCGATCT GTCACGCGCC 
CGCACAGGCG GTTTTGCCGG CGGTTTCTTC GCAGTCTTTG TTCCGCCGCC AACCCATGCG 
TCATCGCCCG ATGATGGCAT CCTGCCCGAT CCGCTGCCCT ACGCCTACGC GCTCCAAACC 
ACACTGGGCA TGGCGGCGCT CCTCTTTCGC ATCGAATCCC AATCCGCCGG GCAGGTTTGC 
GTTGCGCGCA CGGTCAGCGA AATCGAGTAC GGACTTCAGA CCGATACCCT GAGCGCCATC 
CTGCACCTGG AGGGCGCCGA TCCCATCGAT ACTGAGTTTC ATACGCTCGA AGTGTTGTAT 
CAGGCGGGTC TCCGTTCGCT TGGCATCGTC TGGAGTCGAC CAAATGCATA TGGATACGGC 
GTACCGTTTC GTTTCCCCCA TACCCCCGAT ATTGGTCCCG GTCTGACCGA TGCCGGACGT 
GAACTGGTTC GGGCGTGCAA TCGTCTTGGC GTTCTGATCG ACCTTTCTCA CCTGAATGAA 
GCCGGTTTCT GGGATGTGGC ACGGTTGAGC GATGCGCCGT TGGTTGCCAC ACACTCGAAT 
GCGCACACAA TCTGCCCATC GCCACGCAAC CTGACCGACC GGCAACTCGA TGCAATCCGC 
GAGTCGGATG GGATGGTCGG GGTCAATTTC CATGTTGGCT TCCTTCGCCC GGATGGGCAG 
CGTGACGCGA ACACGTCGCT GGACGTCGTG GCGAATCATG TCATCTACCT GGTCGAGCGC 
CTGGGGCTTG ATCGCGTGGG TTTCGGTTCG GATTTCGACG GCGCGCTGAT GCCATATGAT 
CTCGGAGATG CCGCCGGATT GCCACGTCTG CTGGAAACAT TGCGCCGTCG CGGGTTCGAT 
GCGCCATCGC TGCGCAAACT GGCGCACGAA AACTGGCTGC GCGTCTTGCG AAAAACATGG 
CGATCATGA

Protein sequence

MTSALPVFDG HNDTLLRLYT AEHNDSFFSS PHGHLDLSRA RTGGFAGGFF AVFVPPPTHA 
SSPDDGILPD PLPYAYALQT TLGMAALLFR IESQSAGQVC VARTVSEIEY GLQTDTLSAI 
LHLEGADPID TEFHTLEVLY QAGLRSLGIV WSRPNAYGYG VPFRFPHTPD IGPGLTDAGR 
ELVRACNRLG VLIDLSHLNE AGFWDVARLS DAPLVATHSN AHTICPSPRN LTDRQLDAIR 
ESDGMVGVNF HVGFLRPDGQ RDANTSLDVV ANHVIYLVER LGLDRVGFGS DFDGALMPYD 
LGDAAGLPRL LETLRRRGFD APSLRKLAHE NWLRVLRKTW RS