Gene Rcas_2712 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_2712
Symbol
ID	5540198
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	-
Start bp	3500753
End bp	3501853
Gene Length	1101 bp
Protein Length	366 aa
Translation table	11
GC content	59%
IMG OID	640894838
Product	peptidase M29 aminopeptidase II
Protein accession	YP_001432801
Protein GI	156742672
COG category	[E] Amino acid transport and metabolism
COG ID	[COG2309] Leucyl aminopeptidase (aminopeptidase T)
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	16
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	29
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGCTGATC CCTATGTCGA AAAAATGGCG CAAGTGCTGG TGCGCTATTC GCTGGCACTC 
AAGCCAGGCG ATCTGTTTCG CATTATTGCG CCGCCTGCCG CCGCGCCACT GGTGCGCGCG 
TTGTACAAAG AAGCGTTGCT GGCGGGCGCC AACCCGTATC TGGCGATGAC CCTTGAAGAG 
ACCGATGAAC TGCTTCTGCG CCACGGCTCC GATGCGCAGA TCGGGTACGT CTCACCGATG 
ATGCGCCAGG AGATTGAAGA GATCAACGCA ACCATTCGCA TTATGGCGAG TGAGAATACC 
CGTGCGCTGT CCGGGATCGA TCCGCGCAAG GTTGCACTGC GTCGCCAGGC ATTGAGTGAC 
CTCCAGAAGC GTGTGATGCA GCGCTCCGCC GAAGGAACGC TCAACTGGTG CGTGACGCTC 
TTCCCGACCA ACGCCGCCGC ACAGGACGCC GATATGTCGC TGAGCGATTT TGAGGAGTTT 
GTCTACCGCG CCTGCAAACT CCACTATAAC GATCCGGTCG CTGAATGGCG TAGAACGCTG 
GAGGAACAAC AGCAGATCGC CGATTTCTTA AACACGTGCA GCGTCATTCG CCTGGTTGCG 
CCGGATACCG ACCTGACCTA CCGGGTCGCC GGGCGCACCT GGATCAACTG CGCCGGCGAT 
CGGAATTTCC CCGATGGTGA GGTCTTCTCC AGTTGCGATG AAACGGCAAC CGAGGGGTAC 
ATTCGCTACA CCTTCCCGGC GATCTATGCT GGACGCGAAG TCGAAGACAT CCGTTTGTGG 
TTCGAGGATG GTAAGGTTGT GAAGGCGACA GCCGCCAAGG GCGAAGACCT GCTGCACTCG 
CTGCTCGCTA TGGACGAAGG AGCACGGCGG TTGGGCGAGG TTGCGTTCGG GACAAACTAC 
GACATCACGC GCTTCAGTCG CAATATTCTG TTCGACGAAA AGATCGGCGG CACGGTGCAC 
CTGGCGCTCG GCGCCGGCTA CCCGGAGACC GGTTCGCGCA ATACATCGGC GCTCCACTGG 
GATATGATCT GCGATATGCG TCAGGGTGAA GCATACGCCG ACGGACGATT GATCTACAAA 
GAAGGGAAGT TTCTGATTTG A

Protein sequence

MADPYVEKMA QVLVRYSLAL KPGDLFRIIA PPAAAPLVRA LYKEALLAGA NPYLAMTLEE 
TDELLLRHGS DAQIGYVSPM MRQEIEEINA TIRIMASENT RALSGIDPRK VALRRQALSD 
LQKRVMQRSA EGTLNWCVTL FPTNAAAQDA DMSLSDFEEF VYRACKLHYN DPVAEWRRTL 
EEQQQIADFL NTCSVIRLVA PDTDLTYRVA GRTWINCAGD RNFPDGEVFS SCDETATEGY 
IRYTFPAIYA GREVEDIRLW FEDGKVVKAT AAKGEDLLHS LLAMDEGARR LGEVAFGTNY 
DITRFSRNIL FDEKIGGTVH LALGAGYPET GSRNTSALHW DMICDMRQGE AYADGRLIYK 
EGKFLI