Gene Emin_0731 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Emin_0731
Symbol
ID	6262972
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Elusimicrobium minutum Pei191
Kingdom	Bacteria
Replicon accession	NC_010644
Strand	+
Start bp	806469
End bp	807527
Gene Length	1059 bp
Protein Length	352 aa
Translation table	11
GC content	40%
IMG OID	642611205
Product	peptidase M24
Protein accession	YP_001875623
Protein GI	187251141
COG category	[E] Amino acid transport and metabolism
COG ID	[COG0006] Xaa-Pro aminopeptidase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	27
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	12
Fosmid unclonability p-value	0.0000000317312
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGGTAAAAA CAAAATTTAA CCCCGAACTT ATTAAAAAAC TTCAAAAAGC TGTTGTGAAA 
AACAAATTAG ACGCTTATTT TGTAACCGAT TATAAGGACC AGCTTTATTT GACCGGTTTT 
AAATTTTACC CGCAGGAAGC TATTTTACTT GTAACTCCTA AAGAAGTTTA TTGTTACACA 
AGAGATTTAT ATATTATAGA ACTTGGGCAG AAAATACCCC TGTTAAAGGC TTCCGCCCCG 
TTAGATTACG CTTTGGCGGC AGCCGAACAG GCAAAAAAAC TTAAACTTAA AAATGTGGGT 
TTTGATGCGG TTAAAACATA TTATAATTAC GGCAAAACAT TTGAGAAATT CGGCTACAAA 
CCCTCAGCCT TTACGCCGGG TGAACTACGC GAGGTTAAAG AAAAAAGCGA GCTTGACACA 
ATGCGCAAAG CCAACCGCAT AGCTTATAAA ACCTATGAAT ATATTAAAAA ATATATTAAA 
ACCGGAATGA GCGAGTTTGA AGTAGCGGCC GAAATTGAAC GTTATATGAA ATCGCAGGGA 
GCTACAGCCT TAAGTTTTGA GTCAACAGTG TGCTTTGGCG TTAACGGTAC AAACACGCAC 
CACACCCCCA CAAAAGACAA ATTAAAAAAT GAGCAGGCCA TATTACTTGA TTTCGGCTGT 
ATTTATGATA ACTACTGCTC AGATATTTCA CGCAGCTGGT GGCACGGCAA AAAACCCACG 
GCTGAGTATA AAAAGGCCTG GAAAGCGGTT GATGACGCCA GAAAAGCCGG GATAAAAGCG 
GCTAAACCCG GTATTACCGG TAAAGAGCTT GACCTTGTTC CTAGAAATGT AATTGAAAAA 
GCAGGTTTTG GCAAATATTT TATACACAGG ACAGGCCACG GCATAGGCAT GCAGGCGCAT 
GAAGACCCTA ACGTGGAACC GCAAAATAAC AGGAAATTTG TTGCTAACAA CGTAATAACA 
ATTGAGCCCG GTATTTATTA CACAGGTCAT TTTGGCATAC GTATAGAAGA TACTGTTGTT 
GTCACACCTA AAGGCGGCGT AATTCTTACA AAGAAATAA

Protein sequence

MVKTKFNPEL IKKLQKAVVK NKLDAYFVTD YKDQLYLTGF KFYPQEAILL VTPKEVYCYT 
RDLYIIELGQ KIPLLKASAP LDYALAAAEQ AKKLKLKNVG FDAVKTYYNY GKTFEKFGYK 
PSAFTPGELR EVKEKSELDT MRKANRIAYK TYEYIKKYIK TGMSEFEVAA EIERYMKSQG 
ATALSFESTV CFGVNGTNTH HTPTKDKLKN EQAILLDFGC IYDNYCSDIS RSWWHGKKPT 
AEYKKAWKAV DDARKAGIKA AKPGITGKEL DLVPRNVIEK AGFGKYFIHR TGHGIGMQAH 
EDPNVEPQNN RKFVANNVIT IEPGIYYTGH FGIRIEDTVV VTPKGGVILT KK