Gene Elen_2047 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Elen_2047
Symbol
ID	8416358
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Eggerthella lenta DSM 2243
Kingdom	Bacteria
Replicon accession	NC_013204
Strand	+
Start bp	2398272
End bp	2399486
Gene Length	1215 bp
Protein Length	404 aa
Translation table	11
GC content	48%
IMG OID	645025024
Product	hypothetical protein
Protein accession	YP_003182400
Protein GI	257791794
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	14
Plasmid unclonability p-value	0.531982
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	38
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAAATCT ACATCGCCGC CCACAAGCAC ATGAAGCTGC ACACGAACCA GCCATATCAG 
CCGCTTTTTG TCGGAGCGTT CCGGTGCCCT GAAGCCAACC GACGCGACGG TTGGCAATAC 
GACGATACGG GAGTCGACGA TATCTCGTAC AAAAATGCTA CCTTCTGCGA GTTGACAGGT 
GTCAACTGGA TACTGCATAA CAATGAGAGC GACATTACAG GACTTGTTCA CTATCGAAGG 
TATTTCCGAT CTTCCACCGA ATGCAACGAA CCTTTATCAG AACAAGAGAT AAGGACCGCT 
CTCTCCAAGC ACGACTGCAT CGTTGCACAA CGGACATTCT GCACAAGCAA ACTTGATGGA 
TATCTCTGCT CTGCAGCTGA GCAGTACAGA ACATGTCACT CTTCGACCGA TCTCACTCAG 
CTCGACAGGG TAATCAAACG GTATTTTCGG TCGTACCATC CTGCTTTCAG GCTCTGCATG 
AAACGCGATT ATCTCCATCC CTTCAATATG CTCATATGCA GAAAAGAACT ATTCGATGAG 
TACTGCCGCT GGCTTTTTGA GGTCGAAAGC CGACTCGAAG AACGCATCGA CCCTTATCTT 
GATCGAGACG ACTATCAAAA AAGAGTATTT GGATTCCTTG CAGAGCGCCT TATGAACGTG 
TATCTCGAGG CCAAAGGTAT CGACGTGGTC GAATATCCTA TTTTTGACCC CATCCATCCC 
GACGATAGCA GCGTGTTGCC CTTAAAGAAA CCTCCACTTG TCCGATCTGA CGTTGGATTG 
TCGTACCCCA CAATTCAGCC TGTCTACGAA GGAATCGACT ACTCGAAGGT GTTCGAATAT 
CGCTTTTACC TTACGCATAA TGAAGACTTG GCAAAAGCCT ACTCAGACAA TCCCCAAGAA 
TCGCTACAGC ACTTCATTGT GCATGGTGCG CGCGAAAAAC GCATGGCGCA TCCTTGCTTT 
TCGGTTGCTT CCTACATGCA AGGACACCCT GAACTTAAGC CCGAATACGG AGACGATCCC 
CTCGCATATG TTTCACATTA CCTCTCTACT CCCTCAGAGC GTAATCATGC AACAGGATAC 
GAGAATCTGC AGACACCTTC GTTAGAAAAA CGAGAGGCGC TTTCCTCTGA GCGCACTTGC 
ACGGGAAAGC GCATCAATAA AAAACGGCTT TCGCGATATA TCGCGAAAGC CGAAAAACTA 
CCCGTGCTGG ATTAG

Protein sequence

MKIYIAAHKH MKLHTNQPYQ PLFVGAFRCP EANRRDGWQY DDTGVDDISY KNATFCELTG 
VNWILHNNES DITGLVHYRR YFRSSTECNE PLSEQEIRTA LSKHDCIVAQ RTFCTSKLDG 
YLCSAAEQYR TCHSSTDLTQ LDRVIKRYFR SYHPAFRLCM KRDYLHPFNM LICRKELFDE 
YCRWLFEVES RLEERIDPYL DRDDYQKRVF GFLAERLMNV YLEAKGIDVV EYPIFDPIHP 
DDSSVLPLKK PPLVRSDVGL SYPTIQPVYE GIDYSKVFEY RFYLTHNEDL AKAYSDNPQE 
SLQHFIVHGA REKRMAHPCF SVASYMQGHP ELKPEYGDDP LAYVSHYLST PSERNHATGY 
ENLQTPSLEK REALSSERTC TGKRINKKRL SRYIAKAEKL PVLD