Gene Acid345_1521 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Acid345_1521
Symbol
ID	4073009
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Candidatus Koribacter versatilis Ellin345
Kingdom	Bacteria
Replicon accession	NC_008009
Strand	+
Start bp	1856768
End bp	1857997
Gene Length	1230 bp
Protein Length	409 aa
Translation table	11
GC content	56%
IMG OID	637983530
Product	phosphoesterase
Protein accession	YP_590597
Protein GI	94968549
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	10
Fosmid unclonability p-value	0.516758
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAGAAGA TCATCGCAAG CCTTACGCTC GCCGCTACGG CGTTCGCGAA TACGTCATTG 
TTTGCCGCCG AAGGAAACGC CGCTCCCACG GGCGTTCTTC ATCTCGATCA CGTTTGGGTG 
ATCCTGAGGG AAAACCATGG GTATGGCCAG CTTCGCAACA ATCCAAACGC TCCGTTTATC 
AACAAGTACG CGGAGAGTGC GAATACGGCT GACAACTATT TTGCGGTTGC GCATCCCAGC 
CTGACGAACT ACCTGGAAAT CGTGGGCGGA TCTAATTTCG GTGTTCTCGC CGACAATTTT 
CCCGACTGGC ACAATCCCGC GTGCACGCCC AACATAGTCT CAGGAACGCA GAACAATGAG 
CATTCCGGCG GAGCGCCGGT GTGTCCGATT TACGGCAACG GCAGCGACGC TCCGACACCG 
GCAATTGATA AAACAAATGA GACGACCGGC GAGCCTGGCA CGATCAACAT CGACGGGAAG 
ATGTCGATTC CCGCTGATAC GAGCACGCAT GGAAGGACGA TCGCAGACCA ACTGGTGGCG 
CGCGGCATGA CGTGGAAGAG CTACCAGGAG AACCTGCCGG TTTTTGGCGC GGACTACGTC 
AATTACAGTG ACGGCACGTT CACGAACAAT TCGATTTTGC CGGCGCCGTT GAAATCAAGC 
GACATCGTCC AGTTGTATGC CGTGAAGCAC AATCCATTTG CGTACTTCCA GTCAGTACAG 
GATGGGTACG ATCCGCAACT CAGTCTGAGT CAAGTGCGTG GTTTCGATGG GCAGGGCGGA 
CTATACGAAG ATCTGGGCTC GGGAAAAGTT CCGAACTTCT CGCTGATTGC GCCGAACCAG 
TGCAACGACC AGCACGGCCG CGGAAATGCA GGCCCCATCT GTAACTTCGA TCCGGCCGAC 
AATGGCACCC AGACCGGACT GAACAACGCG CTCATCTACC AGGGCGACGT AACTGTCCAA 
AGGCTCGTGA CTGCGATCCG GCGCTCGCCG GCATGGAACA GAGGCCGAAA CGCCATCGTT 
GTGGTGTGGG ATGAGAATGA CTACTCGCTT GTGCCGATCA CGAACCAGGT TTTGTTCATT 
GTTGACACCA ACTACGGCCG CCATGGCGTG CATAGTTCGC GGTTCTACGA TCACTTCTCG 
CTGCTGAGAA GCCTGGAGGC TGGTTTCGGG CTCTCCTGCC TGAACCACGC GTGCGACGCA 
CAATCGAAAG TGATGGGCGA TATCTTCTGA

Protein sequence

MKKIIASLTL AATAFANTSL FAAEGNAAPT GVLHLDHVWV ILRENHGYGQ LRNNPNAPFI 
NKYAESANTA DNYFAVAHPS LTNYLEIVGG SNFGVLADNF PDWHNPACTP NIVSGTQNNE 
HSGGAPVCPI YGNGSDAPTP AIDKTNETTG EPGTINIDGK MSIPADTSTH GRTIADQLVA 
RGMTWKSYQE NLPVFGADYV NYSDGTFTNN SILPAPLKSS DIVQLYAVKH NPFAYFQSVQ 
DGYDPQLSLS QVRGFDGQGG LYEDLGSGKV PNFSLIAPNQ CNDQHGRGNA GPICNFDPAD 
NGTQTGLNNA LIYQGDVTVQ RLVTAIRRSP AWNRGRNAIV VVWDENDYSL VPITNQVLFI 
VDTNYGRHGV HSSRFYDHFS LLRSLEAGFG LSCLNHACDA QSKVMGDIF