Gene Plim_4095 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Plim_4095
Symbol
ID	9140815
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Planctomyces limnophilus DSM 3776
Kingdom	Bacteria
Replicon accession	NC_014148
Strand	+
Start bp	5252581
End bp	5253879
Gene Length	1299 bp
Protein Length	432 aa
Translation table	11
GC content	55%
IMG OID
Product	protein of unknown function DUF1501
Protein accession	YP_003632105
Protein GI	296124327
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	14
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGGCGACCA GTTATACATG TGATGGCATT CAACGACGCG ATGCACTGAA AGCAGGGCTG 
CTGGGAGTGG GAGGCTTATC GCTTTCTAAC TTTTTGAAGC TCAGCCATGC AGGGGAAGTT 
TCCTCCAAGG CCAAGGCCAA AGCTGCGATC TATATCAACC TGGGGGGTGG CCCCAGCCAC 
ATGGACACCT TCGATATGAA GCCCAATGCA CCGGCTGAGT ATCGCGGGGA ATTCAATCCC 
ATTAAAACGA ACGTCGCCGG GATCGAGATC TGTGAGCACT TGCCCCATCT GGCGAAACAG 
GCCGACAAGT TCGCCCTCAT TCGTGGTGTC TCGCACACTC TGGCGGCTCA TGAACTGGGC 
ACGCAATATG TCAACTGCGG CAACCGGCCT ATCCCTTCGC TGGAATTCCC GGGATATGGC 
TCGGTGGTTG CCAAGGAGTT GGGTGGCCCG GATAACCTGC CCGCCTATGT GGCCATTCCA 
CGAACGAGTT CAAAGTCGGG TTATCTGGGA GTGAAGTACG CACCACTGGC CACGGGGAAC 
ACACCCAAGG CCGGTATGCC TTATTCGGTG CGTGGGGTTT CACTGCAGAA TGGATTGACA 
GTGCAGGAAG TGGATCGTCG CAAGAATCTG CTCAACGATC TTGATCGGAC GTTTGCTGGT 
TACGAAAAGC AGAACCAGTT GCTGGAAGGG ATGGATCAGT TTGCCGAGCA GGCCTACTCG 
ATGATCACTT CACCAGCCGC CCGCAAAGCG TTTGATATCA GCCAGGAATC TCCCAAGTTT 
GCCGAGCCAT TCGGTGAGAC ACCCTTTGGA ACCAGCTGCC TGCTGGCAAC GAGGCTGATC 
GAATCGGGAG TGAGGTTTGT CACGATTTCG TACGGCGGAT GGGATACTCA TGATGACAAC 
TGGACGCGGC TGAAAGAAAA GCAGTTGCCT CCGTTTGATG AAGGTCTGGC GGCCTTGCTG 
GCAGGTCTGG CTCAGAAGGG CTTGCTCGAT TCGACCGCTG TCTTTGTGAC AGGTGAGTTT 
GGTCGAACAC CCAAGATCAA TGGCCGCGCT GGTCGGGATC ACTTTGCCCG CAATATGTTC 
ATGATTATGG CAGGTGGTGG CGTGCGTGCG GGTCAGGTGA TTGGTGCCAG CGATGAAAAA 
GCCATGGCAC CAGCGAGCCA GGCCATTACA CCTGATGATG TGGCCGCTTC GTTCTATCAC 
AATCTCGGGA TTGATCCCAA GAAAGAATAT CAGACCAACA CCGGGCGGCC ACTGATGATT 
GTGCGTGACG GGAACATTAT TCCTTCACTG TTTGCCTGA

Protein sequence

MATSYTCDGI QRRDALKAGL LGVGGLSLSN FLKLSHAGEV SSKAKAKAAI YINLGGGPSH 
MDTFDMKPNA PAEYRGEFNP IKTNVAGIEI CEHLPHLAKQ ADKFALIRGV SHTLAAHELG 
TQYVNCGNRP IPSLEFPGYG SVVAKELGGP DNLPAYVAIP RTSSKSGYLG VKYAPLATGN 
TPKAGMPYSV RGVSLQNGLT VQEVDRRKNL LNDLDRTFAG YEKQNQLLEG MDQFAEQAYS 
MITSPAARKA FDISQESPKF AEPFGETPFG TSCLLATRLI ESGVRFVTIS YGGWDTHDDN 
WTRLKEKQLP PFDEGLAALL AGLAQKGLLD STAVFVTGEF GRTPKINGRA GRDHFARNMF 
MIMAGGGVRA GQVIGASDEK AMAPASQAIT PDDVAASFYH NLGIDPKKEY QTNTGRPLMI 
VRDGNIIPSL FA