Gene Pars_1564 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Pars_1564
Symbol
ID	5055130
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Pyrobaculum arsenaticum DSM 13514
Kingdom	Archaea
Replicon accession	NC_009376
Strand	+
Start bp	1414234
End bp	1415238
Gene Length	1005 bp
Protein Length	334 aa
Translation table	11
GC content	50%
IMG OID	640469105
Product	sugar phospate transferase
Protein accession	YP_001153770
Protein GI	145591768
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG1207] N-acetylglucosamine-1-phosphate uridyltransferase (contains nucleotidyltransferase and I-patch acetyltransferase domains)
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	20
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	4
Fosmid unclonability p-value	0.0000000011841
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

GTGGAAATTG CGTTGGTAGG ATCTCTTAGC CCTAGGCTGG CTGTACCTTC GCCCTATGTC 
ATAGCTGGCG GCTTTAGACT TGTAGAACTG GCTGCATTGT CCACGTGCGA AGATGGCAAG 
GCGGTGATCT ACGTAGAGGA TAGTGCGGAT CTACCCCTAA TCTTAGAGGG CTGTAAGCTT 
GAGATCAGGA GGGGGATTCC CAGAGACGTT CCGAAAGTTC ACGTGGGGTG CGTCCCGTAC 
TTGTTGAGAT CGAGAAATTT AAAATGCGGC GGCTTTTACG TAAATCTCGG CGGCGAAGAG 
ATGGTCGTGG AGCCCCTCAC ATCGCTTGCC GATATTATTG AGAAAAACGT AGAAATTATG 
AATATGGCCT TTAACAAACT TAGGGAGCTT GGCGTGGAGC TTGTAAGAGG AGACGTGAAA 
GGAGAGACAA GGGGTTTGGT ATATGTAAGA GGCAAAATAT ACGAATACAC ATACGTTGAG 
GGCCCCGCCG TGGTTGGGCC CTCCTCTGCG GTTTTGCCTT TTACCTATGT GAGACCGGGC 
ACTACGCTTT ATTTCGACTC GAAGATCAGG GAGGAGGCCA AAAATGCTAT TCTCGACGCC 
TATACCCGGA AGCAACATAC GGGATATCTA GGCGATGCGT ATGTATCTGC CTTTGTCAAC 
ATGGGGGCCG GCACCACGGT CTCTAACTTG AAGAACACCC TGGGCCTAAT TAGGCCTTCC 
TACACCTCCA GGGCGTACCG AAAGCTGGGC CCTATACTAG GCGAGTTTGT GAAGACGGCT 
ATCGGCACTT TAATATACGG CGGGCGGTAT GTAGGCCCTC TCTCGCATGT ATACGGGGTA 
GTTGATAGGG ATGTGCCTCC TCTTTCCATA TTCAAAAACG GAGAAGTGAA GCCGATGGAT 
AGAGACAAGG CTATTGAGTT ATTACAGCGC GACTTGGCCC AATTCGGCCG CTCTGATCTT 
GGCCCCTATT TTAAAACACG CCTAATCGAG CAGTCTCTGT TTTAG

Protein sequence

MEIALVGSLS PRLAVPSPYV IAGGFRLVEL AALSTCEDGK AVIYVEDSAD LPLILEGCKL 
EIRRGIPRDV PKVHVGCVPY LLRSRNLKCG GFYVNLGGEE MVVEPLTSLA DIIEKNVEIM 
NMAFNKLREL GVELVRGDVK GETRGLVYVR GKIYEYTYVE GPAVVGPSSA VLPFTYVRPG 
TTLYFDSKIR EEAKNAILDA YTRKQHTGYL GDAYVSAFVN MGAGTTVSNL KNTLGLIRPS 
YTSRAYRKLG PILGEFVKTA IGTLIYGGRY VGPLSHVYGV VDRDVPPLSI FKNGEVKPMD 
RDKAIELLQR DLAQFGRSDL GPYFKTRLIE QSLF