Gene RPB_3839 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	RPB_3839
Symbol
ID	3911642
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Rhodopseudomonas palustris HaA2
Kingdom	Bacteria
Replicon accession	NC_007778
Strand	-
Start bp	4384806
End bp	4386140
Gene Length	1335 bp
Protein Length	444 aa
Translation table	11
GC content	69%
IMG OID	637885739
Product	glycosyl transferase, group 1
Protein accession	YP_487443
Protein GI	86750947
COG category	[M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0438] Glycosyltransferase
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	11
Plasmid unclonability p-value	0.24097
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	16
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

TTGGCGCAGC CCCCCGACAG CCAGACCCCG CCGCCGCGAC AACCCTGGCT GTGGATGGAC 
GTATCGACCA GCGCTCGCGC GCGCTCCGGC CAGATGAACG GCACGCTGCG GGTCGAGCAC 
AGAATCGCCA CCGCGTTGCG CGAACGGATC GGACCGCAGC TCGGATTTTG CCGCTACGAA 
CCGCTGCGAC AGGACTACGT GCCGGTTGCG GCGGTGCCCG ATCTCGGCGC CAAGCCGGTC 
GCCGCGGCGA AGCCGAAGGC GGCGCGTGCC ACGATGCTGT CGTCGATCAA GCCGCTCGGC 
AAGAAACTCG AACGCGCGGT TCGTACTTCG GTGCGTGGCG CTGTCGCGCC GCTGCTGCAG 
AAAATGGCCG GCGGCGAGGG GCTGCCGCCG CCCGGCCCGG CTGCGGGCCA CGAGGTGCTG 
CTGCTCGCCG GCGAGAACTG GTCGCGGGTC GACTACGCAG CGGTGGCGCG GATGCGCCGC 
GCGCGCGGAA CCCGGATCGC GGCGGTGTGC CAGGACTTCA TCCCGGTGGT CGCGCCGCAA 
TTCTTCGCCG ACGGCGAGTT CGTCACGCAG TTCGAGGCCT ATGCGCAGTT CCTGATCCGC 
GAATGCGACA TGGTGATTTC GATTTCCGAC TCCACCAGCG CCGACGTGCG CGCCTATGCG 
CAGCGCCATG GCGGGTTGCG CGGCGCGATC GAGGTGGTGC ATCTGGGCGC CGATCTGGCG 
ACGCCGGCGA CCGCGCGCCG GCCCGCTGCG CTCGGCGACG GGCAGGCGCA GCGCTTCGTG 
CTCAGCGTCT CGACCATCCA GTCGCGCAAG AATTTCGATC TGCTGTATCA CTTGTGGCGG 
CGCTTGACCG AGCAGGGCAC GCCTCGTCTG CCGACGCTGG TGATCGTCGG GCAGCCCGGC 
TTCGGCAGTG CCGACCTGCT GTGGCAGATC GCGCATGATC CGGTCACCGC GTCGTCGATC 
CTGCATCTGC CTCGCGCTGG CGACGAGGAA CTGGCGTGGC TGTACCGGAA CTGCGCGTTT 
ACGCTGTATC CCTCGTTCTA CGAGGGCTGG GGACTGCCGG TGTCGGAGAG CCTCGCCTTC 
GGCAAGTACT GTCTCGCATC GAACACGTCG TCACTGCCGG AAGCCGGCGC CGGCCTCGCG 
GGGCACCTCG ATCCGCTGGA TTTCGCAGCC TGGCGCGATG CGGTGCTTGA CCTGATCCAT 
TCCCCTGAGC AACTTGCCGG ATACGAAGCC GCGATCCGGT CGAACTATCG CCCGGTAACC 
TGGGCGCAAT CCGCCGGCCG GATGGTGGAG GTGCTGCGCA GCGTAGCGGC TGCCCCTGCC 
GGTTTCACGA GCTAG

Protein sequence

MAQPPDSQTP PPRQPWLWMD VSTSARARSG QMNGTLRVEH RIATALRERI GPQLGFCRYE 
PLRQDYVPVA AVPDLGAKPV AAAKPKAARA TMLSSIKPLG KKLERAVRTS VRGAVAPLLQ 
KMAGGEGLPP PGPAAGHEVL LLAGENWSRV DYAAVARMRR ARGTRIAAVC QDFIPVVAPQ 
FFADGEFVTQ FEAYAQFLIR ECDMVISISD STSADVRAYA QRHGGLRGAI EVVHLGADLA 
TPATARRPAA LGDGQAQRFV LSVSTIQSRK NFDLLYHLWR RLTEQGTPRL PTLVIVGQPG 
FGSADLLWQI AHDPVTASSI LHLPRAGDEE LAWLYRNCAF TLYPSFYEGW GLPVSESLAF 
GKYCLASNTS SLPEAGAGLA GHLDPLDFAA WRDAVLDLIH SPEQLAGYEA AIRSNYRPVT 
WAQSAGRMVE VLRSVAAAPA GFTS