Gene RPB_3244 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	RPB_3244
Symbol
ID	3911045
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Rhodopseudomonas palustris HaA2
Kingdom	Bacteria
Replicon accession	NC_007778
Strand	-
Start bp	3706532
End bp	3707728
Gene Length	1197 bp
Protein Length	398 aa
Translation table	11
GC content	68%
IMG OID	637885146
Product	hypothetical protein
Protein accession	YP_486851
Protein GI	86750355
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	18
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	20
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAGTGTCG GTACCGGGGC GCGTTCACTG CCCAACCATC GTGGGGCCCG CTATATGGGT 
TTTCGTAAGT CACTTGGCGC GATCGCCATC GCGCTGCCGG TGATGGGCTG CGTCTGGACG 
GTGTATGCCA ACACCGTGGG CGCAAGCATC TATCCCAGCG TCGGCACTTG GGGCGAGGAG 
CCCGCCAGCC GCACGGATTC GCGTCCCGAG CGACCGAATT TCGCATCGCG TTTCGAGCCG 
CTGGCCGCGG CTGCGGAGAG TGCGCCACGC CTGATGGCGC ATCTCGCCCT GAAAAACGCC 
ATGGCCAAGC AGGGCGCTGC GCCGGTGCAG GTCGCTTCCG CCGATCCCGG CGACGTTCCC 
GTCACCGCCA GCGTGCAGGC CGCCAACGCT GCAGCGCCGC AGGCCAAGTC CGGTCACCGC 
TATTACGCGC TGCTCGACGC CAATTATTCG TTCGGTTTCG AGCCCGACAG GTTCAGGCCC 
GCGCAAAATA AATCGGCCGA GCCGGCCGCG GTCGATGCCG CCGGCAAGGC GGGAGCGGAC 
GCGAAACTGG CGCTGGCCGT GCCGATGCCG CCGGAGCGCA AGTCGGTGGC CTCCCGCGTC 
GCGCCCGGCC CGACCCGCAA CCCGTTCAGC CAGGAAGCGC TGGTGGCGCG CGCCAAGGCG 
GTGCTGATGG CGCAGAAGGC GGAGAGCAAG TCGAGCTTCT TCGAGAAACT GTTCGGCAAG 
CCCGACGCCC CGGCGCTGGC CTATGCGTCC GCCGAAGCCG GCGTGACCAG CACCGGCGAG 
CCGCGCGATC CTGCCTTCAG TCCGTCCGAG GACGACCGCT ACACCGCAGT CTACGACATC 
ACGGCCAAGA CCGTGTACAT GCCGGACGGC AGCAAGCTCG AAGCCCATTC GGGCCTTGGT 
CCCAAGATGG ACGATCCGCG CCACGTCAAC GTCCGGATGC ACGGCGCGAC GCCGCCGCAC 
ATCTACGACA TGAAGATGCG CGAGGCGCTG TTCCACGGCG TCGCGGCGAT CCGGCTGACG 
CCGGTCGGCG GCCAGGACTT GATCCACGGC CGCACCGGCC TGTTGGCGCA CAGCTACATG 
CTTGGCCCGC GCGGCGACTC CAACGGTTGC GTCTCGTTCA AGGACTACAA TGCCTTCCTG 
CAGGCGTTCA AACGCGGCGA GGTCAAACGC CTCGTCGTCG TCGGCAGCAT GACCTGA

Protein sequence

MSVGTGARSL PNHRGARYMG FRKSLGAIAI ALPVMGCVWT VYANTVGASI YPSVGTWGEE 
PASRTDSRPE RPNFASRFEP LAAAAESAPR LMAHLALKNA MAKQGAAPVQ VASADPGDVP 
VTASVQAANA AAPQAKSGHR YYALLDANYS FGFEPDRFRP AQNKSAEPAA VDAAGKAGAD 
AKLALAVPMP PERKSVASRV APGPTRNPFS QEALVARAKA VLMAQKAESK SSFFEKLFGK 
PDAPALAYAS AEAGVTSTGE PRDPAFSPSE DDRYTAVYDI TAKTVYMPDG SKLEAHSGLG 
PKMDDPRHVN VRMHGATPPH IYDMKMREAL FHGVAAIRLT PVGGQDLIHG RTGLLAHSYM 
LGPRGDSNGC VSFKDYNAFL QAFKRGEVKR LVVVGSMT