Gene RPB_4382 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	RPB_4382
Symbol
ID	3912197
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Rhodopseudomonas palustris HaA2
Kingdom	Bacteria
Replicon accession	NC_007778
Strand	-
Start bp	4963887
End bp	4965527
Gene Length	1641 bp
Protein Length	546 aa
Translation table	11
GC content	70%
IMG OID	637886288
Product	glucose-methanol-choline oxidoreductase
Protein accession	YP_487980
Protein GI	86751484
COG category	[E] Amino acid transport and metabolism
COG ID	[COG2303] Choline dehydrogenase and related flavoproteins
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	20
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	17
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGACACAGG ACACGCAGGA CATCGATCAC GCCCGGGCCG TGGCGGAGAA CCAGACTCGT 
CTGCGCGCGC GATTGGCCGA CGGCTTCGAT TTCATCGTGT GCGGCGCCGG CTCGGCGGGC 
TGCGTGGTCG CGGCGCGTCT GGCCGAGAAG CCCGACGTGC GGGTGCTGCT GCTCGAAGCC 
GGCGACGGCG AGATGTCGCC CAGGCTCGTG GAGCCGGCGA TGTGGCCGAT GAATCTCGGC 
ACCGAGCGCG ACTGGGCGTT CGAATCGCAG CCGACGCCGA CCCTGAACGG GCGGCGCCTT 
CCGCTCAACA TGGGCAAGGG GCTCGGCGGC GGCTCGAGTA TCAACGTCAT GGTCTGGGCG 
CGCGGTCACC GCGCGGATTG GGACTACTTC GCCGCCGAGG CGGGCGACGG CTGCTGGGGT 
TACGAATCCG TGCTCGACAC CTATCGCCGC ATCGAGAGCT GGCAGGGCCA TCCCGACCTG 
CGTCGGCGCG GGACCGGCGG CCCCGTGCAT GTCGAACAGC CGGCCCAGCC GCGGCCGGTC 
GCCAGCGCGA TGGTCGAGGC CGCGAGCATG CTCGGCCTGC CGCGCTACGC CAGTCCGAAC 
GGCGAGATGA TGGAATCCGC CGGCGGCGTG GCATACGCGG ATCTGCGGAT CAAGAACGGG 
AAGCGGCAGT CGGTCCATCA GTCCTACACC TATCCGCGCA TGCACCAGCC GAACCTCACG 
GTGCTGACCC ACGCGACCGT CGGCCGGCTC GTGCTGGACG GCCACAAGGC GGTCGGGGTG 
CAGGCCCTGG TCGGCGATCG GCTGATGACC TTCGATGCGC GCCGCGAGGT CGTGCTGTCG 
CTCGGTGCGA TCAACACGCC GAAGCTGCTG ATGCAGTCCG GCATCGGCCC CGAGGACGAA 
CTGCGCGCCC ACGGCATCGA GGTGGTGCAG CATCTGCCGG GCGTCGGCCA AAATCATCAG 
GACCATGTCG CCTTCGGCTG CACCTGGGAA TATCTGCGGC CGCAGGAGGT CGGCAGCGGC 
GGGTGCGAGG CGAAACTGTA CTGGAAGAGC GATGCCCGCC TGGACGCGCC CGACATCCTG 
CAGTGTCAGC TCGGATTCGC CGTGCCGTCG CCGGCCGAGG TGGGGATCGC GCCACCGCAG 
CACGGCTGGA CGATGTTCGC CGGGCTGGCT CAGCCGAAGA GCCGCGGGCG TGTGCGGCTG 
TCCGGGCCCG ATATCGGCGA CGCCATGCTG ATCGAGCCCA ACGCGCTCAG CGAGCCCGAG 
GACATGGCCG CGGCGCGGGC GACCATCGAG CTCTGTCGCG AGATCGGCAA TCATCCGGCC 
TTCGGCCGGC AGGTGCAGCG CGAGGTCGTG CCCCGGCTGG GCGACCGCCT GGCCATGGAC 
CAGTTCATCC GAAACGCGGC GGTGACCTAC TGGCATCAAT GCGGCACCGC CAAGATGGGC 
CGCGACGCGA TGGCCGTGGT CGACCGGCGG CTCCGGGTCT ACGGGATCGA GAATCTCCGG 
ATCGCGGATG CGTCGATCAT GCCGCGGATC ACCTCCGGCA ACACGATGGC GCCCTGCGTC 
GTGATCGGCG AGCGCGCCGC CGACATGATC TGCGCCGCGC ATGACGACTC GTTCGACGTC 
GTCGAGCCCA TCGGCGCGTG A

Protein sequence

MTQDTQDIDH ARAVAENQTR LRARLADGFD FIVCGAGSAG CVVAARLAEK PDVRVLLLEA 
GDGEMSPRLV EPAMWPMNLG TERDWAFESQ PTPTLNGRRL PLNMGKGLGG GSSINVMVWA 
RGHRADWDYF AAEAGDGCWG YESVLDTYRR IESWQGHPDL RRRGTGGPVH VEQPAQPRPV 
ASAMVEAASM LGLPRYASPN GEMMESAGGV AYADLRIKNG KRQSVHQSYT YPRMHQPNLT 
VLTHATVGRL VLDGHKAVGV QALVGDRLMT FDARREVVLS LGAINTPKLL MQSGIGPEDE 
LRAHGIEVVQ HLPGVGQNHQ DHVAFGCTWE YLRPQEVGSG GCEAKLYWKS DARLDAPDIL 
QCQLGFAVPS PAEVGIAPPQ HGWTMFAGLA QPKSRGRVRL SGPDIGDAML IEPNALSEPE 
DMAAARATIE LCREIGNHPA FGRQVQREVV PRLGDRLAMD QFIRNAAVTY WHQCGTAKMG 
RDAMAVVDRR LRVYGIENLR IADASIMPRI TSGNTMAPCV VIGERAADMI CAAHDDSFDV 
VEPIGA