Gene Dole_2851 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Dole_2851
Symbol
ID	5695709
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Desulfococcus oleovorans Hxd3
Kingdom	Bacteria
Replicon accession	NC_009943
Strand	+
Start bp	3436284
End bp	3437621
Gene Length	1338 bp
Protein Length	445 aa
Translation table	11
GC content	60%
IMG OID	641265466
Product	hypothetical protein
Protein accession	YP_001530731
Protein GI	158522861
COG category	[S] Function unknown
COG ID	[COG4198] Uncharacterized conserved protein
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	0.0586103
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGGCACGCG TTGTCCCTTT GCGGGGGATT CTCTATAATC CTGAAAAAAC GGGGGGTTTT 
GGAAACGTGG TCTCCCCTCC CTACGATGTC ATCTCAGCTG GCTACCAGAA GGTCCTGTGT 
GACCGCCACC CCCATAATGT GGTCCGGCTG ATTCTCGGCG AGCCCGGGGA AAACGCCGGG 
GAAACTCCAC GGTTTTACGG GGCCTCGGCC CAGCGGTTTG AAGAATGGCG GGCACAAGGC 
ATTCTTGCGC AAGACAGCGA GCCCGCCTTT TATCTCTCCT CGGTCACCTT TTCCGTGGAG 
CAGCAGACTT ACACCCGTTA CGGCATCATC GCCGAAGTGG GGCTGGAGCC CTTTGAACGG 
GGCATCATTC TGCCCCACGA GCGGACCTCC TCCAAGGTCA AGGCCGACCG GCTGCTTTTG 
ACAAAGGCCA CAAAAGCCAA CTTCAGCCCC ATCTTCTCCC TCTTTTCCGA TGACGACAAC 
CGGGTACTGA ATCTGGTAAA ACAGGCCACC GGCGGCAACA CCCCGGATGC CTCCTTTGTG 
GATGACCGGG GCGAAAAACA GTGCCTGTGG CGCATCACGG ACAAAGCCGT GCAGCAGGAG 
ATCTCACGGG CAATGGCCGA CAAACAGCTT TTTATCGCCG ACGGCCACCA CCGTTACGAA 
ACGGCCCTGG CCTACCGGCA GTGGGTGGCC GACCAGACCC CGGATTTTTC CGACCGCCAC 
CCGGCCGATT ATGTGCTCAT GTACCTGTCC AGCATGGCCG ACCCCGGCCT GGTGATTCTC 
CCGGCCCACC GCCTGCTGAA GGGGGTGGCA CCGGCCCGGC GCGACCGGTT CCTGGAAGAG 
GCGTCCGCCT GTTTCGACAT TCAGACGATT CCCGTGACTG GGGCCGACCT GTCCGCGGCC 
CGGAAGGAAC TGATGGGACA GCTGCAGGCC GATACCGCAA ATAACACCAT CGGCTGCGCC 
ATCGGCGGTA AGGATGCCTT TTACCTGCTT ACCCCCAAGC CCCGGGTGAT GGAGACCGTC 
TTCTCAGGAG AGGTACCGCC GGTGCTCCGC ACCCTTGACG TTACCGTGCT CACCCGGCTG 
ATCCTGATCC AAATACTGGG GTACCCCCTT GCCGATCTGG ATGACGAACA TGTGCTGGCC 
TATACCAGCA TCGCCGGCGA AGCATTTGAC GCTGTGGCTT CAGGCGACTG CGACATGGCG 
TTCCTTTTAA ACCCCACGAC CAACGACCAG ATGAAGGCCG TGGCAGGGGC CGGGGAGATC 
ATGCCGAGAA AATCGACCTT TTATTATCCA AAAGTGTTTG CGGGACTTGT CTTAAGCAGC 
AAGGCAGGAA CCCGCTGA

Protein sequence

MARVVPLRGI LYNPEKTGGF GNVVSPPYDV ISAGYQKVLC DRHPHNVVRL ILGEPGENAG 
ETPRFYGASA QRFEEWRAQG ILAQDSEPAF YLSSVTFSVE QQTYTRYGII AEVGLEPFER 
GIILPHERTS SKVKADRLLL TKATKANFSP IFSLFSDDDN RVLNLVKQAT GGNTPDASFV 
DDRGEKQCLW RITDKAVQQE ISRAMADKQL FIADGHHRYE TALAYRQWVA DQTPDFSDRH 
PADYVLMYLS SMADPGLVIL PAHRLLKGVA PARRDRFLEE ASACFDIQTI PVTGADLSAA 
RKELMGQLQA DTANNTIGCA IGGKDAFYLL TPKPRVMETV FSGEVPPVLR TLDVTVLTRL 
ILIQILGYPL ADLDDEHVLA YTSIAGEAFD AVASGDCDMA FLLNPTTNDQ MKAVAGAGEI 
MPRKSTFYYP KVFAGLVLSS KAGTR