Gene Noc_0844 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Noc_0844
Symbol	glcE
ID	3707149
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nitrosococcus oceani ATCC 19707
Kingdom	Bacteria
Replicon accession	NC_007484
Strand	-
Start bp	921882
End bp	922952
Gene Length	1071 bp
Protein Length	356 aa
Translation table	11
GC content	55%
IMG OID	637737346
Product	glycolate oxidase FAD binding subunit
Protein accession	YP_342887
Protein GI	77164362
COG category	[C] Energy production and conversion
COG ID	[COG0277] FAD/FMN-containing dehydrogenases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	34
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGATGCGCA CTCATGACAG CAGCGAAGAA CTTCAGGAAA CCGTCCGTAC TGCGGCAGCG 
GCTCAAACCC CTTTGCGAAT TATAGGTGGT AATACCAAAG TTTTTTATGG CCGTCACCTA 
AAAGGTACGC CCCTGAACGT AGGCAAACAC CAGGGCATCA CCAGCTACGA ACCCACCGAA 
CTCGTCGTCA CTGCCCGTGC GGGAACACCG TTGGCCGAAA TTGAAACGCT GCTTGCCGAG 
CAGGGCCAAA TGCTTACTTT TGAACCCCCT TACTTCGGCT CCAACGCTAC CCTAGGCGGC 
GCTGTAGCTA GCGGCCTCTC CGGCCCACGC CGACCCTATG GGGGAGCAGT CCGGGATATG 
ATATTAGGGG TACAGATTAT TAACGGCAGG GGCCAGGTGC TACGCTTTGG CGGACGGGTG 
ATGAAAAACG TAGCTGGCTA TGATATCTCC CGCTTGATGG CAGGTAGCCT TGGTACCCTA 
GGGGTGCTGC TGGAAGTCTC TCTAAAGGTT TCGCCCCGTC CTCCCATGGA AATCACACTC 
TCCCAAGAAC GGGATGCCCA CAATGCCATT CGCCTGTTCA ATGTCTGGGC AGCCCAGCCC 
CTTCCCCTTT CAGCGTGTGC TTTTGACGGA GAGCATCTTT ACGTACGTCT ATCCGGCTCT 
GAAGAGAGCA TCCAGGCTGC GCGCAACAAG GTTGGAGGCG ATAAACTGAG CGACAGCACA 
AAGTTCTGGG AAAAAGTGCG AGAACAAACC CATCTTTTTT TCCAACGAAG CACAGCCCCT 
CTTTGGCGCT GGTCGGTACC CGCCACAACA CCACCCATCG ATCTGCCGGG GGAATGGAAA 
ATTGGCTGGG GCGGAGCCCA ACGCTGGTTT CGCTCCGAAT TGACTGCAGA AACGATACGC 
CCTGCCGCCG AGAGCATCAA CGGTTATGCC ACTCTATTCC GTGGTGGAGA TCGTAGCGGC 
GAGGTCTTTC ACCCCCTATC TCCCCCACTC ATGGCGCTAC ATCAACATCT CAAACGAGCC 
TTCGATCCCC ATGGCATTCT GAATCCAGGA CGAATGTACC AGGAATTCTA G

Protein sequence

MMRTHDSSEE LQETVRTAAA AQTPLRIIGG NTKVFYGRHL KGTPLNVGKH QGITSYEPTE 
LVVTARAGTP LAEIETLLAE QGQMLTFEPP YFGSNATLGG AVASGLSGPR RPYGGAVRDM 
ILGVQIINGR GQVLRFGGRV MKNVAGYDIS RLMAGSLGTL GVLLEVSLKV SPRPPMEITL 
SQERDAHNAI RLFNVWAAQP LPLSACAFDG EHLYVRLSGS EESIQAARNK VGGDKLSDST 
KFWEKVREQT HLFFQRSTAP LWRWSVPATT PPIDLPGEWK IGWGGAQRWF RSELTAETIR 
PAAESINGYA TLFRGGDRSG EVFHPLSPPL MALHQHLKRA FDPHGILNPG RMYQEF