Gene Noc_1509 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Noc_1509
Symbol
ID	3705845
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nitrosococcus oceani ATCC 19707
Kingdom	Bacteria
Replicon accession	NC_007484
Strand	+
Start bp	1673929
End bp	1675149
Gene Length	1221 bp
Protein Length	406 aa
Translation table	11
GC content	55%
IMG OID	637737995
Product	UDP-sulfoquinovose synthase
Protein accession	YP_343524
Protein GI	77164999
COG category	[G] Carbohydrate transport and metabolism [M] Cell wall/membrane/envelope biogenesis
COG ID	[COG0451] Nucleoside-diphosphate-sugar epimerases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	0.32933
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAAAATTC TCATTCTTGG GGGGGACGGC TTTTGCGGTT GGCCCACTAG CCTGCATCTT 
TCCGCGCTTG GTCATGAGGT TGCCATCGTG GACAACTTGT CGCGCCGGTG TATCGATGTT 
GAGCTTGAGT GCGAATCCTT GACGCCGATC CGGCCCCTGG GCGAACGGTT GCGTGCTTGG 
AAAGAAATTT CCGGTAAGAC CATCGCCTTC CACAACTTTG ACGTGGCCGT GAACTATCAG 
CGCCTGCTGG ATCTGCTCAG GGAATGGCAA CCCCACGCCA TTGTGCATTT TGCCGAGCAG 
CGAGCGGCGC CCTACTCGAT GAAGAGCAGC CATCACAAAC GCTACACCGT CAGCAACAAC 
CTCAATGCCA CCAACAACGT GCTTGCCGCC GTGGTTGAAA GTGGGCAGGA CATCCACATT 
GCCCACTTGG GCACCATGGG CGTCTATGGT TATGGCACGG CCGGCATGAA AATCCCGGAA 
GGTTACCTCC AGGTGAAAGT GGAAACCGAC GAAGGCAAGC TGCTGGACAA CGAAATTCTT 
TACCCGGCCA ATCCTGGCAG CATCTATCAT ATGACCAAAA CCCAGGACCA GCTTCTGTTC 
TTCTTCTATA ACAAGAACGA CAAGGTCCGT ATCACCGATC TCCACCAGGG CATCGTCTGG 
GGCACGCAAA CCCAGGAAAC CAGGCTGGAT GAGCGCCTGA TCAACCGTTT CGATTATGAC 
GGCGATTATG GCACTGTTCT GAATCGTTTT TTAATGCAGG CGTCTATTGG TTACCCTCTT 
ACGGTGCATG GAACGGGCGG CCAGACCCGC GCCTTTATCC ATATTCAGGA TACCGTGCAG 
TGCATTCAGA TCGCCTTGGA AAATCCCCCC GCTCCGGGTG ACCGGGTGCA GATATTTAAT 
CAGATGACCG AGACCCATCG TGTGCGTGAT CTGGCCCAGA TGCTCTCCGA GCGTACCGGC 
GTCAAGATTG ACTATCTGTC CAACCCCCGT AACGAAGCGG ACGAAAACGA CTTGCATGTC 
AAAAACGACC GCTTTCTCGC ATTGGGTCTG GACCCGATCA CGCTGAACGA AGGGCTCATG 
GAGGAGGTGA CGGATATTGC CCGAAAATAT GCTCACCGGT GCGACCAGAG CAAGATTCCT 
TGTACCTCGC TCTGGAAGCG GCCTAAGGAG AAAGCAAGTG AGTTGGTGCA GTTGCGGCAT 
GTAGCCGGTA ATCAGATGTA G

Protein sequence

MKILILGGDG FCGWPTSLHL SALGHEVAIV DNLSRRCIDV ELECESLTPI RPLGERLRAW 
KEISGKTIAF HNFDVAVNYQ RLLDLLREWQ PHAIVHFAEQ RAAPYSMKSS HHKRYTVSNN 
LNATNNVLAA VVESGQDIHI AHLGTMGVYG YGTAGMKIPE GYLQVKVETD EGKLLDNEIL 
YPANPGSIYH MTKTQDQLLF FFYNKNDKVR ITDLHQGIVW GTQTQETRLD ERLINRFDYD 
GDYGTVLNRF LMQASIGYPL TVHGTGGQTR AFIHIQDTVQ CIQIALENPP APGDRVQIFN 
QMTETHRVRD LAQMLSERTG VKIDYLSNPR NEADENDLHV KNDRFLALGL DPITLNEGLM 
EEVTDIARKY AHRCDQSKIP CTSLWKRPKE KASELVQLRH VAGNQM