Gene Noc_1458 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Noc_1458
Symbol
ID	3706027
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nitrosococcus oceani ATCC 19707
Kingdom	Bacteria
Replicon accession	NC_007484
Strand	-
Start bp	1614546
End bp	1615649
Gene Length	1104 bp
Protein Length	367 aa
Translation table	11
GC content	55%
IMG OID	637737947
Product	WD-40-like beta propeller repeat-containing protein
Protein accession	YP_343476
Protein GI	77164951
COG category	[U] Intracellular trafficking, secretion, and vesicular transport
COG ID	[COG0823] Periplasmic component of the Tol biopolymer transport system
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	16
Plasmid unclonability p-value	0.0940503
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGACTCTTG GAGGTAAATT CATGCGAGAC ATCAATACTG TCGCTTCCAG TTGGCTCCTA 
GTGGCGACGC TCTGCGCGGG CGCTGCTGGG GCTATCGCGG CAGAACCCAC TAACAGTCCC 
GCTTCCCCGA CGGAGGAGCT TCGCTATCCC GGCGAAAAGC ACCTGACCCA TCTCCGTCAA 
CTTACCTTTG GCGGCCAGAA CGCCGAAGCT TATTTTTCTT TTGACGGCAA GGAGCTGATT 
TTTCAGTCTA CCCGTGACGA TTTGAAGTGC GACGCTATCT TCCGTATGGA TGCGGATGGC 
AAGAATGTCC GCCAGGTCTC CTCTGGCAAA GGGGTGACCA CCTGCTCATT TATTGCCCCG 
GACGACCAGG CCATTATCTA TGCCTCTACT CATCTGGCGG GCGACCAGTG TCCCCCCAAA 
CCTGACTACT CCCAAGGCTA CGTCTGGCCC TTGTACGAGG GCTATGACAT TTTCCGGGCT 
GATCCGGAAG GCGGCAATCG GGTGCGCCTG ACCGACACCC CTGGCTACGA TGCCGAGGGA 
GTTTACTCTC CCAAGGGGGA CAAAATTATC TTTACGTCAG CCCGCACGGG GGATCTGGAA 
CTGTTCATGA TGAACCCGGA CGGCAGCGAG GTGGAACAGC TCACTGATCA ACCCGGCTAC 
GATGGCGGGG CCTTTTTCTC CCGGGATGGT CAATGGATCG TCTGGCGCGC CTCCCGTCCC 
GAAGGTAAAG CCCTGGCCGA TTATCAAAGC TTGCTCAAAC AAGGACTCAT CCGTCCTAGC 
CAACTGGAAA TTTTCATCAT GAACCTAGAG GAACGCAAAC CTATCCAGCT CACCGACAAT 
GGCGCCGCCA ACTTCGGCCC CTATTGGCAT CCGGATGGCA AGCACATCAT CTTCTCCTCC 
AACATGCACA ATCCCAAAGG CCGCAACTTT GATCTGTTCC TGATTAACGT GGATACCCGG 
GAAATCGAGC AGATCACTCA TCATCCTGAT TTCGATGGCT TTCCCATGTT CTCCCACGAT 
GGCAAAAAGC TGGTATTTGC CTCCAACCGC AACGGCAAGG TGGAAGGGGA AACCAATGTC 
TTCATGGTAG ATTGGCGCTG GTAA

Protein sequence

MTLGGKFMRD INTVASSWLL VATLCAGAAG AIAAEPTNSP ASPTEELRYP GEKHLTHLRQ 
LTFGGQNAEA YFSFDGKELI FQSTRDDLKC DAIFRMDADG KNVRQVSSGK GVTTCSFIAP 
DDQAIIYAST HLAGDQCPPK PDYSQGYVWP LYEGYDIFRA DPEGGNRVRL TDTPGYDAEG 
VYSPKGDKII FTSARTGDLE LFMMNPDGSE VEQLTDQPGY DGGAFFSRDG QWIVWRASRP 
EGKALADYQS LLKQGLIRPS QLEIFIMNLE ERKPIQLTDN GAANFGPYWH PDGKHIIFSS 
NMHNPKGRNF DLFLINVDTR EIEQITHHPD FDGFPMFSHD GKKLVFASNR NGKVEGETNV 
FMVDWRW