Gene Noc_2845 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Noc_2845
Symbol
ID	3705537
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nitrosococcus oceani ATCC 19707
Kingdom	Bacteria
Replicon accession	NC_007484
Strand	+
Start bp	3222196
End bp	3223173
Gene Length	978 bp
Protein Length	325 aa
Translation table	11
GC content	47%
IMG OID	637739321
Product	peptidase S49, SppA
Protein accession	YP_344821
Protein GI	77166296
COG category	[O] Posttranslational modification, protein turnover, chaperones [U] Intracellular trafficking, secretion, and vesicular transport
COG ID	[COG0616] Periplasmic serine proteases (ClpP class)
TIGRFAM ID	[TIGR00706] signal peptide peptidase SppA, 36K type

Plasmid Coverage information

Num covering plasmid clones	19
Plasmid unclonability p-value	0.25989
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGTCAAACC AAGATCCATC TACGACCGAT CTAAGCAAAA CACAGGCAAT CCAGCGCAAC 
TGGGAGCGAG AGGTCTTGGA GCGTTTGGCT TTTAGCGCTC TTAAAGAACA GCGGCGGGCG 
CGTCGTTGGA GTATTTTTTT CAAACTACTC TTTGCTGCCT ATTTACTCGT TCTCTTGCTG 
CTTTATCTTC CTAATGGGCT TAGCGCTCCA GGAATAATTA CGCCCCACAC TGCCTTAGTA 
AAAATAGAAG GGATCATTGG CAGCGACTCA TTTGCAAATG CGGAAAATAT AAAAAAAGGA 
CTAAAAGCCG CCTTTGAGAA CGAACATATC GCTGGGTTAA TTCTGCATAT CAATAGTCCT 
GGCGGCAGCC CAGTCCAGGC AAACCAAATC AACGACCAAA TCCATCAATT GCGCAAAGAA 
CATCCTAATA TCCCTATCCA CGCCGTTATT ACAGACATCT GCGCCTCGGG AGGATATTAC 
ATTGCGGTAG CGGCAGATCA AATTTATGCG GACAAAGCAA GTATCGTGGG TTCCATTGGT 
GCTCTGATCA ATAGTTTCGG CTTCGTTGAA GCTATGGAAA AACTGGGAAT TGAGCGGCGC 
CTCTTTACTG CAGGCGACTA TAAAGGTTTC CTTGATCCGT TCTCGCCTAT GAAAGAATTC 
GAATCCCAAC ATATCCAAAA GATGCTAGAC AACATCCACA AGCAATTCAT TCAGGTTGTA 
AAAGACAACC GCGGAGAACG ACTCAAGAAC GATTCTTCCC TATTCAGCGG ATTAGTCTGG 
ACAGGCGAGC AAGCCATCGA TCTAGGATTG ATCGATGGCT TGGGAAACAG CAACTACGTG 
GCTCGCGAGA TCATAGGAGC GGAAAAAATT GTCGATTACA CCCCCCAGCC CAAGCTCCTA 
GATCGCTTCT CTCGCCAGCT TGGAGCCACT TTCGCTAATA TGCTATCCGG CTTCACCCTT 
GCGGCTAATA CAAGATAG

Protein sequence

MSNQDPSTTD LSKTQAIQRN WEREVLERLA FSALKEQRRA RRWSIFFKLL FAAYLLVLLL 
LYLPNGLSAP GIITPHTALV KIEGIIGSDS FANAENIKKG LKAAFENEHI AGLILHINSP 
GGSPVQANQI NDQIHQLRKE HPNIPIHAVI TDICASGGYY IAVAADQIYA DKASIVGSIG 
ALINSFGFVE AMEKLGIERR LFTAGDYKGF LDPFSPMKEF ESQHIQKMLD NIHKQFIQVV 
KDNRGERLKN DSSLFSGLVW TGEQAIDLGL IDGLGNSNYV AREIIGAEKI VDYTPQPKLL 
DRFSRQLGAT FANMLSGFTL AANTR