Gene Noc_1501 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Noc_1501
Symbol
ID	3705992
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nitrosococcus oceani ATCC 19707
Kingdom	Bacteria
Replicon accession	NC_007484
Strand	+
Start bp	1664860
End bp	1666053
Gene Length	1194 bp
Protein Length	397 aa
Translation table	11
GC content	55%
IMG OID	637737988
Product	transposase
Protein accession	YP_343517
Protein GI	77164992
COG category	[L] Replication, recombination and repair
COG ID	[COG0675] Transposase and inactivated derivatives
TIGRFAM ID	[TIGR01766] transposase, IS605 OrfB family, central region

Plasmid Coverage information

Num covering plasmid clones	22
Plasmid unclonability p-value	0.915709
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGTTGAAAG CCACAAAGAT ACGCCTCTAC CCTACGAGGG AGCAGGCGGA GTTTCTGAAC 
CGCCAGTTCG GTAGCGTGCG GTTTTGCTAT AACACCGGCC TTCGCATTAT GTCTCACCGC 
TATAAGCGAC ACGGCCAATC CTTGAGCGCC AAGTATGACA TCAAGAAATT GTTGCCTGTG 
GCCAAGAAGT CCCGTAAGTA TGGATGGTTG AAGGAGGCGG ATTCGGTTGC GCTCGCTCAA 
GCGTGTATCA ATCTCGACAA GGCGTTTCAG CGTTTTTTCA AGGAAAAGAA AGGCTATCCC 
CGGTTCAAGC GCAAGCGTGG CAAGCAGTCG AGCTACCATT GCATGAGCGT GAGCTGCGGT 
GAAAGCTGGG TCAAGGTGCC GAAGCTCGGC CCCATCAAGG CTAGAGTTCA TCGGTCCGTT 
GAGGGCAAAT TGAAAAGCAT CACCCTGTCG CGCACCGTTA CCGGCAAACA CTACGCGTCT 
CTCCTGTATG AAACCGAGCA ACCTGTCCCT GAGCCGATGA CGGCTATCGA CGCCACCAAG 
GTGCTCGGCT TGGACATGGG TCTCTCGCAC CTGGCGATTG ACTCCACTGG ACGAAAAGTA 
GCCAATCCAC GCTTTATCAA GCAGGTTCAG AAAAATCTCA AGCGCAAGCA ACAGTCGCTG 
TCACGAAAGC AAAAAGGCAG TTCCAAACGA GCAAAAGCAC GCCTACTGGT CGCTAAGGCT 
CACGAGCGGG TCGCTGATGC CCGCAGTGAC TTCCAGCATA AACTGTCCCG GCAGATCGTT 
GACGACAACC AAGCGGTGAT CGTCGAGACG CTGAAAGTCA ACAACATGAT GAAGAACGCC 
AAGCTCGCCA AGCATATCGG CGATGCCTCT TGGCACGCCT TGATCGCCAA GCTGGCATAC 
AAGGCCAAGG AGCAGGGCAA ACATCTGGTC AAGATCGACC CCTGGTTTGC CAGCTCAAAA 
ACTTGCCATG TATGCCAGCA CAAGATGGAT GCCATGCCAC TAAATATCCG GTCGTGGGCG 
TGCCCTACCT GCCACACGCG CCATGACCGC GACATCAACG CGGCGCTGAA CATCCAACAT 
CAAGGCATTT TGAAGTTGAA GGCGGAAGGG CTGTCCGTCT CTGCCCATCG AGGCTTGCGT 
AAATCCGGCA TGCCGCCGGT GGCTGCCGTT GAAGTGGGAA GCTCCGTCCG ATAG

Protein sequence

MLKATKIRLY PTREQAEFLN RQFGSVRFCY NTGLRIMSHR YKRHGQSLSA KYDIKKLLPV 
AKKSRKYGWL KEADSVALAQ ACINLDKAFQ RFFKEKKGYP RFKRKRGKQS SYHCMSVSCG 
ESWVKVPKLG PIKARVHRSV EGKLKSITLS RTVTGKHYAS LLYETEQPVP EPMTAIDATK 
VLGLDMGLSH LAIDSTGRKV ANPRFIKQVQ KNLKRKQQSL SRKQKGSSKR AKARLLVAKA 
HERVADARSD FQHKLSRQIV DDNQAVIVET LKVNNMMKNA KLAKHIGDAS WHALIAKLAY 
KAKEQGKHLV KIDPWFASSK TCHVCQHKMD AMPLNIRSWA CPTCHTRHDR DINAALNIQH 
QGILKLKAEG LSVSAHRGLR KSGMPPVAAV EVGSSVR