Gene Noc_0388 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Noc_0388
Symbol
ID	3706559
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nitrosococcus oceani ATCC 19707
Kingdom	Bacteria
Replicon accession	NC_007484
Strand	+
Start bp	428172
End bp	429293
Gene Length	1122 bp
Protein Length	373 aa
Translation table	11
GC content	58%
IMG OID	637736900
Product	IS891/IS1136/IS1341 transposase
Protein accession	YP_342444
Protein GI	77163919
COG category	[L] Replication, recombination and repair
COG ID	[COG0675] Transposase and inactivated derivatives
TIGRFAM ID	[TIGR01766] transposase, IS605 OrfB family, central region

Plasmid Coverage information

Num covering plasmid clones	26
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGATCAATG CCTTCAAATA CCGTCTTTAT CCGAATGCCC ATCAGGCGCG CGAGCTTGAA 
ACCATGCTCG AAACGCATCG ACGCTTGTAT AATGAATGCC TGGCTCAGCG AAAAGAGCGT 
TACGAAATTG CCCAGAAAAG CGTGAAGTAC ACGCAGCAAT CGGCTTGGTT TAAATCCGAA 
CGGGGTGTAA ATGAGTGGTA CGCTCGGCTT AATTTCTCGT CTGCTCAAGC CACCATGCGC 
CGTTTGGATA AAGCGTTCCA AGCGTTCTTC CGGCGCATTA AGGCCGGTGA AAAGCCCGGT 
TATCCACGCT TCAAGGCCCG TGGCCGATTC GATAGTTGGA CGTATCCGGC GCACGGTGAC 
GGCGCCCGGC TGCTTGATGG TCAACTGCGC CTTCAGCATG TGGGCCTGGT CAAAGTACGC 
CAGCATCGTC CTGTAGAAGG GGCGGTCAAA ACCGTGCAAG TCAAAAATGA AGCCGGGAAG 
TGGTTTGTCA TCGCTAGTTG CAATATCGGC GATGGGCCAG CCCCCCGCGC CGAGGATACC 
TCGGTGGGCC TGGATGTTGG GTTGGCATAT TTTCTGTCCA CCGATCAAGG CGAGCACGTC 
GATAATCCGC GTTACCAAAA AGAAGCGTTG CGCCAGTTGA GGATTGCTGG GCGCGCGGTT 
TCGCGTAAGA GAAAGGGTGG CCGGAACCGA GCTAAAGCGG TTGCCAGATT GCGCGCGATA 
CATGCGCGCG TAGCCAACAA AAGACGGGAC TACCACCACA AGGTGGCCCG CGATTTGGTG 
AGTCGATACG CCTTCATCGC GGCGGAGAGC CTGACCGTGA GCAACATGGT CAGGAACCGC 
CGGTTGAGTC GGTCGATTTC GGATGCTGGC TGGCGCCAGT TTCTGAACAT ACTCCGCGCC 
AAGGCTGAAA GCGCCGGGTC GGTGTGGGTT GAAGTGCCTC CGCAGGGCAC CTCGCAAGCG 
TGCTCTGGGT GCGACACACT TGTGCGAAAG TCGCTTTCCG TGCGGCAGCA CCACTGCCCC 
GAATGCGGCT TGCGCCTGCA AAGAGATGTC AACGCTGCTA GGAATATCCT GGCGCGTGGC 
CAGGCTCGGA TGGAGCCTGT GCGGCTTAAC GTGGCGCAGT AG

Protein sequence

MINAFKYRLY PNAHQARELE TMLETHRRLY NECLAQRKER YEIAQKSVKY TQQSAWFKSE 
RGVNEWYARL NFSSAQATMR RLDKAFQAFF RRIKAGEKPG YPRFKARGRF DSWTYPAHGD 
GARLLDGQLR LQHVGLVKVR QHRPVEGAVK TVQVKNEAGK WFVIASCNIG DGPAPRAEDT 
SVGLDVGLAY FLSTDQGEHV DNPRYQKEAL RQLRIAGRAV SRKRKGGRNR AKAVARLRAI 
HARVANKRRD YHHKVARDLV SRYAFIAAES LTVSNMVRNR RLSRSISDAG WRQFLNILRA 
KAESAGSVWV EVPPQGTSQA CSGCDTLVRK SLSVRQHHCP ECGLRLQRDV NAARNILARG 
QARMEPVRLN VAQ