Gene Noc_1786 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Noc_1786
Symbol
ID	3704901
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Nitrosococcus oceani ATCC 19707
Kingdom	Bacteria
Replicon accession	NC_007484
Strand	-
Start bp	2014536
End bp	2015687
Gene Length	1152 bp
Protein Length	383 aa
Translation table	11
GC content	55%
IMG OID	637738270
Product	hypothetical protein
Protein accession	YP_343787
Protein GI	77165262
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	26
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAACTCAT TAACGCAAGA TTACCCAGCT ATTTTGCTGG ACAAGCACGA GCCGCCTTGT 
CTCTCGCTCT ATCAGCCGAC GCACCGACAG CATCCTGAAA ACACCCAGGA CCCGATCCGC 
TTCCGCAATC TGGTGAAGGA AATGGAGGAA TCCCTGCGCA AGAAGTATCC GTCTCGTGAT 
ATTACGGCGC TACTGCGCCC ATTTGAGGAC TTAGCCGAAG ATCGGTCTTT CTGGAATCAT 
ACCGCAGACG GGCTGGCGGT GCTGAGTGCG CCTGGGCTGT TCCGCGTGTA TAGACTGCAG 
CGGCCAGTTG TCGAGCTATC GGTTGTCGCC GACAGCTTTC ATACCAAGCC GCTCATGCGC 
ATTGTGCAAT CGGCCGATCG CTACCAGATT CTTGGTTTGA GCCGGCACGC GTTCAAGATG 
TTCGAGGGCA ATCGCGATGC GCTGGATGAG ATTCAGCTCA TTGAAAGCGC GGCGCAAGTG 
ATCGATGAAC AACAAGGCAA AGATGAGGGT GATCGTGAAG GCGCTCACCG CGCATACAGC 
TCTGCTGGGC GGCCCGGTGC CGCAGCGCGG CACGGCACCG ATGTAAAGCA AGATGTTGAG 
GATCGCAACA CCCAACTATT TTTTCGCGCT GTGGATGAAG TAGTGCTGAA GCATTATTCC 
CAACCATTGG GACAGCGCCT AATACTGGCG GCGCTACCTC AGCACCATCA TCTGTTTCGC 
GCCATTAGCA GTAATCCTTT GCTAATGAGC GAAGGTATTA ACACTAACCC AGAGGCGTTA 
TCGCTTGATG CGTTGCGTGA ACGCGCATGG CAATTGGTGC AGCCCTATTA CCTTGAGCGG 
CTAGCCGGTT TGGTGGAATC GTTTGGCGCG GCGGCTGCAA AGGGGCAGGG CGCGGATGAC 
CTTAGCGAGA TCGCCACGGC CGCCATCGCC GGGCGGATTG CAACGTTATT GATCGAGGCC 
GACCGTTTAA TTCCCGGTTA TATTGATGCC ACAAGCGGTC AAATTACCAC TGATAATTTG 
AGTAACCCGG AAATTGACGA TGTGCTCGAT GATCTCGGCG AGCATGTGCT CAAGACCAGC 
GGCGAAGTTG TGATCGTCCC CAGTGAACGA ATGCCAACAC AGACTGGCGC CGCCGCCATC 
TATCGTTTTT GA

Protein sequence

MNSLTQDYPA ILLDKHEPPC LSLYQPTHRQ HPENTQDPIR FRNLVKEMEE SLRKKYPSRD 
ITALLRPFED LAEDRSFWNH TADGLAVLSA PGLFRVYRLQ RPVVELSVVA DSFHTKPLMR 
IVQSADRYQI LGLSRHAFKM FEGNRDALDE IQLIESAAQV IDEQQGKDEG DREGAHRAYS 
SAGRPGAAAR HGTDVKQDVE DRNTQLFFRA VDEVVLKHYS QPLGQRLILA ALPQHHHLFR 
AISSNPLLMS EGINTNPEAL SLDALRERAW QLVQPYYLER LAGLVESFGA AAAKGQGADD 
LSEIATAAIA GRIATLLIEA DRLIPGYIDA TSGQITTDNL SNPEIDDVLD DLGEHVLKTS 
GEVVIVPSER MPTQTGAAAI YRF