Gene NATL1_00651 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	NATL1_00651
Symbol
ID	4779178
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. NATL1A
Kingdom	Bacteria
Replicon accession	NC_008819
Strand	+
Start bp	71859
End bp	72950
Gene Length	1092 bp
Protein Length	363 aa
Translation table	11
GC content	33%
IMG OID	640083328
Product	hypothetical protein
Protein accession	YP_001013894
Protein GI	124024778
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	8
Plasmid unclonability p-value	0.2704
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	15
Fosmid unclonability p-value	0.550522
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

TTGAATTTTA TAGATGATAA TGGTAATACT AAATTAAGTG TAGAAGATAA TAAAATCTTT 
GCACATTACG ATAATAAAAA ATTTGGATTA TGTGCTTATA CCATTTCAGT GCCTGGGTAT 
TCAGATGATA TAGTCGGATG GGAGACAGAC AATAAAAAGA GTTGGCCTGG TATTTTTGTT 
TATGATAATG GTGATTACTT TAAGTTTTAT GCTGAGGTTT TTAATAATAC TGGAATAATA 
GTTTTTGAAG GTTTAGATAT TAATAATAAG GTTCAGAGAT ATCAAGTATA TGAGTTTTCG 
TTAATAGATA TAGGTGTGAT TACAAAATAT TTTTCACAGA ATCCAGATGG TACTTTTTCT 
AGTTATTTCT TTACTAGTTC AGAATATCCT GAGGATGAAT TTATATTAAA GCCACCTGAT 
GGATCCTTGT CTTCCTGGGA GGCATTAGAT ACAGATCCTT ATTATCGGAC TCATGGTCAA 
GGAACTTATA CAGATTTCTT AAAAGAATAT GGTCAAGTAA TTAATCCTGC TTCAGGGGAT 
AGAAAATTTT TCCCTGCTAA AAGTTTTGAT TATCAATTCT TTGACTTAGG AAATCAAGAG 
TATGGAATCA GACCAGATGC AGGTGGCACA GTAGATCCTT TAACAGGTTT CTCTTCAATT 
CAGTTTATAG ATAAGTTTAT GACAATAGAA GCAGATATCA TAGGAGTCTT CGATCAAGTT 
ACAGGGTTAA ATACAGACTC AGGCAAAATG TTTCGTCTTT ACAACGCTGC TTTTGCCCGG 
TTCCCTGATG CTGATGGTTT GAGGTATTGG ATCAGTAATT TTAGTTCTGG GATTGATGAT 
GAACGAGCAG TCTCATCTTC TTTTCTTGCC TCTGCTGAAT TTAAAGAACG TTATGGAGAA 
AATATTACAC ATGAGACGTA TGTCGAAAAT CTCTATCTTA ATGTTTTGAA TAGGGAATTA 
GATCAAGGCG GATACGATTA CTGGGTGGGT AATTTAAATA ATGGTATAGA GGAAAGACAT 
GAAGTACTTT TAGGTTTTTC TGAGTCGGTA GAAAACAAAT TTCTTTTTAC TGAGATGACA 
GGATTTGGTT GA

Protein sequence

MNFIDDNGNT KLSVEDNKIF AHYDNKKFGL CAYTISVPGY SDDIVGWETD NKKSWPGIFV 
YDNGDYFKFY AEVFNNTGII VFEGLDINNK VQRYQVYEFS LIDIGVITKY FSQNPDGTFS 
SYFFTSSEYP EDEFILKPPD GSLSSWEALD TDPYYRTHGQ GTYTDFLKEY GQVINPASGD 
RKFFPAKSFD YQFFDLGNQE YGIRPDAGGT VDPLTGFSSI QFIDKFMTIE ADIIGVFDQV 
TGLNTDSGKM FRLYNAAFAR FPDADGLRYW ISNFSSGIDD ERAVSSSFLA SAEFKERYGE 
NITHETYVEN LYLNVLNREL DQGGYDYWVG NLNNGIEERH EVLLGFSESV ENKFLFTEMT 
GFG