Gene NATL1_10101 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	NATL1_10101
Symbol
ID	4779309
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Prochlorococcus marinus str. NATL1A
Kingdom	Bacteria
Replicon accession	NC_008819
Strand	+
Start bp	935183
End bp	936214
Gene Length	1032 bp
Protein Length	343 aa
Translation table	11
GC content	35%
IMG OID	640084288
Product	DnaJ domain-containing protein
Protein accession	YP_001014833
Protein GI	124025717
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	14
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	5
Fosmid unclonability p-value	0.00128924
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

GTGGCAGAAG CAAAAGCTGA AGAGAAGAAG GTAAAAAGAA TTTCAATTGA CTTGCCAATT 
GAGTTAATAG AAGGTGTAGA CCGTCTTCGT AAAGAGTGGG GACTAAGAAG TAGAGGACTT 
GTCTTTGCGA GGTTATTAGA AGTCATTTTA TCTAATGACT TAGAGGAAGA TTTAACTAAC 
AATCAACAGC TAGAGCTTAA CCAAAGTTCT AAGAATGACT TAGTAACAAA CAATCATGAT 
GAAATAGACA ATAAGACTGA AGAAAAGGCA ATTGTTATAG TTGGTGATAA GAATATTGAA 
ATAAAGAATG TCTCAGTACT AGAAAATAAC AATAAAAATA AAAAAGATCA GATAACATCT 
GGCATTGAAC TACCTGGGTT TATTAGGAAA CAAGCTACTA ATCTTAAGAG AAGTTTAAGC 
AAGGACAAGT CTATAAAAAA TATGGAGGAC ACATCAATTA CCACTATTGA TATAAACGAT 
TTATTAGAGG CTAAAAATGA TGCAGTAAAA CATTGGATCT ACCTTTACGG ACAAAAACCC 
ACAGACAATG TTCTTGAGGC ATCAATGATT TGGTTAGCAA GAGATATATG GCCAAACGTC 
GATGGCACGG AAAACATTCC TTTCACATGG AGTGCTGCAT GCAAGATGTT GAATTCATAT 
TGCACGGATT GGCATAATGA AGATTTAACT TTTGATCAGG TAATCATAAT AGCTGGAGCA 
TTAGAAGATC CTTTTTCTAC CAGAAACCTA AAAAGTAGAA TTCCTACTCT GATTCGAAGA 
TTCGTTAATA AATTTAAGCG AAGCAATAAT GTGACTTCTT TTCAAACGCT TGAATCAACC 
ATGACCGTCC ATGGAGCACT TAAATTATTA GGTTTACCCA CAAAGGCCGG CTCATCTTTA 
ACACTTTCTT TCATCAGGGA AGCATATAAA AATAAAGCAT TATCTAACCA TCCAGACGCT 
GGGGGCTCAA ATGAATCAAT GAGGAAGCTA AATGAAGCAT ATCAACTTTT AAAAGATCTA 
TACAAAAATT GA

Protein sequence

MAEAKAEEKK VKRISIDLPI ELIEGVDRLR KEWGLRSRGL VFARLLEVIL SNDLEEDLTN 
NQQLELNQSS KNDLVTNNHD EIDNKTEEKA IVIVGDKNIE IKNVSVLENN NKNKKDQITS 
GIELPGFIRK QATNLKRSLS KDKSIKNMED TSITTIDIND LLEAKNDAVK HWIYLYGQKP 
TDNVLEASMI WLARDIWPNV DGTENIPFTW SAACKMLNSY CTDWHNEDLT FDQVIIIAGA 
LEDPFSTRNL KSRIPTLIRR FVNKFKRSNN VTSFQTLEST MTVHGALKLL GLPTKAGSSL 
TLSFIREAYK NKALSNHPDA GGSNESMRKL NEAYQLLKDL YKN