Gene Nther_2023 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Nther_2023
Symbol
ID	6315835
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Natranaerobius thermophilus JW/NM-WN-LF
Kingdom	Bacteria
Replicon accession	NC_010718
Strand	-
Start bp	2134530
End bp	2135843
Gene Length	1314 bp
Protein Length	437 aa
Translation table	11
GC content	38%
IMG OID	642644411
Product	protein of unknown function UPF0052 and CofD
Protein accession	YP_001918178
Protein GI	188586633
COG category	[S] Function unknown
COG ID	[COG0391] Uncharacterized conserved protein
TIGRFAM ID	[TIGR01826] conserved hypothetical protein, cofD-related

Plasmid Coverage information

Num covering plasmid clones	33
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	66
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGGATGTAT TGAGGTGGTT CTATCCCGGT CTAAAGGTTA AAAGGTGGAT CTTAGTTGTA 
CTACTGGGAG CTTTATTAAG TTTTTTTGGG ATTGTAGTTT TACTGGGACC GTCTAAAGTT 
GCCTTACTGG GTAAACAAAG CTTTGTGACT CTAGGTGAAA TATTAGGTGC TTACTCACGA 
TATAATGGGA TTATTTTTTT GATAATTGGA GGCTTTACTT GCTGGTACGG TTTTAAGAAA 
ACTATGCATT CTGTTATGAC AGCTGCAGTA CCACAAGAGG AAGAAAAGTT AGTTAAACTG 
TTAAACAGAA GGAGACAACA AAAAATGGGC CCAAAAATTG TGGCCTTAGG AGGTGGTACA 
GGTTTACCTA ATTTATTAAG GGGGTTGAAA CCTTACACAC AAAATATAAC TGCTGTTGTT 
ACAGTTTCTG ATGACGGCGG AAGCTCTGGA AAGCTTAGAG GGGAATTTGG AATGGTTCCC 
CCCGGTGATG TCAGGAATTG CTTGTTAGCT CTAGCCGATA CTGAACCACT CATGGAAGAA 
ATCTTTAATT ACAGATTTAA AACAGAGGGA GACTTGGAAG GGCATAATGT AGGGAACTTA 
ATTATAGCCG CCTTAAATGA CAAGAAAGGT TTCAAAGATG CCTTGGCGTC TGTCAGTCGC 
GTCTTAGCCG TTAAAGGTAA TGTATTACCA GTTACTGATC AGTCTTTGAC ATTAAAAGCT 
AGATGTACTG ATGGAACTAC AGTAGTGGGA GAAAGCAGCA TATCAAATCA GAGCAAACAG 
ATCGAACAAG TATATCTTGA TGAACAAGAT GTATCTCCCC TTTCTGAAGT GATTACGGCT 
CTCGAAGAAG CTGATGCTAT AATACTTGGT CCTGGGAGTC TTTATACAAG TGTTATACCT 
AACTTATTGG TTCCAGGAAT CCCAGAGGCA ATTAAAAATT CCCAAGCTGT GAAAATCTAT 
GTATCCAATA TAATGACCCA ACCAGGGGAA ACTGATAATT ATCGGGCATC TGATCATTTG 
AGGTCGATTA TACAACACAC AGAATATAAT TTAGTTGATA CTGTCTTAAT TAATGGTGAA 
TTAGATGTAG ATTCCCAAAC CCTAGCAAAA TATAAGGAAG AACTACAGGA ACCCGTACAA 
CCTGACATTG AAAATCTTAC CAATATGAAG GTAGATACAA TTATAAAAAA CTTTAATGGG 
CGAAACTCCC TTATCAGGCA TGATTCGGAA TTACTTGGGG AAGTCATTAT TAAAGAAGTG 
ATCAATAAGA AAAAAGAAGT GATTCGAAAA AAATTATTTG CCAGGAGGGA TTAA

Protein sequence

MDVLRWFYPG LKVKRWILVV LLGALLSFFG IVVLLGPSKV ALLGKQSFVT LGEILGAYSR 
YNGIIFLIIG GFTCWYGFKK TMHSVMTAAV PQEEEKLVKL LNRRRQQKMG PKIVALGGGT 
GLPNLLRGLK PYTQNITAVV TVSDDGGSSG KLRGEFGMVP PGDVRNCLLA LADTEPLMEE 
IFNYRFKTEG DLEGHNVGNL IIAALNDKKG FKDALASVSR VLAVKGNVLP VTDQSLTLKA 
RCTDGTTVVG ESSISNQSKQ IEQVYLDEQD VSPLSEVITA LEEADAIILG PGSLYTSVIP 
NLLVPGIPEA IKNSQAVKIY VSNIMTQPGE TDNYRASDHL RSIIQHTEYN LVDTVLINGE 
LDVDSQTLAK YKEELQEPVQ PDIENLTNMK VDTIIKNFNG RNSLIRHDSE LLGEVIIKEV 
INKKKEVIRK KLFARRD