Gene Nmag_3891 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Nmag_3891
Symbol
ID	8826761
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Natrialba magadii ATCC 43099
Kingdom	Archaea
Replicon accession	NC_013923
Strand	+
Start bp	286437
End bp	287651
Gene Length	1215 bp
Protein Length	404 aa
Translation table	11
GC content	61%
IMG OID
Product	major facilitator superfamily MFS_1
Protein accession	YP_003481994
Protein GI	289583584
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGGACGTGA GTACCGTCTC GACACCGTCA CCCGAACCCG ACAGCCGTCG TAGCTGGGGC 
GTTGCACTCG CCGGTGCGAT TGCGATGGTG TTTACGTTCG GTACACCGCT CTCCTACGGC 
ATTTTCCAGC AGCCGTTCAG CGAGACGTTC GCCGTCTCTC CCGTCGCTCT TTCCGGTGTT 
TTCGCGGTCA TGTTGTTCAC CTTCTTTATT GGCTCCGGAC TCGTCGGCAT CTTCGCCGCA 
CGGCTCCCCG TTCGAGGCGT ACTGCTGGTG TGTACCATCG TAACAGCACT TCTCGCGCCC 
TCACTGTACG CAGTCGACTC GTATCTCGGG CTTACGTTCG TCTTTGCAGC CCTCGGACTC 
GCGCTGGGGA CCGTTTTCGT GCTGGTCGCA TCCGTCGTTC CGCGGTGGTT CGACGAGCGG 
CGGGGCGCTG CAACTGGATT GATCTTCGTC GGTAACGGGC TCGGATTGTT CGTTCTGCCA 
CCAATCTGGC AGTACGCACT CAGCACCGTT GGTGTTCGCG AGGGTTTCCT GATCATCATA 
GCGACGACGG CCAGCGCGTT CTTCCTTGCA AGCCTGCTCT GTCGGCGACC ACCCTGGGCC 
ACACGGTCGA CGGACTCGAA TAGCGCGCTC GTGTCCTGGC TCAGCGGACT CATCAGGGCG 
CGAACCTTCC AGTTGCTCTT CGTGGGGATG TCACTGGCGT TTGCCTGGTA TCAGCTCCTT 
GCGGCGTACG CGATCGACCT GTTCGCTGCG CGCGGGTTGA CCGAAGCTGG GGCGTCAACG 
TTGTTCGGCC TGATCGGTGG CGTGAGTATT ATCTCCCGAA TCGGTGGTGG GTATATCGCC 
GATATTGTCG GGTCGCGTCG GGCGTTTCTC GCATCACTCG GCTGTGCCGC CGTCGGAATC 
GTCCTGTTGC TCGTCCCGCA GTACGCGATA CTCACCGTTG CTGTCTTCAG TATCGGGTTG 
GGTCTCGGTG GCTGTGCAAC CCTGTACATC CCGTTGCTGA TGGAGACCTA CAATCCCGAG 
AAAGACACTG CGATTATCGG TGTCTTCAAC GTCGGCGGTG GGATCGGTGC GCTGGCGATG 
CCGCCACTTG GAACGGCGAG CGTCGCCTAC ACCGAGAGCT ACACCGTCGC AATCTTGCTC 
ACACTCGGGG TGACAATCGT CTCGTTCTGG GCTGTGGTCG TCGGAACTGC TGGAGGCGCA 
TCGACTCAGT CCTGA

Protein sequence

MDVSTVSTPS PEPDSRRSWG VALAGAIAMV FTFGTPLSYG IFQQPFSETF AVSPVALSGV 
FAVMLFTFFI GSGLVGIFAA RLPVRGVLLV CTIVTALLAP SLYAVDSYLG LTFVFAALGL 
ALGTVFVLVA SVVPRWFDER RGAATGLIFV GNGLGLFVLP PIWQYALSTV GVREGFLIII 
ATTASAFFLA SLLCRRPPWA TRSTDSNSAL VSWLSGLIRA RTFQLLFVGM SLAFAWYQLL 
AAYAIDLFAA RGLTEAGAST LFGLIGGVSI ISRIGGGYIA DIVGSRRAFL ASLGCAAVGI 
VLLLVPQYAI LTVAVFSIGL GLGGCATLYI PLLMETYNPE KDTAIIGVFN VGGGIGALAM 
PPLGTASVAY TESYTVAILL TLGVTIVSFW AVVVGTAGGA STQS