Gene SNSL254_A4870 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	SNSL254_A4870
Symbol
ID	6484844
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Salmonella enterica subsp. enterica serovar Newport str. SL254
Kingdom	Bacteria
Replicon accession	NC_011080
Strand	-
Start bp	4738678
End bp	4739862
Gene Length	1185 bp
Protein Length	394 aa
Translation table	11
GC content	56%
IMG OID	642740081
Product	major facilitator family protein
Protein accession	YP_002043758
Protein GI	194442452
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	12
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	62
Fosmid unclonability p-value	0.444375
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGGTTCATG CTCAGAGCGC TTCACCTCGC CATCCCATTT TTACGGCGCT TTTCGGTATG 
ATGGTATTGA CGCTGGGGAT GGGAGTTGGC CGCTTTCTGT ATACGCCCAT GCTGCCAGTA 
ATGCTGGCGG AAAAGCAGCT AACGTTTAAC CAACTCTCCT GGATTGCCAG CGCCAATTAT 
GCAGGGTACC TGGCGGGAAG CTTACTGTTT TCCTTTGGCC TTTTTCATCT TCCCTCTCGT 
CTACGCCCCA TGCTGCTGGC TTCGGCGGTC GCCACCGGTA TTCTTATTCT GTCTATGGCG 
ATATTTACTC AGCCCGCGGT CGTCATGTTG GTGCGCTTAC TGGCAGGTGT CGCGAGCGCG 
GGAATGATGA TTTTTGGATC AATGATTGTG TTGCATCATA CCCGCCATCC GTTTGTGATC 
GCCGCGCTCT TTTCCGGCGT CGGGGCCGGG ATTGCACTGG GCAACGAATA TGTCATTGGC 
GGTTTACATT ATGCGCTTTC GGCCCATTCG CTATGGCTGG GGGCCGGAGC GCTCGCCGGT 
ATATTGCTAT TAATCGTGGC AATGTTGATT CCCCCCCGCG CTCATGCGCT GCCGCCTGCG 
CCCTTAGCAA GAATCGAAAA TCAGCCTATG CCCTGGTGGC AACTGGCGCT GTTGTACGGT 
TTCGCCGGAT TCGGCTACAT CATTGTCGCT ACCTATTTGC CGCTGATGGC GAAAAGCGCG 
GGCTCTCCAC TACTCACGGC GCACCTTTGG TCGTTGGTCG GCCTAGCGAT CATTCCCGGC 
TGCTTCGGCT GGCTGTGGGC GGCAAAACAT TGGGGCGTCC TGCCATGCCT GACCGCGAAC 
CTGTTGATCC AGAGCGCCTG CGTGCTGCTG TCTCTCGCCA GCGACTCATT GTTGCTGTTA 
ATACTGAGCA GTATTGGTTT TGGCGCCACG TTTATGGGCA CAACCTCGCT GGTGATGCCG 
CTTGCCCGAC AACTCAGCGC GCCGGGTAAT ATTAATTTGT TAGGCCTGGT GACGCTAACG 
TATGGTATTG GGCAAATTCT CGGTCCGCTC GCCGCCAGTC TGTCAGGCAA TGGCGCGTCG 
ACAATTATCA ACGCCACGCT TTGCGGCGCC GCGGCGCTCT TTTTTGCCGC GCTGATCAGC 
GCCGCGCAGC AGATAAAACA AAAACGGTTT GTGATACGTG AATAA

Protein sequence

MVHAQSASPR HPIFTALFGM MVLTLGMGVG RFLYTPMLPV MLAEKQLTFN QLSWIASANY 
AGYLAGSLLF SFGLFHLPSR LRPMLLASAV ATGILILSMA IFTQPAVVML VRLLAGVASA 
GMMIFGSMIV LHHTRHPFVI AALFSGVGAG IALGNEYVIG GLHYALSAHS LWLGAGALAG 
ILLLIVAMLI PPRAHALPPA PLARIENQPM PWWQLALLYG FAGFGYIIVA TYLPLMAKSA 
GSPLLTAHLW SLVGLAIIPG CFGWLWAAKH WGVLPCLTAN LLIQSACVLL SLASDSLLLL 
ILSSIGFGAT FMGTTSLVMP LARQLSAPGN INLLGLVTLT YGIGQILGPL AASLSGNGAS 
TIINATLCGA AALFFAALIS AAQQIKQKRF VIRE