Gene SeHA_C1217 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	SeHA_C1217
Symbol	hpaX
ID	6489813
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Salmonella enterica subsp. enterica serovar Heidelberg str. SL476
Kingdom	Bacteria
Replicon accession	NC_011083
Strand	+
Start bp	1198763
End bp	1200139
Gene Length	1377 bp
Protein Length	458 aa
Translation table	11
GC content	53%
IMG OID	642741456
Product	4-hydroxyphenylacetate permease
Protein accession	YP_002045107
Protein GI	194449451
COG category	[G] Carbohydrate transport and metabolism
COG ID	[COG2271] Sugar phosphate permease
TIGRFAM ID	[TIGR02332] 4-hydroxyphenylacetate permease

Plasmid Coverage information

Num covering plasmid clones	4
Plasmid unclonability p-value	0.126319
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	76
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAGCGACA CATCATCTGC ACTTCCGGAA AGCCCCGAGT CTGTCAGTTC GCACAACGCG 
CTCAGCACGG GTCAACAAAC CGTCATAAAT AAACTGTTCC GCCGACTGAT CGTATTTTTA 
TTCGTGTTGT TTATCTTCTC GTTTTTAGAC CGTATCAACA TCGGTTTTGC CGGGTTGACG 
ATGGGGCAGG ATCTGGGGTT AAGCGCCACC ATGTTTGGCC TTGCCACGAC GCTGTTTTAC 
GCCACCTACG TCATTTTCGG CATTCCCAGC AACGTGATGT TGAGCATCGT CGGCGCCCGC 
CGCTGGATTG CGACCATTAT GGTGCTATGG GGCATTGCAT CTACCGCCAC GATGTTCGCG 
GTGGGACCGA AAAGCCTGTA TGTGCTGCGA ATGCTGGTGG GCATTACCGA AGCGGGCTTT 
TTGCCAGGAA TATTGCTCTA TTTAACTTAC TGGTTTCCGG CATTTTTCCG CGCCCGCGCC 
AACGCATTAT TTATGATTGC CATGCCGGCC ACTACCGCGT TGGGGTCGAT TGTCTCCGGC 
TATATTTTAT CGTTGGACGG CATATTCAAT CTGCATGGAT GGCAGTGGTT ATTCCTGTTG 
GAAGGATTTC CGTCAGTTTT GTTAGGCATT ATGGTCTGGT TTTACCTGGA TGATACCCCG 
GCAAAAGCCA AATGGCTGAC GGCAGAGGAT AAAAAATGTT TGCAGGAGAT GATGGATAAT 
GACCGCCTGA CGCTGGTTCA GCCGGAGGGG GCCATCAGCC ATAACGCCAT GCAGCAGCGT 
AGTCTGTGGC GCGAAGTATT CACGCCAATT GTACTGATGT ATACGCTGGC CTATTTTTGC 
CTTACCAATA CGCTTAGCGC CATTAGTATC TGGACGCCGC AAATCCTGAA AAGTTTTAAT 
GAAGGCAGCA GCAATATCAC CATCGGCCTG CTGGCGGCGA TCCCGCAGAT TTGTACTATT 
CTGGGCATGA TTTACTGGAG CCGCCATTCG GACAAGCATC AGGAACGTAA ACATCACACG 
GCGTTGCCGT TCCTGTTTGC CGCCGCGGGC TGGCTGCTGG CGTCGGCGAC CGACCATAAC 
CTGATCCAGC TCCTGGGGAT CGTGATGGCA TCCACGGGTT CCTTTAGCGC GATGGCGATC 
TTCTGGACCA CGCCGGATCA GTCGATCAGT TTACGCGCCA GGGCGATAGG CATTGCGGTC 
ATCAATGCCA CCGGCAATAT TGGCTCCGCG CTCAGCCCGT TTATGATTGG CTGGCTAAAA 
GATATCACCG GTAGCTTCAA TAGCGGACTC TGGTTTGTCG CTTCTCTGTT AGTCGTCGGC 
GCCGCCATTA TCTGGCTCAT TCCCATGAAA GCATCGCGTC CGCGCGCCAC CCCTTGA

Protein sequence

MSDTSSALPE SPESVSSHNA LSTGQQTVIN KLFRRLIVFL FVLFIFSFLD RINIGFAGLT 
MGQDLGLSAT MFGLATTLFY ATYVIFGIPS NVMLSIVGAR RWIATIMVLW GIASTATMFA 
VGPKSLYVLR MLVGITEAGF LPGILLYLTY WFPAFFRARA NALFMIAMPA TTALGSIVSG 
YILSLDGIFN LHGWQWLFLL EGFPSVLLGI MVWFYLDDTP AKAKWLTAED KKCLQEMMDN 
DRLTLVQPEG AISHNAMQQR SLWREVFTPI VLMYTLAYFC LTNTLSAISI WTPQILKSFN 
EGSSNITIGL LAAIPQICTI LGMIYWSRHS DKHQERKHHT ALPFLFAAAG WLLASATDHN 
LIQLLGIVMA STGSFSAMAI FWTTPDQSIS LRARAIGIAV INATGNIGSA LSPFMIGWLK 
DITGSFNSGL WFVASLLVVG AAIIWLIPMK ASRPRATP