Gene Saro_1295 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Saro_1295
Symbol
ID	3917927
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Novosphingobium aromaticivorans DSM 12444
Kingdom	Bacteria
Replicon accession	NC_007794
Strand	+
Start bp	1339901
End bp	1341172
Gene Length	1272 bp
Protein Length	423 aa
Translation table	11
GC content	69%
IMG OID	640444032
Product	general substrate transporter
Protein accession	YP_496573
Protein GI	87199316
COG category	[G] Carbohydrate transport and metabolism
COG ID	[COG2271] Sugar phosphate permease
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	23
Plasmid unclonability p-value	0.659237
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGAATCCGA TTCGCCAGCA CGGCCGCGTG CTGACCGCCA GCCTCGTCGG CACGGCGGTC 
GAGTTCTACG ATTTCTATAT CTACGCGACG GCGGCGGCGC TGGTCATCGG TCCGCTTTTC 
TTTCCCACGG AATCGCAGGC TGCCCAGACT CTCCTCTCCT TCATGACCTT CGGCCTGGCG 
TTCTTCGCGC GGCCCGTCGG GGCGGTGGCC TTCGGGCATT TCGGTGATCG CATCGGGCGC 
AAGTCGACGC TGGTCGCGTC GCTCATGCTG ATGGGCGGAT CGACGCTGCT GATCGCGTTC 
CTGCCAACTT ATGCGATCGC CGGGTGGATC GCCCCGGCGC TGCTTTGCCT CCTGCGCTTC 
GGTCAGGGTT TCGGGCTTGG CGGGGAGTGG GGCGGGGCGG CGCTGCTGGC GGTGGAGAAT 
GCGCCGCGCG GCTGGGAAGC GCGCTTCGGC AGCGCGCCGC AGCTTGGCGC GCCGTTAGGG 
TTCTTTTTCG CCAACGGCCT GTTCCTCCTG CTCGGCCTCG GCCTCTCGGA CGCGGACTTT 
GCCGCCTGGG GCTGGCGCGT GCCGTTCCTT GCCAGCGCGG TGCTGGTCGG CGTGGGCTTG 
TGGGTGCGGC TGAAGATTGG CGAAACGCCC TCGTTCCGTG AAGCTATGGA AAAGGCGCCG 
CCGCCGCAGG TGCCCATTTC CCGCCTGCTG CGCGGTCACT CCCCGGCCGT CCTCGCCGGG 
ATCGCCGGCG TGGTCGCGTG CTTCGCCATC TTCTACCTCG CGACGACCTT CGCCCTGTCC 
TTTGCCACGA CCGCGCTGGG CTATGCCAAG CAGGAATTCC TTGCGGTCCA GCTTGGCGCC 
AACACCTTCT TCGCGCTCGG CATTCTCGTG GCGGGCTACT GGGCCGACAA GACTTCGGTC 
CGGCGTGTCC TCGGCACGGG CGCGGCGCTC ACCGCGGTGC TCGGCATGGT CTTCGGGACC 
GGGCTGGGCT CGGGCTCGCT TGCGGTGGTC TTCGCGACGC TCGCCTCGTC GCTGTTCATC 
ATGGGCCTTG CCTACGGGCC GCTCGGCGCG TGGTTGCCGA CGCTCTTTCC GGTGTCGGTG 
CGCTACACCG GCATTTCACT GGCGTTCAAC GTCGGCGGGA TCATCGGGGG CGCGCTGGCG 
CCCTTCGCCG CGGCCTGGCT CGCGGGAGTG GGGGGCACCG CCTATGTCGG CGTGTTCCTG 
ACCCTGGCTG GGGCGATGAC GCTGGCGGGC GTACAGTTCT CCCCCCGGGG GGCCGAACCC 
GGGGAGGCGT GA

Protein sequence

MNPIRQHGRV LTASLVGTAV EFYDFYIYAT AAALVIGPLF FPTESQAAQT LLSFMTFGLA 
FFARPVGAVA FGHFGDRIGR KSTLVASLML MGGSTLLIAF LPTYAIAGWI APALLCLLRF 
GQGFGLGGEW GGAALLAVEN APRGWEARFG SAPQLGAPLG FFFANGLFLL LGLGLSDADF 
AAWGWRVPFL ASAVLVGVGL WVRLKIGETP SFREAMEKAP PPQVPISRLL RGHSPAVLAG 
IAGVVACFAI FYLATTFALS FATTALGYAK QEFLAVQLGA NTFFALGILV AGYWADKTSV 
RRVLGTGAAL TAVLGMVFGT GLGSGSLAVV FATLASSLFI MGLAYGPLGA WLPTLFPVSV 
RYTGISLAFN VGGIIGGALA PFAAAWLAGV GGTAYVGVFL TLAGAMTLAG VQFSPRGAEP 
GEA