Gene Pnap_4042 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Pnap_4042
Symbol
ID	4686148
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Polaromonas naphthalenivorans CJ2
Kingdom	Bacteria
Replicon accession	NC_008781
Strand	+
Start bp	4308570
End bp	4309562
Gene Length	993 bp
Protein Length	330 aa
Translation table	11
GC content	60%
IMG OID	639837055
Product	TRAP dicarboxylate transporter, DctP subunit
Protein accession	YP_984254
Protein GI	121606925
COG category	[G] Carbohydrate transport and metabolism
COG ID	[COG1638] TRAP-type C4-dicarboxylate transport system, periplasmic component
TIGRFAM ID	[TIGR00787] tripartite ATP-independent periplasmic transporter solute receptor, DctP family

Plasmid Coverage information

Num covering plasmid clones	15
Plasmid unclonability p-value	0.941259
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	24
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAAGCAA TTTGTTCAAC ATTCATCGCC GTGCTGGCCC TCGCCACTTG CGCAGTGATG 
GCACATGCCG AGCCGATCAC CCTGACGCTG GTCCATGCCG CCTCGACCAC GCACCCGGAA 
CACCTGGCGG CGCTGCAGTT TGCCAGGCGC GTCGAAGAGC GCACCCACGG GCAAATCAAG 
ACCAGGATAT TCCCGGCGGC CCAGCTCGGC AGCGAAACCG AAATGATCCA GAAAGTCCGA 
CTCGGAGCCA TCGACATGGA CTTGGCCTCT CACCACTACC TCATCAATTA TGAGAAGGCC 
TTCGCGGTTG TGATCATGCC TTACGTATTC GACAACTATG AGCATGCGCA CCGGGTGCTC 
GACGGCCCGG CGATGGCCTG GCTCGCGCCG CTGGCCGAAA AGCAGGGCTT CGTGATCTTG 
TCCAACTGGG AATGGGGCTT TCGCAACCTG AGCAACAACC AGCGTCCAAT CAACCAGCCC 
GAGGATGTGC GCGGCCTGAA AATACGCGTG CCGCCTGGGG TTGGAATGGA GGCCAGCATG 
GAAGCGCTGG GCGCGCAGAT CAGCAAGATC AGCTTCAAGG ATCTCTACGC AGCGTTGTCG 
CAAGGACGGG TCGATGGCCA GGAAAACCCG CTCAGTGTCT TTTATCACCA CAAGCTGTAC 
GAGTCTCAGA AGCACCTCGC GCTGACGCGG CATGTTTACT ACAACATGGT CCACTTCATC 
AGCGTCAAAA GCTGGACCCG GCTCACGCCG GCGCAGCAAA CCATCGTGCG CGAAGAAAGC 
AAGGCGGCGG GCGACGGCAT GCGCAAAAAA ATCATGGCCG AAGAGGACGA GCTGATCGCC 
AGGCTGGCCG CTGCCGGGGT GAAGGTCACA CGCCCCGACC CCCAGCCGTT CCGCGCCATG 
ATGGAGCCCG CCCACAAAAA GATCAAGCTC CTTGCCGGCG AAGAGAACGC ACGCAAGTTC 
CTGAACATGG TCGCGGATGA ACGCCGGCCA TGA

Protein sequence

MKAICSTFIA VLALATCAVM AHAEPITLTL VHAASTTHPE HLAALQFARR VEERTHGQIK 
TRIFPAAQLG SETEMIQKVR LGAIDMDLAS HHYLINYEKA FAVVIMPYVF DNYEHAHRVL 
DGPAMAWLAP LAEKQGFVIL SNWEWGFRNL SNNQRPINQP EDVRGLKIRV PPGVGMEASM 
EALGAQISKI SFKDLYAALS QGRVDGQENP LSVFYHHKLY ESQKHLALTR HVYYNMVHFI 
SVKSWTRLTP AQQTIVREES KAAGDGMRKK IMAEEDELIA RLAAAGVKVT RPDPQPFRAM 
MEPAHKKIKL LAGEENARKF LNMVADERRP