Gene EcolC_1135 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	EcolC_1135
Symbol
ID	6068037
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Escherichia coli ATCC 8739
Kingdom	Bacteria
Replicon accession	NC_010468
Strand	-
Start bp	1239674
End bp	1240876
Gene Length	1203 bp
Protein Length	400 aa
Translation table	11
GC content	54%
IMG OID	641600551
Product	phenylpropionate dioxygenase ferredoxin reductase subunit
Protein accession	YP_001724129
Protein GI	170019175
COG category	[R] General function prediction only
COG ID	[COG0446] Uncharacterized NAD(FAD)-dependent dehydrogenases
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	23
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	20
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAAAGAAA AAACGATCAT TATTGTCGGT GGCGGGCAAG CGGCGGCAAT GGCTGCGGCC 
TCGCTACGCC AGCAAGGGTT CACCGGTGAG CTGCATCTGT TTTCCGATGA GCGACATCTT 
CCTTATGAAC GACCTCCACT CTCGAAATCC ATGTTGCTGG AAGATTCCCC GCAGTTACAG 
CAGGTGTTAC CCGCTAACTG GTGGCAGGAA AACAATGTTC ATCTGCATTC CGGTGTAACC 
ATCAAAACGC TGGGTCGCGA CACACGAGAG TTAGTGTTAA CCAACGGCGA AAGCTGGCAC 
TGGGATCAGC TTTTTATAGC AACCGGCGCG GCAGCTCGAC CGCTGCCGTT GCTTGATGCA 
CTGGGAGAAC GCTGCTTTAC CCTACGCCAT GCCGGTGATG CCGCCAGACT GCGAGAAGTT 
CTGCAGCCCG AACGGTCAGT CGTGATTATC GGTGCCGGAA CTATTGGTCT GGAACTGGCT 
GCCAGCGCCA CGCAGCGCAG ATGTAAGGTG ACAGTGATTG AACTGGCGGC AACCGTCATG 
GGCCGTAATG CACCACCGCC CGTGCAACGC TATCTTTTAC AGCGCCACCA GCAGGCTGGT 
GTGCGTATTC TGCTCAATAA TGCCATTGAA CATGTGGTCG ATGGTGAAAA AGTAGAACTG 
ACGCTGCAAA GTGGGGAAAC GCTTCAGGCT GATGTGGTGA TTTACGGTAT TGGTATCAGC 
GCCAACGAGC AACTGGCTCG CGAGGCCAAC CTTGATACTG CCAATGGCAT TGTCATTGAT 
GAGGCTTGCC GCACCTGCGA TCCCGCGATC TTTGCCGGTG GCGATGTGGC AATCACTCGT 
CTTGATAATG GTGCACTACA CCGCTGCGAA AGCTGGGAAA ACGCCAATAA CCAGGCGCAA 
ATTGCCGCTG CCGCAATGTT AGGGCTACCG CTACCGCTAC TGCCGCCGCC GTGGTTCTGG 
AGCGATCAGT ACAGTGATAA CTTACAGTTT ATTGGCGATA TGCGTGGCGA TGACTGGCTT 
TGTCGTGGCA ACCCGGAAAC TCAGAAGGCG ATTTGGTTTA ATCTGCAAAA CGGCGTGCTT 
ATCGGTGCGG TCACGCTGAA TCAGGGGCGT GAGATTCGCC CAATTCGCAA ATGGATCCAG 
AGCGGCAAAA CGTTTGATGC GAAACTGCTG ATAGATGAGA ACATCGCGCT TAAATCACTG 
TAA

Protein sequence

MKEKTIIIVG GGQAAAMAAA SLRQQGFTGE LHLFSDERHL PYERPPLSKS MLLEDSPQLQ 
QVLPANWWQE NNVHLHSGVT IKTLGRDTRE LVLTNGESWH WDQLFIATGA AARPLPLLDA 
LGERCFTLRH AGDAARLREV LQPERSVVII GAGTIGLELA ASATQRRCKV TVIELAATVM 
GRNAPPPVQR YLLQRHQQAG VRILLNNAIE HVVDGEKVEL TLQSGETLQA DVVIYGIGIS 
ANEQLAREAN LDTANGIVID EACRTCDPAI FAGGDVAITR LDNGALHRCE SWENANNQAQ 
IAAAAMLGLP LPLLPPPWFW SDQYSDNLQF IGDMRGDDWL CRGNPETQKA IWFNLQNGVL 
IGAVTLNQGR EIRPIRKWIQ SGKTFDAKLL IDENIALKSL