Gene EcolC_2152 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	EcolC_2152
Symbol
ID	6065540
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Escherichia coli ATCC 8739
Kingdom	Bacteria
Replicon accession	NC_010468
Strand	+
Start bp	2353865
End bp	2355013
Gene Length	1149 bp
Protein Length	382 aa
Translation table	11
GC content	44%
IMG OID	641601559
Product	fimbrial biogenesis outer membrane usher protein
Protein accession	YP_001725118
Protein GI	170020164
COG category	[N] Cell motility [U] Intracellular trafficking, secretion, and vesicular transport
COG ID	[COG3188] P pilus assembly protein, porin PapC
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	16
Plasmid unclonability p-value	0.883478
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	23
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGAGTGGTT ACACCGTCAA GCCTCCTACC GGAGACACCA ATGAGCAGAC ACAATTTATT 
GATTATTTTA ATCTGTTCTA CAGTAAGCGT GGTCAGGAAC AAATAAGCAT CTCTCAGCAG 
CTTGGAAATT ACGGTACGAC ATTTTTCAGT GCCAGTCGCC AAAGTTACTG GAACACGTCA 
CGCAGCGACC AGCAAATATC ATTTGGATTA AATGTGCCGT TTGGTGATAT TACGACTTCG 
CTGAATTACA GCTATTCCAA TAATATATGG CAAAACGATC GGGATCATTT ACTCGCTTTT 
ACGCTTAATG TTCCCTTCAG TCATTGGATG CGTACAGACA GTCAGTCGGC ATTTCGTAAT 
TCAAACGCCA GTTACAGTAT GTCAAACGAT TTGAAAGGCG GCATGACCAA TCTATCGGGG 
GTTTATGGCA CTCTGCTGCC GGATAATAAC CTGAATTATA GCGTTCAGGT CGGTAACACC 
CACGGAGGTA ATACATCGTC TGGCACCAGT GGTTACAGTT CTCTTAATTA TCGTGGAGCT 
TATGGTAATA CTAATGTCGG TTACAGTCGG AGTGGTGACA GCAGCCAGAT TTATTACGGA 
ATGAGTGGTG GGATTATTGC TCATGCTGAT GGCATCACCT TTGGACAGCC GCTGGGCGAC 
ACAATGGTTC TGGTTAAGGC TCTTGGTGCT GATAATGTCA AAATAGAGAA CCAGACCGGA 
ATTCATACCG ACTGGCGTGG CTATGCCATA TTACCATTTG CGACAGAATA TAGAGAAAAC 
CGTGTTGCTC TTAACGCGAA TTCCCTTGCA GATAATGTTG AACTGGATGA AACCGTGGTC 
ACTGTCATCC CAACTCACGG TGCTATTGCC AGAGCAACAT TTAATGCACA AATCGGCGGG 
AAAGTATTAA TGACGTTGAA GTACGGTAAT AAGAGCGTTC CATTCGGTGC AATTGTCACA 
CACGGAGAGA ATAAAAATGG CAGCATTGTC GCGGAAAATG GTCAGGTTTA TCTGACTGGA 
CTTCCACAGT CAGGGCAATT ACAGGTTTCA TGGGGCAAAG ATAAAAACTC AAACTGTATT 
GTCGAGTACA AGCTTCCTGA AGTTTCTCCT GGTACCTTAC TGAACCAGCA GACAGCAATC 
TGTCGCTAA

Protein sequence

MSGYTVKPPT GDTNEQTQFI DYFNLFYSKR GQEQISISQQ LGNYGTTFFS ASRQSYWNTS 
RSDQQISFGL NVPFGDITTS LNYSYSNNIW QNDRDHLLAF TLNVPFSHWM RTDSQSAFRN 
SNASYSMSND LKGGMTNLSG VYGTLLPDNN LNYSVQVGNT HGGNTSSGTS GYSSLNYRGA 
YGNTNVGYSR SGDSSQIYYG MSGGIIAHAD GITFGQPLGD TMVLVKALGA DNVKIENQTG 
IHTDWRGYAI LPFATEYREN RVALNANSLA DNVELDETVV TVIPTHGAIA RATFNAQIGG 
KVLMTLKYGN KSVPFGAIVT HGENKNGSIV AENGQVYLTG LPQSGQLQVS WGKDKNSNCI 
VEYKLPEVSP GTLLNQQTAI CR