Gene PHATRDRAFT_18128 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	PHATRDRAFT_18128
Symbol
ID	7197160
Type	CDS
Is gene spliced	Yes
Is pseudo gene	No
Organism name	Phaeodactylum tricornutum CCAP 1055/1
Kingdom	Eukaryota
Replicon accession	NC_011670
Strand	+
Start bp	469820
End bp	471244
Gene Length	1425 bp
Protein Length	247 aa
Translation table
GC content	46%
IMG OID
Product	predicted protein
Protein accession	XP_002177625
Protein GI	219111747
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	15
Plasmid unclonability p-value	0.0972526
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGCAACATA TAAGTAGGCA GGGTGTCCAC GACAATGTTA TGGGAGTATA TGACGTTTTG 
CAAGATGAGG AATATTTGTT AATGTTCATG CCCTACTGTT CCTCGGGCGA TCTTTTTTCT 
TTTGTACAAC AAGCTGGAAG GTTTCCGGAA CCAATGGCAC GATACTGGTT TAAGCAAATT 
TTAGAGGTGA GTATTCTTGA GTAATTGGGG TATGCCATAT GTGACGATTG GGCTCTGATC 
AATTGTATAC AAATCTTTTG GGTTAAGGGT GTCTCACATT TGCAGAGGAT GGGCGTTTGC 
CATCGGGATT TGTCGCTAGA AAACATTTTG GTCGACAAGT ATCGAACATC CATCATCATC 
GATCTGGGAA TGTGTTTACG GGTTCCATAC GACGGTGGTA ATCACGTTAC CGATGTTTCG 
TCTGGTACAA TCCGGCGTCT GATTAAACCG CTTGTCCCCT GCGGTAAACC AAACTACATT 
TCTCCGGAGG TCTTGAAATC GCATGAGGCG TTCGATGGAT TTGCTGTTGA TTTGTGGGCG 
TCGGCTGTGA TTTTGTTCAT TATGGTTGTC GGTTTGCCGC CCTGGGAATA TGCCAACAAC 
GATGATCCAA GATACCGGAT GGTCATTGGA GGCGGTCTGG AACGTATGCT ACGAAGTTGG 
GACCGAGAAA TTAGCCCTCT GGTCGCAGAT CTATTGCAAA AAATGCTGAG AGAAGATCCT 
AGACACAGAT TGTCTCTGAT GGAAATCAAG GACCATCCTT GGATTACAGT GGATGAATCT 
GTTGATGGGA TGCCATACGC ACCTGAAGAG GAATGGAGAA GGTAAATGAT TCACTCATCA 
AACGAATAGC TTGCAATAGC GGGAAGGGAG TAATGTTATT AGATCACGAA AATTAGTGCC 
TCGGTGAAGC ACGCACCTCA CTACAAGCCT ATCCAAACAA GCTCCAGTCT CGAATCTGCA 
AACTCGAAAT GATCTCGGGA AAGATCGCGC TGGATTGAGA CAAGTCGGCT TCGTTGGGAT 
TTGGAGAAAT TGGCTCAGAG AGCGTCACCA ATATATCCGA GCCAACCGAT GGAAGACGTA 
TCGCGCCGAC GTCAATACGA ATACACCTAA TTTCTTGTTC CCGACTATCG CCTCTCGGGT 
CATGGTCTCT CCCTAAGGCT ACCTTTTGAT ATCCCATTCC AAAACATATT CTTGCAGTAT 
CCGGTAAATT CGCAAGCTGG AATGGTTGCC TTTGCGGCTG AAAGTGGGTA TTTTCTGGAC 
TAGAACCGTT CGCTTCCGCC AAATCACGAA AAAAATGCCC TGGCGCCTGA TCATCTGCAA 
TGTGGCTTTG GTATTCAAGA ATTTCAACGA CTAGCATGCA CCCATCGTTG ACATCGTGCC 
AACATTCTTG ATGATCCGGA ACTTGACGAA CCTCGGAGAC ATCCA

Protein sequence

MQHISRQGVH DNVMGVYDVL QDEEYLLMFM PYCSSGDLFS FVQQAGRFPE PMARYWFKQI 
LEGVSHLQRM GVCHRDLSLE NILVDKYRTS IIIDLGMCLR VPYDGGNHVT DVSSGTIRRL 
IKPLVPCGKP NYISPEVLKS HEAFDGFAVD LWASAVILFI MVVGLPPWEY ANNDDPRYRM 
VIGGGLERML RSWDREISPL VADLLQKMLR EDPRHRLSLM EIKDHPWITV DESVDGMPYA 
PEEEWRR