Gene PHATRDRAFT_47187 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	PHATRDRAFT_47187
Symbol
ID	7201963
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Phaeodactylum tricornutum CCAP 1055/1
Kingdom	Eukaryota
Replicon accession	NC_011680
Strand	-
Start bp	748196
End bp	749442
Gene Length	1247 bp
Protein Length	362 aa
Translation table
GC content	47%
IMG OID
Product	predicted protein
Protein accession	XP_002181436
Protein GI	219122194
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	30
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGGGAGGTC GTAGCAAAAG ACCCTCGGGT GGACGTATGC TACGCATCAT TGCTGCGGTG 
CTAGTACTGT GCTTATGGGC CTTTAAATTT CCCATATTGT TCGATGAGTC GATTGACCGA 
GCAAAGGATT CTCCGGCAAC GCACAGTTCC TCAGGGAATA ACTGGGACTT TCTGACGTTG 
CCGCAGACAC CTTTGGCAGC AAACCAAAAC CTGATACAGA TCGAATTTGA TTGGATCAAT 
GCACGTTTGC TCGGACCCGA CTCTTACGGT GGAACCGATA AATGCAGTCT TTGTGGGTGT 
CCTGGCGTTC CAACCCCTCG AGACTGCCCG CAGTGGTACA CAGTGGAGGA CATCCAAGAC 
TCCGTACACT TTATGGATGA TCACAGCGAT GTGCTTATTC CGCACTCACG TGCTTTGTTG 
AACAAAAGAC GATTAGAGGC GGAAGGCGAC TGTCAGGTGA AGGAGGTTAC TCAAGCCCGA 
GGTGGATGGT GTCTTACACC AAATCCTAAA GGGGAAAAAA TGACTACGGC TAATGGCAGC 
TTTCTTGTAC CATTCCATCA TGTTCCTCCA GCAAAGCGTC TCGTCGATGA AATTGACAAG 
CTGATTCGAG ACGAAGACGT AAGATCAATA GTCGACTTTG GTGCAGGTGT AGGACAGTAC 
AAGTTGGCCT TGACCGAGCG GCATCCTGAT CTACAGTACT ATGCGTATGA TGGGGCTGGT 
AATGCTGTTA ATTATACCAA CGACTACCTG GAATACTTTG ATCTGACCAT TCCTTTGGGA 
CTACCCAAGG CGGATTGGGT TTTGTCACTT GAGGTGGGAG AGCATGTGCC TAGTAAATAC 
GAAGGTATGG TCCTACGGAA TCTGCATCGA CACAATTGCA AAGGAATAAT ATTGAGTTGG 
GGTGTTCTTG GCCAAGGAGG ATATGGCCAT GTCAACAACC ACTCCAATGA TTATATCATC 
AAAGTGATTG AACAGCTTGG ATATGTTCTA GACCAAAAAT TGACTGCACG ATTCCAGCAA 
GCCAAGGATA ATTACTGGTG GTTCAAAAAA TCAACCATGG CCTTTCGACG TACGACTGAA 
GTCTGTTAGT GTACCCGCTG GCTGCGTTGA AAAAGAGTGC TGCTTCGGTT TTTCAAAATA 
CGATTTGATG ACATTTGGTG ACTGGATCCC GGCTTGGTTG GATGCGATGG CACGGTGATA 
GAAAAATTGA AGAGAACGGT TTTCTATAAA CTCAATTGCA CTTATTT

Protein sequence

MGGRSKRPSG GRMLRIIAAV LVLCLWAFKF PILFDESIDR AKDSPATHSS SGNNWDFLTL 
PQTPLAANQN LIQIEFDWIN ARLLGPDSYG GTDKCSLCGC PGVPTPRDCP QWYTVEDIQD 
SVHFMDDHSD VLIPHSRALL NKRRLEAEGD CQVKEVTQAR GGWCLTPNPK GEKMTTANGS 
FLVPFHHVPP AKRLVDEIDK LIRDEDVRSI VDFGAGVGQY KLALTERHPD LQYYAYDGAG 
NAVNYTNDYL EYFDLTIPLG LPKADWVLSL EVGEHVPSKY EGMVLRNLHR HNCKGIILSW 
GVLGQGGYGH VNNHSNDYII KVIEQLGYVL DQKLTARFQQ AKDNYWWFKK STMAFRRTTE 
VC