Gene PHATRDRAFT_45441 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	PHATRDRAFT_45441
Symbol
ID	7200681
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Phaeodactylum tricornutum CCAP 1055/1
Kingdom	Eukaryota
Replicon accession	NC_011675
Strand	+
Start bp	164401
End bp	165549
Gene Length	1149 bp
Protein Length	379 aa
Translation table
GC content	49%
IMG OID
Product	predicted protein
Protein accession	XP_002179593
Protein GI	219117602
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	26
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

CAGAGCACCA TGGCGGATAT AAGCAAATCT ACGACCGATG CCACCAAGAA GAATCACAAC 
AAATATCGTC GTGACAAGCC ATGGGACAAT GATGACATCG ATCACTGGAA GTTGGCATCA 
TGGAACGCGG ACGATGGTGG CGACACATTG CCCGGCGGCC GTCTCCTGGA AGAGAGTTCC 
TTCGCAACTC TTTTTCCAAA GTATCGTGAA GCCTATTTGC GTCAAATTTG GCCCGTAGTG 
ACGCGGCATT TAGATCAGCA CGGAGTAGCT TGTGAATTGA ATCTTGTGGA AGGAAGTATG 
ACGGTACGGA CAACGAAAAG GACGAAGGAC CCATACGTGA TCCTGAAGGC GAGAGACCTG 
CTGAAATTGC TAGCACGGTC ACTGCCGGTG GCACAAGCGG TCAAGATCCT TCAAGACGAC 
TACCAGTGTG ATATTGTCAA AATTGGAGGC CTCGTTCGAA ACAAGGAGCG TTTTGTAAAG 
CGACGCCAGC GCCTTCTTGG TCCAGATGGA AGTACATTGA AGGCCCTGGA GTTGCTTACG 
GGCTGCTATA TTCTGGTGCA GGGCAATACC GTTAGCATCA TGGGTGATTC GTGGAAAGGT 
TTGAAGCAGG CTCGTCGTGT GGTTTTGGAT TGCTTGAAGA ATATCCACCC TGTATACCAT 
CTGAAACGCC TTATGATTCA GAAAGAGCTC GCGAAGGACC CGGCACTTCA GAACGAGGAC 
TGGTCGCGAT TTTTGCCGCA ATTCCAAAAG AAAAACGTAC AAACTAAAAA ACCTTCCGTT 
CGGAAGACAA AGAAATCATA CACACCGTTC CCGCCCGCCC AACAACCGAG CAAGATCGAT 
CTACAACTCG AATCTGGAGA ATACTTCGCA ACGGAGTTTG AGCGCAAAAC CAAAAAGGTG 
GCCGATCGAA AAGAGGCTTC CAAGAGCAAA TCAATTGCCA AAAGGAAAGC TCGCGAGTTG 
GAAGAAGAAA CACCCGTGCT GGCATCGCGA AAAGCCAAAA CGACCACAAC GAAGGAAGAT 
ATTCCTGTGG AACAGCGCAT CAAGGACAAG TTTCAAAAGG CTGCACAGGC TTCACAATCT 
TCGACCTCCG ACCCTGCCGA CTTTATTCAA GGATCGGGCT CGGGATCCAA GAGGGGTAAA 
AAATCGTAG

Protein sequence

MADISKSTTD ATKKNHNKYR RDKPWDNDDI DHWKLASWNA DDGGDTLPGG RLLEESSFAT 
LFPKYREAYL RQIWPVVTRH LDQHGVACEL NLVEGSMTVR TTKRTKDPYV ILKARDLLKL 
LARSLPVAQA VKILQDDYQC DIVKIGGLVR NKERFVKRRQ RLLGPDGSTL KALELLTGCY 
ILVQGNTVSI MGDSWKGLKQ ARRVVLDCLK NIHPVYHLKR LMIQKELAKD PALQNEDWSR 
FLPQFQKKNV QTKKPSVRKT KKSYTPFPPA QQPSKIDLQL ESGEYFATEF ERKTKKVADR 
KEASKSKSIA KRKARELEEE TPVLASRKAK TTTTKEDIPV EQRIKDKFQK AAQASQSSTS 
DPADFIQGSG SGSKRGKKS