Gene Tery_3924 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Tery_3924
Symbol
ID	4244007
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Trichodesmium erythraeum IMS101
Kingdom	Bacteria
Replicon accession	NC_008312
Strand	-
Start bp	6064632
End bp	6065948
Gene Length	1317 bp
Protein Length	438 aa
Translation table	11
GC content	40%
IMG OID	638108847
Product	hypothetical protein
Protein accession	YP_723429
Protein GI	113477368
COG category
COG ID
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	13
Plasmid unclonability p-value	0.647872
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	3
Fosmid unclonability p-value	0.00979003
Fosmid Hitchhiker	Yes
Fosmid clonability	hitchhiker

Sequence

Gene sequence

ATGAGCGTAA ATGTCAAAGC TTTCTTTCAG GCAACAAACC CTGGTAAAGC CCTATTCAAA 
GATAACCAGG AAATAGAGGA AAAATACTAT ATTGACTTCT CCTCAGTACG GGGGGGAAAA 
ATAATAGAAG ACCTCAAAGA CAATATTGCT ATGTGGTTTC CCGACGAACC TACCTGTCAA 
CTATTCACCG GACATATTGG TTGTGGTAAA TCTACCGAAC TCTGGCTACT CAAACAACTA 
TTAGAAGCAG AAGGCTTTCA CGTCGTCTAT TTTGAGTCAG ACAAAGACCT AGAAATGGGA 
GATATAGACG TCAGTGATAT TCTTCTAACT ATAGCTCGAC AAGTCATCGA AAGTTTGAAG 
ACCCGGGAGA AGCTCAATTT AGGTGAACCC ACAAGATTCA AACGTCAAAT TGAGGGAGCT 
ATGAGACTAT TGCAGACAGA AATAGAAATA TCTCCTGGAG TTGAGCTTTC TTTTGGAATT 
GCCAAAATAA CTGCTCAGGC CAAAGCTAGT CCCCAACTCC GCAGCAAACT CAGAGACTAT 
CTCGGGCCTC GTAGCAATGG AATTATTGAA ACAATAAACC AAGAGTTACT CGAACCAGCT 
CACGAAAAGC TGAAGCAGCG CGACAAAAAG GGATTAGTAG TTATAGTTGA CAACCTTGAT 
AAAGTTGATA GTGCCCCAAA ACCTTGGGGG CGATCTCAAC CAGAATATCT ATTTGTTGAT 
CGCGGCGAAC AACTAGCAAG TCTCCATTGT CATGTAATTT ATACTCTACC TCTAGCACTG 
CGATTTTCCA ATGACTATAA TAGATTAACT CAACGCTTCA AAACCGACCC CCAAGTCTTG 
CCAATGGTTT CTATGCAGTT GCGGGATGGT AAGGAATTTG GAGAAGGAAT GGCAAAACTC 
AGGCAGTTAG TTTTAGCAAG AGCATTTCCC CATTTGGGAG AACAACAACG TCTAGAGAAA 
ATAACTGAAA TTTTTGACAG TACCGAAACT TTAGATCATC TATGTAAAAT GAGTGGGGGT 
CATGTGAGAA ATATATTGCG GATACTCAAT GAGGCTATTA AAAAGCAAAA AGGGTTGCCG 
ATATCCAGTG AAAACCTGAA CAAGGTAATT CAAAATTTTC GCAATGAACG TACTCTGGCA 
GTAGATGATC AAGAGTGGGA GTTGTTGCGC CAAGTAGCAC AAACTAAAAA AGTTACAGGT 
GATGATGGAT ATCAAAAGTT GATTCGGAGT ATGTTTGTCT ATGAATACCG AGATGATGAA 
GGATCTTGGT TTGATATTAA TCCTATATTG AAAGATGCAG TGGAATTGAA AAAATGA

Protein sequence

MSVNVKAFFQ ATNPGKALFK DNQEIEEKYY IDFSSVRGGK IIEDLKDNIA MWFPDEPTCQ 
LFTGHIGCGK STELWLLKQL LEAEGFHVVY FESDKDLEMG DIDVSDILLT IARQVIESLK 
TREKLNLGEP TRFKRQIEGA MRLLQTEIEI SPGVELSFGI AKITAQAKAS PQLRSKLRDY 
LGPRSNGIIE TINQELLEPA HEKLKQRDKK GLVVIVDNLD KVDSAPKPWG RSQPEYLFVD 
RGEQLASLHC HVIYTLPLAL RFSNDYNRLT QRFKTDPQVL PMVSMQLRDG KEFGEGMAKL 
RQLVLARAFP HLGEQQRLEK ITEIFDSTET LDHLCKMSGG HVRNILRILN EAIKKQKGLP 
ISSENLNKVI QNFRNERTLA VDDQEWELLR QVAQTKKVTG DDGYQKLIRS MFVYEYRDDE 
GSWFDINPIL KDAVELKK