Gene Cmaq_1830 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Cmaq_1830
Symbol
ID	5710082
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Caldivirga maquilingensis IC-167
Kingdom	Archaea
Replicon accession	NC_009954
Strand	-
Start bp	1909330
End bp	1910550
Gene Length	1221 bp
Protein Length	406 aa
Translation table	11
GC content	49%
IMG OID	641276335
Product	hypothetical protein
Protein accession	YP_001541637
Protein GI	159042385
COG category	[S] Function unknown
COG ID	[COG1602] Uncharacterized conserved protein
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	30
Plasmid unclonability p-value	1
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	48
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

GTGCGGATTA ACCCTGAACT ATGCATTAAA TGCCGTGGGG AGTATAACCT ATGCGGGTTA 
GCGTACTGCC CAATACTAGT GAATAATTGG ACACTTAGGA GGATTAAGCC CCTTGAGGGT 
AGGCAGGATG TTAACGGCTC CTCACCCCCA AGCATCATGG TTGGTAGATT AGGTTACCCT 
AAGGTTAGAG TCTACCCAGC CACACCACCC ACTCATGGGG ACACAGGTTG GCTTGAGGAA 
CCGAGGACAT GGTTAAGCAT GAGGCTTGAG GACTTCCTAT CAAGTAGACT CACGTTAATC 
AGGGGGTCAG TAATCTTCAA GGTTAATGAC CCAAGGAACC CACCTAGGCA ACTCCACGAC 
ATACAGGTAA TGGCTATTTC AAGCGGACCC GTGGACACTG AGTTAACGCT GGCTAAGCCA 
ATTAAAGGTA ATGTAACCTT AAATGAACAG GAACCACCAA TAGGCCCCTC AGCCCCATTG 
AGAAGCATTA AATTATCCAC AATACCTCAA CCAAGCAGGG CTGTGGAGAA GGCTTACTCC 
GACGTGGATT TAAAGGCTAA TGATGCCGTT TGGATGCTTT ATAACTCAGG CATTGATGTG 
CACGTTATCT CAAGGTTAAT GAGCGTAGGC GCCATAGGTA GGGGTAGGGC TAGGAGACTC 
GTACCCACTA GGTGGTCTAT AACTGCGGTT GATGAGGAGG TTTCAAGTAG GTTAATCAAT 
GAGGTTAAGA ATTACCCTGA GTTAAGCGAG TACAGGGTTT ACGTCAGGAG GAGTAACAAT 
AACCTATTCA TAGGCATACT AGCCCCACAC ACCTGGCTAT ACGAGTGGGG TGAGGCATGG 
TGGCCTGGGA GCACTTGGAA CACCTGGGGA AGTGAACCAG TGATTGAAAT CGATAGTGAA 
GGCTACTGGG GTAGGGACAC CTACCCAAGC ATCGGTGGAT GCTACTACGC AGCCAGGTTA 
GCTGCAGCAG AGGCGCTTCA TAGTATGCAT AGGCAGGCAG CCGTAATTCT CTGGAGGGAG 
ATTTACCCAG GCTTCAATAT ACCTGTGGGT GTTTGGTTCG TTAGGGAGAA TGTTAGAGCC 
ATGTTTAAGG GTAGCTACGT CAGCTTCAGT AGCCTTGATG AGGCGCTTAA ATTCGCCTCA 
AGTCAACTTA AACTACCGCT GGCTCAATGG GCCTCAAGAT CCTACGTATT GAGGAGGTTA 
AGGGAGGCTA GATTACTATG A

Protein sequence

MRINPELCIK CRGEYNLCGL AYCPILVNNW TLRRIKPLEG RQDVNGSSPP SIMVGRLGYP 
KVRVYPATPP THGDTGWLEE PRTWLSMRLE DFLSSRLTLI RGSVIFKVND PRNPPRQLHD 
IQVMAISSGP VDTELTLAKP IKGNVTLNEQ EPPIGPSAPL RSIKLSTIPQ PSRAVEKAYS 
DVDLKANDAV WMLYNSGIDV HVISRLMSVG AIGRGRARRL VPTRWSITAV DEEVSSRLIN 
EVKNYPELSE YRVYVRRSNN NLFIGILAPH TWLYEWGEAW WPGSTWNTWG SEPVIEIDSE 
GYWGRDTYPS IGGCYYAARL AAAEALHSMH RQAAVILWRE IYPGFNIPVG VWFVRENVRA 
MFKGSYVSFS SLDEALKFAS SQLKLPLAQW ASRSYVLRRL REARLL