Gene Rcas_3335 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Rcas_3335
Symbol
ID	5540833
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Roseiflexus castenholzii DSM 13941
Kingdom	Bacteria
Replicon accession	NC_009767
Strand	+
Start bp	4351226
End bp	4352764
Gene Length	1539 bp
Protein Length	512 aa
Translation table	11
GC content	58%
IMG OID	640895452
Product	AMP-dependent synthetase and ligase
Protein accession	YP_001433403
Protein GI	156743274
COG category	[I] Lipid transport and metabolism [Q] Secondary metabolites biosynthesis, transport and catabolism
COG ID	[COG0318] Acyl-CoA synthetases (AMP-forming)/AMP-acid ligases II
TIGRFAM ID

Plasmid Coverage information

Num covering plasmid clones	8
Plasmid unclonability p-value	0.277543
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	32
Fosmid unclonability p-value	1
Fosmid Hitchhiker	No
Fosmid clonability	normal

Sequence

Gene sequence

ATGCTGAATC TCGCCATTAT TCTGGAGGAG AGCGCGCGCC GGATGCCCGG AAAGACTGCT 
GTCATCCTCG ACAGCATTCG CCTGAACTAT GCCGAACTAA ACGGCGCCGC CAACAAAATT 
GCCAACGGTC TGGCAAATCT CGGCGTGCGC CCTGGCGACA AAGTGGCGAT GATGATCCCC 
AACACGCCAC ACTTCCCGAT GTGCTATTTC GGCATTCTCA AGGCTGGCGC GACGGTTGTG 
CCGCTCAATG TGCTATTCAA GCGCGATGAG GTTCGGTATC ATCTGGAAGA CAGCGACTCG 
GTCGCACTGA TCGTCTGGGA AGGATTCCTC GATGAAGCCG CGTCCGGCTT TCACGCGGTC 
AAAACCTGCC GTCACCTGAT CGTCGCGCAG GCGCCGGGTT CCACGGCGAC ACTCCCCGAT 
GGCGCGATTC CGCTCGGCAG TCTCCTCGCC GAACACGCTC CGGTATTCGA TACGGTCCAG 
ACCATGCCGG ACGATACGGC GGTTATTCTC TACACCAGCG GCACGACGGG TCGCCCCAAG 
GGCGCGGAAC TGACCCATGC CAACATGTTC TTGAATGCCA CGATCTGCAC CGATAAGTTG 
CTGAATGTCT CGTCAGAAAC GGTGGGGCTG GCGGTACTGC CATTGTTTCA CAGTTTTGGA 
CAGACGTGTG TGATGAACAG TCTGATCTAC GCCGGCGGCG CCATCACCAT GCTGCCGCGC 
TTCGAACCGC AGAAGGCGCT CGAAGTGATG GCGCGCGACC GGGTGACGTA TTTCGCCGGC 
GTGCCGACGA TGTATTTCTA TCTGCTCAAT TTCCCCGGCG CAGATCAGTA TGATCTGTCG 
GCGCTTAAGT TCTGCGTCTC AGGCGGCGCA GCGATGCCGG TCGAAGTGAT GCATGCCTTC 
AACCGTAAAT ACAATGTCAC CATCCTCGAA GGGTACGGTC TCTCCGAAAC TTCTCCGGTG 
GCGTCGTTCA ATCATCTCGA CCGCGAGCCA AAGCCGGGGT CGATCGGCGT GCCGATCTGG 
GGCATTGAGA TGCGCGTGGT GGATGACCAG GGGCGCGAGG TTCCCAACGG CGAACTTGGT 
GAGATTGTCA TTCGTGGGCA CAATGTGATG AAGGGGTACT ACAAGCGTCC CGACGCAACT 
GCTGATGCGA TTCGCAATGG CTGGTTCCAC AGCGGCGACA TAGCCTATCG TGACGATGAC 
GGTTTCTTCT TCATCAAGGA TCGCGTGAAG GATATGATCA TCCGCGGCGG GTTCAATGTC 
TATCCGCGCG AGATCGAAGA GGTGCTCTAC GGGCATCCAG CCATCGCCGA AGCGGCCGTC 
ATTGGCGTTC CCGATCAGGC GCTTGGCGAG GAGGTCAAGG CGGTTGTCGC CCTGAAGCCA 
GGGCATACGG CAACCGAGAC AGAGATTATT GAGTACTGTA AGGAACGCCT GGCTGCCTAC 
AAGTATCCGC GCATCGTCGA AATCCGCGAG ACGTTGCCCA AGACGGCGAC CGGCAAAATC 
CTCAAGCGCG AATTGCGTCA GATCGAAGTG ACTGCATAG

Protein sequence

MLNLAIILEE SARRMPGKTA VILDSIRLNY AELNGAANKI ANGLANLGVR PGDKVAMMIP 
NTPHFPMCYF GILKAGATVV PLNVLFKRDE VRYHLEDSDS VALIVWEGFL DEAASGFHAV 
KTCRHLIVAQ APGSTATLPD GAIPLGSLLA EHAPVFDTVQ TMPDDTAVIL YTSGTTGRPK 
GAELTHANMF LNATICTDKL LNVSSETVGL AVLPLFHSFG QTCVMNSLIY AGGAITMLPR 
FEPQKALEVM ARDRVTYFAG VPTMYFYLLN FPGADQYDLS ALKFCVSGGA AMPVEVMHAF 
NRKYNVTILE GYGLSETSPV ASFNHLDREP KPGSIGVPIW GIEMRVVDDQ GREVPNGELG 
EIVIRGHNVM KGYYKRPDAT ADAIRNGWFH SGDIAYRDDD GFFFIKDRVK DMIIRGGFNV 
YPREIEEVLY GHPAIAEAAV IGVPDQALGE EVKAVVALKP GHTATETEII EYCKERLAAY 
KYPRIVEIRE TLPKTATGKI LKRELRQIEV TA