Gene Avin_48970 details

Gene Information Plasmid Coverage information Fosmid Coverage information Sequence

Gene Information

Locus tag	Avin_48970
Symbol	anfK
ID	7763756
Type	CDS
Is gene spliced	No
Is pseudo gene	No
Organism name	Azotobacter vinelandii DJ
Kingdom	Bacteria
Replicon accession	NC_012560
Strand	-
Start bp	4956821
End bp	4958209
Gene Length	1389 bp
Protein Length	462 aa
Translation table	11
GC content	59%
IMG OID	643807737
Product	Fe-only nitrogenase, beta subunit
Protein accession	YP_002801972
Protein GI	226946899
COG category	[C] Energy production and conversion
COG ID	[COG2710] Nitrogenase molybdenum-iron protein, alpha and beta chains
TIGRFAM ID	[TIGR02931] Fe-only nitrogenase, beta subunit

Plasmid Coverage information

Num covering plasmid clones	10
Plasmid unclonability p-value	0.12057
Plasmid hitchhiking	No
Plasmid clonability	normal

Fosmid Coverage information

Num covering fosmid clones	n/a
Fosmid unclonability p-value	n/a
Fosmid Hitchhiker	n/a
Fosmid clonability	n/a

Sequence

Gene sequence

ATGACTTGCG AAGTCAAGGA AAAAGGGCGG GTTGGCACTA TCAACCCCAT CTTTACCTGT 
CAACCGGCCG GTGCCCAGTT CGTCAGTATC GGTATCAAGG ATTGCATCGG TATCGTGCAT 
GGCGGCCAAG GCTGCGTGAT GTTCGTCCGC CTGATCTTTT CCCAGCACTA CAAGGAAAGT 
TTCGAGCTGG CCTCTTCCTC CCTGCACGAG GACGGCGCCG TGTTCGGTGC CTGCGGCCGG 
GTCGAGGAAG CGGTCGATGT GCTGCTCAGC CGCTATCCCG ACGTGAAGGT GGTGCCCATC 
ATCACCACCT GCTCCACCGA GATCATCGGC GACGACGTGG ACGGGGTGAT CAAGAAGCTC 
AACGAAGGGC TGCTGAAAGA GAAGTTCCCG GACCGGGAAG TCCATCTGAT CGCCATGCAC 
ACGCCGAGCT TCGTGGGCAG CATGATCAGC GGCTACGACG TGGCCGTTCG GGATGTGGTC 
AGGCATTTCG CCAAGCGCGA AGCGCCCAAC GACAAGATCA ATCTGCTCAC CGGCTGGGTC 
AATCCGGGGG ATGTCAAGGA GCTGAAGCAC CTGCTCGGGG AAATGGACAT CGAAGCCAAC 
GTGTTGTTCG AGATCGAAAG TTTCGACTCG CCGATCCTGC CGGATGGCAG TGCCGTTTCC 
CACGGCAATA CCACCATCGA GGATCTGATC GACACCGGCA ATGCCCGGGC GACCTTCGCC 
CTGAACCGCT ACGAAGGCAC CAAGGCCGCC GAGTATCTGC AGAAGAAATT CGAGATCCCG 
GCGATCATCG GCCCGACCCC GATCGGCATC CGCAATACCG ACATCTTCCT GCAGAACCTG 
AAGAAGGCGA CGGGCAAGCC GATTCCCCAG TCGCTGGCCC ATGAGCGCGG GGTGGCCATC 
GATGCCCTGG CCGACCTGAC CCACATGTTT CTGGCCGAAA AGCGTGTGGC CATCTATGGG 
GCGCCGGATC TGGTGATCGG CCTGGCCGAA TTCTGCCTGG ATCTGGAGAT GAAGCCCGTC 
TTGCTGCTGC TGGGCGACGA CAACTCCAAG TACGTGGACG ATCCGCGCAT CAAGGCGCTT 
CAGGAAAACG TCGATTACGG CATGGAAATC GTCACCAATG CGGATTTCTG GGAACTGGAA 
AACCGCATCA AGAACGAGGG TCTGGAACTG GATCTGATCC TCGGTCACTC CAAGGGCCGT 
TTCATCTCCA TCGACTACAA CATCCCGATG CTGCGCGTGG GTTTCCCGAC CTACGACCGC 
GCCGGCCTGT TCCGCTATCC CACGGTGGGC TATGGCGGTG CCATCTGGCT GGCCGAGCAG 
ATGGCCAACA CCCTGTTCGC CGATATGGAA CACAAGAAGA ACAAGGAATG GGTCCTCAAC 
GTCTGGTAA

Protein sequence

MTCEVKEKGR VGTINPIFTC QPAGAQFVSI GIKDCIGIVH GGQGCVMFVR LIFSQHYKES 
FELASSSLHE DGAVFGACGR VEEAVDVLLS RYPDVKVVPI ITTCSTEIIG DDVDGVIKKL 
NEGLLKEKFP DREVHLIAMH TPSFVGSMIS GYDVAVRDVV RHFAKREAPN DKINLLTGWV 
NPGDVKELKH LLGEMDIEAN VLFEIESFDS PILPDGSAVS HGNTTIEDLI DTGNARATFA 
LNRYEGTKAA EYLQKKFEIP AIIGPTPIGI RNTDIFLQNL KKATGKPIPQ SLAHERGVAI 
DALADLTHMF LAEKRVAIYG APDLVIGLAE FCLDLEMKPV LLLLGDDNSK YVDDPRIKAL 
QENVDYGMEI VTNADFWELE NRIKNEGLEL DLILGHSKGR FISIDYNIPM LRVGFPTYDR 
AGLFRYPTVG YGGAIWLAEQ MANTLFADME HKKNKEWVLN VW