Release date
Release ID
237
Data source
NCBI Refseq release 237
Number of genomes
15826
Number of proteins
724778
VOGDB group
Number of VFAM: 40091 (Virus protein families)
Number of VOG: 49128 (Virus orthologous groups)
Number of VFOLD: 33333 (Virus protein structural folds)
Base URL
VOGDB File
vog.raw_algs.alistat.txt (Statistics of multiple alignments): 3,307,618 bytes, MD5 checksum 5f6cb4b8eb2735e3533b6410225af7b1
https://fileshare.csb.univie.ac.at/vog/vog237/vog.raw_algs.alistat.txt
vog.annotations.tsv.gz (Funcational annotations of groups): 374,234 bytes, MD5 checksum ed0b907ee2ccef495f6a1b1ca5e2870e
https://fileshare.csb.univie.ac.at/vog/vog237/vog.annotations.tsv.gz
vfam.members.tsv.gz (Member protein ids of groups): 4,576,398 bytes, MD5 checksum 3384a9d7fd69b3f376af3d24b6d4c252
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.members.tsv.gz
vfam.virusonly.tsv.gz (Specificity if groups to Viruses): 105,921 bytes, MD5 checksum 4eab639b90f4b6f4ec6244cf3d682242
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.virusonly.tsv.gz
vfam.lca.tsv.gz (Last common aencestors of groups): 504,485 bytes, MD5 checksum 086ba7ad4d8db86bd806e9262385eb46
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.lca.tsv.gz
vog.hmm.tar.gz (Hidden Markov Models of groups): 580,866,728 bytes, MD5 checksum 920ee2d0b35736da470a401192904d39
https://fileshare.csb.univie.ac.at/vog/vog237/vog.hmm.tar.gz
vfam.annotations.tsv.gz (Funcational annotations of groups): 297,258 bytes, MD5 checksum 8e181711da0b4f9700567aeec20da0ca
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.annotations.tsv.gz
vog.faa.tar.gz (Protein sequences of groups): 67,016,104 bytes, MD5 checksum 1ff76112fb7a769e4d84658876214b5a
https://fileshare.csb.univie.ac.at/vog/vog237/vog.faa.tar.gz
vogdb.host.txt (Host information and classification for genomes): 489,226 bytes, MD5 checksum 7a058e734a1a5c015349ee86fab98aba
https://fileshare.csb.univie.ac.at/vog/vog237/vogdb.host.txt
vfold.faa.tar.gz (Protein sequences of groups): 64,886,465 bytes, MD5 checksum cb6757f17e36ef41959a70372770b5e0
https://fileshare.csb.univie.ac.at/vog/vog237/vfold.faa.tar.gz
vfam.raw_algs.tar.gz (Multiple sequence alignments of groups): 63,905,008 bytes, MD5 checksum be2cf83ca8d1f3d15e4f7c1e05126154
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.raw_algs.tar.gz
vog.members.tsv.gz (Member protein ids of groups): 4,671,788 bytes, MD5 checksum a4375c97cce97b036d533353c9b69c36
https://fileshare.csb.univie.ac.at/vog/vog237/vog.members.tsv.gz
vfold.members.tsv.gz (Member protein ids of groups): 4,542,947 bytes, MD5 checksum e5b92dca10f18055621636a3298c7c2b
https://fileshare.csb.univie.ac.at/vog/vog237/vfold.members.tsv.gz
vfam.hmm.tar.gz (Hidden Markov Models of groups): 468,752,192 bytes, MD5 checksum 6de3c8ec2dfab6039988ecfe4e0057bc
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.hmm.tar.gz
vfold.annotations.tsv.gz (Funcational annotations of groups): 245,135 bytes, MD5 checksum 4201e456ff8130a0f272f643ba19854e
https://fileshare.csb.univie.ac.at/vog/vog237/vfold.annotations.tsv.gz
vfam.representatives.colabfold_predictions.tar.gz (Protein structure predictions): 7,926,277,974 bytes, MD5 checksum 0a73195dfbe7bd40afeaffca1006cea7
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.representatives.colabfold_predictions.tar.gz
vogdb.proteins.all.fa.gz (Protein sequences of all genomes): 107,562,466 bytes, MD5 checksum 2f9ba643daeaf9a86587c4ee32e0f2e5
https://fileshare.csb.univie.ac.at/vog/vog237/vogdb.proteins.all.fa.gz
vogdb.genes.all.fa.gz (Gene sequences of all genomes): 173,110,467 bytes, MD5 checksum b3491920d690b1520ddd0880cd07770c
https://fileshare.csb.univie.ac.at/vog/vog237/vogdb.genes.all.fa.gz
vfam.raw_algs.alistat.txt (Statistics of multiple alignments): 2,743,033 bytes, MD5 checksum 625fe80e7d89528fd0a94e615524c5a7
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.raw_algs.alistat.txt
vfam.representatives.colabfold_mean_plddt.txt (Mean pLDDT values of protein structure predictions): 640,416 bytes, MD5 checksum 563e8debfb9c53c6666528314e38b337
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.representatives.colabfold_mean_plddt.txt
vog.virusonly.tsv.gz (Specificity if groups to Viruses): 127,548 bytes, MD5 checksum 7d069a639eb0f58fa68842b280704db5
https://fileshare.csb.univie.ac.at/vog/vog237/vog.virusonly.tsv.gz
vog.raw_algs.tar.gz (Multiple sequence alignments of groups): 62,924,752 bytes, MD5 checksum f4cfddfd8d202df73c6f3f723fb483c7
https://fileshare.csb.univie.ac.at/vog/vog237/vog.raw_algs.tar.gz
vfold.lca.tsv.gz (Last common aencestors of groups): 417,895 bytes, MD5 checksum 80d8768ccbc291e381870854b33d3c76
https://fileshare.csb.univie.ac.at/vog/vog237/vfold.lca.tsv.gz
vogdb.functional_categories.txt (Lettercodes of functional categories): 308 bytes, MD5 checksum 6b816cc49c17d0095da91bad4e7552fa
https://fileshare.csb.univie.ac.at/vog/vog237/vogdb.functional_categories.txt
vfold.virusonly.tsv.gz (Specificity if groups to Viruses): 87,434 bytes, MD5 checksum 6fd326d322cd77707cfc2ca900904744
https://fileshare.csb.univie.ac.at/vog/vog237/vfold.virusonly.tsv.gz
vog.lca.tsv.gz (Last common aencestors of groups): 624,426 bytes, MD5 checksum 3399d27f4767387fe7420f83ebcd63af
https://fileshare.csb.univie.ac.at/vog/vog237/vog.lca.tsv.gz
vogdb.species.txt (Virus genomes used for VOG construction): 825,200 bytes, MD5 checksum 2bdd449c444453cd0079991bca63aa87
https://fileshare.csb.univie.ac.at/vog/vog237/vogdb.species.txt
vogdb.taxonomy.krona.html (Distribution of virus genome taxonomies): 7,060,611 bytes, MD5 checksum 08393e281c7448c95d520e178df68d0c
https://fileshare.csb.univie.ac.at/vog/vog237/vogdb.taxonomy.krona.html
vfam.faa.tar.gz (Protein sequences of groups): 66,163,776 bytes, MD5 checksum b38c18d42ce67694ba39d5bc405e8235
https://fileshare.csb.univie.ac.at/vog/vog237/vfam.faa.tar.gz