Common Crawl
Fondation sans but lucratif éponyme d'un moissonnage périodique et ouvert du web
Common Crawl est une organisation à but non lucratif 501(c)(3) qui explore le Web et fournit gratuitement ses archives et ses ensembles de données au public. Les archives web de Common Crawl se composent de pétaoctets de données collectées depuis 2008. Il effectue des crawls environ une fois par mois.
Nº Q12055316 ★★
Peu commune · Organisations
Common Crawl
Fondation sans but lucratif éponyme d'un moissonnage périodique et ouvert du web
Common Crawl est une organisation à but non lucratif 501(c)(3) qui explore le Web et fournit gratuitement ses archives et ses ensembles de données au public. Les archives web de Common Crawl se composent de pétaoctets de données collectées depuis 2008. Il effectue des crawls environ une fois par mois.
Dernier prix
—
Prix plancher
—
Médiane 7 j
—
Ventes 30 j
0
Fourchette 30 j
—
En circulation
0
Cours
médiane
min – max
ventes
Aucune vente sur la période
Voir le tableau
| Date | médiane | Min | Max | ventes |
|---|
Historique des ventes
- Dernière vente
- —
- Moyenne 30 j
- —
- Plus bas 30 j
- —
- Plus haut 30 j
- —
- Ventes 7 j
- 0
- Ventes 30 j
- 0
Aucune vente pour l'instant.
Ventes anonymes : ni acheteur ni vendeur. Les chiffres ne comptent que les ventes entre joueurs.
Sur Wikipédia
Common Crawl est une organisation à but non lucratif 501(c)(3) qui explore le Web et fournit gratuitement ses archives et ses ensembles de données au public. Les archives web de Common Crawl se composent de pétaoctets de données collectées depuis 2008. Il effectue des crawls environ une fois par mois. Common Crawl a été fondé par Gil Elbaz. Peter Norvig et Joi Ito comptent parmi les conseillers de l'organisation à but non lucratif. Les robots d'exploration de l'organisation respectent les politiques nofollow et robots.txt. Le code open source pour le traitement de l'ensemble de données de Common Crawl est accessible au public. L'ensemble de données Common Crawl comprend des travaux protégés par le droit d'auteur et est distribué depuis les États-Unis dans le cadre de revendications d'utilisation équitable. Les chercheurs d'autres pays ont eu recours à des techniques telles que le mélange de phrases ou le référencement de l'ensemble de données Common Crawl pour contourner la législation sur le droit d'auteur dans d'autres juridictions. L'anglais est la langue principale de 46 % des documents de la version de mars 2023 de l'ensemble de données Common Crawl. Les autres langues les plus courantes sont l'allemand, le russe, le japonais, le français, l'espagnol et le chinois, chacune représentant moins de 6 % des documents.
Texte : Wikipédia, CC BY-SA 4.0. ·
Cartes voisines
OpenClaw
Logiciel d'assistant personnel autonome d'intelligence artificielle (IA) open source
Nº Q137916205 ★★★★
ORCID
Code alphanumérique non propriétaire, qui permet d'identifier de manière unique les chercheurs et auteurs de contributions académiques et scientifiques
Nº Q51044 ★★
Cloud Native Computing Foundation
Projet de la Linux Fondation
Nº Q50866964 ★
You.com
Moteur de recherche privé
Nº Q111598768 ★★
Signal Foundation
Association à but non-lucratif
Nº Q55074807 ★★★
Organization for the Advancement of Structured Information Standards
Consortium œuvrant à la mise en place de standards informatiques
Nº Q1455952 ★