C

Common Crawl

Fondation sans but lucratif éponyme d'un moissonnage périodique et ouvert du web

Common Crawl est une organisation à but non lucratif 501(c)(3) qui explore le Web et fournit gratuitement ses archives et ses ensembles de données au public. Les archives web de Common Crawl se composent de pétaoctets de données collectées depuis 2008. Il effectue des crawls environ une fois par mois.

Nº Q12055316 ★★

Peu commune · Organisations

Common Crawl

Fondation sans but lucratif éponyme d'un moissonnage périodique et ouvert du web

Common Crawl est une organisation à but non lucratif 501(c)(3) qui explore le Web et fournit gratuitement ses archives et ses ensembles de données au public. Les archives web de Common Crawl se composent de pétaoctets de données collectées depuis 2008. Il effectue des crawls environ une fois par mois.

Dernier prix

—

Prix plancher

—

Médiane 7 j

—

Ventes 30 j

0

Fourchette 30 j

—

En circulation

0

Cours

Voir le tableau
Datemédiane MinMaxventes

Historique des ventes

Dernière vente
—
Moyenne 30 j
—
Plus bas 30 j
—
Plus haut 30 j
—
Ventes 7 j
0
Ventes 30 j
0

Aucune vente pour l'instant.

Ventes anonymes : ni acheteur ni vendeur. Les chiffres ne comptent que les ventes entre joueurs.

Sur Wikipédia

Common Crawl est une organisation à but non lucratif 501(c)(3) qui explore le Web et fournit gratuitement ses archives et ses ensembles de données au public. Les archives web de Common Crawl se composent de pétaoctets de données collectées depuis 2008. Il effectue des crawls environ une fois par mois. Common Crawl a été fondé par Gil Elbaz. Peter Norvig et Joi Ito comptent parmi les conseillers de l'organisation à but non lucratif. Les robots d'exploration de l'organisation respectent les politiques nofollow et robots.txt. Le code open source pour le traitement de l'ensemble de données de Common Crawl est accessible au public. L'ensemble de données Common Crawl comprend des travaux protégés par le droit d'auteur et est distribué depuis les États-Unis dans le cadre de revendications d'utilisation équitable. Les chercheurs d'autres pays ont eu recours à des techniques telles que le mélange de phrases ou le référencement de l'ensemble de données Common Crawl pour contourner la législation sur le droit d'auteur dans d'autres juridictions. L'anglais est la langue principale de 46 % des documents de la version de mars 2023 de l'ensemble de données Common Crawl. Les autres langues les plus courantes sont l'allemand, le russe, le japonais, le français, l'espagnol et le chinois, chacune représentant moins de 6 % des documents.

Texte : Wikipédia, CC BY-SA 4.0. ·

Cartes voisines

Voir la fiche

Confirmation