← Natora に戻る NATORA ナトラ

世界に公開された素材・データ・ツールを、分野を横断して探す。

公開リソースの案内

Common Crawl Corpus

2008年以降に定期収集されたウェブページの生データ、メタデータ抽出、テキスト抽出を含むコーパス。

提供元
Common Crawl Foundation
分野
言語 > コーパス
利用条件
未確認

公開されている資料でも、自由に再利用できるとは限りません。最新の利用条件は配布元でご確認ください。