全新HuggingFace数据集库发布!带来467种语言的611个文本数据集
新智元报道
新智元报道
来源:Huggingface
编辑:Q
【新智元导读】NLP初创公司 HuggingFace 近日发布新版其Datasets库 v1.2,包括611 个文本数据集,可以下载以准备在一行 python 中使用;涵盖 467 种语言,其中 99 种包含至少 10 个数据集;当使用非常大的数据集时(默认情况下是内存映射),高效的预处理可以使用户摆脱内存限制。




推荐阅读:

关注公众号:拾黑(shiheibook)了解更多
[广告]赞助链接:
四季很好,只要有你,文娱排行榜:https://www.yaopaiming.com/
让资讯触达的更精准有趣:https://www.0xu.cn/

随时掌握互联网精彩
赞助链接
排名
热点
搜索指数
- 1 总书记的两会“关心事” 7901657
- 2 中方回应菲前总统杜特尔特携女访港 7942811
- 3 苦等丈夫80多年 103岁的她去世 7800286
- 4 三大通道聚焦这些“大事小情” 7712762
- 5 国家版减肥指南来了 7642775
- 6 26岁小伙做泰山陪爬年入30多万 7533951
- 7 00后用DeepSeek1天卖出3.3亿 7488976
- 8 首批小米SU7 Ultra车标被抠 7350645
- 9 老人29块网购电三轮 快递巴掌大 7224961
- 10 乡村如何吸引并留住年轻人 7195536