全新HuggingFace数据集库发布!带来467种语言的611个文本数据集
新智元报道
新智元报道
来源:Huggingface
编辑:Q
【新智元导读】NLP初创公司 HuggingFace 近日发布新版其Datasets库 v1.2,包括611 个文本数据集,可以下载以准备在一行 python 中使用;涵盖 467 种语言,其中 99 种包含至少 10 个数据集;当使用非常大的数据集时(默认情况下是内存映射),高效的预处理可以使用户摆脱内存限制。




推荐阅读:

关注公众号:拾黑(shiheibook)了解更多
[广告]赞助链接:
四季很好,只要有你,文娱排行榜:https://www.yaopaiming.com/
让资讯触达的更精准有趣:https://www.0xu.cn/

随时掌握互联网精彩
赞助链接
排名
热点
搜索指数
- 1 习近平和青年朋友的10个暖心瞬间 7904643
- 2 贵州游船倾覆事故已造成3人死亡 7808319
- 3 外交部国防部罕见接连发声 7713685
- 4 这个五一的文旅体验不要太丰富 7619441
- 5 300亿饮料巨头进军半导体 7523217
- 6 乙游逐渐成年轻人的恋爱代餐 7427048
- 7 女子在沙滩玩20分钟捡了小半兜钉子 7331997
- 8 景区飞天魔毯失控 多名游客被甩出 7236869
- 9 网红猫爷掀起猫步模仿潮 7138294
- 10 三个“爆品” 藏着中国外贸秘籍 7041468