文本分类数据集共13个20ngmrR8R52ohsumedwikiagnews等 文本分类数据集(共13个20ng,mr,R8,R52,ohsumed,wiki,agnews等) 数据量很多,适合进行深度学习实验
最全的中文停用词表20K 在信息检索中,为节省存储空间和提高搜索效率,在处理自然语言数据(或文本)之前或之后会自动过滤掉某些字或词,这些字或词即被称为StopWords(停用词)。这些停用词都是人工输入、非自动化生成的,生成后的停用词会形成一个停用词表。但是,并没有一个明确的停用词表能够适用于所有的工具。甚至有一些工具是明确
U型件冲压回弹的Abaqus仿真数据集 在U型件冲压工艺中, 回弹现象不可避免。如何根据工艺参数预测回弹值大小,是一个重要问题。 在这里我选取了4个工艺参数(板料厚度,摩擦系数,凹模圆角半径,压边力),通过Abaqus获取了2688个仿真实验样本,得到了该四个因素对回弹的影响。得到该数据集合。 有兴趣的可以用来做机器学习中的回归预测的练习