UCI iris 数据集分类正确率问题
你应该能查到具体是哪个样本判断有误。如果是第35个或第38个的话,很可能是因为这个数据集本身的问题。UCI上的说法是:「This data differs from the data presented in Fishers article (identified by Steve Chadwick, spchadwick \u0026#39;@\u0026#39; http://espeedaz.net ). The 35th sample should be: 4.9,3.1,1.5,0.2,"Iris-setosa" where the error is in the fourth feature. The 38th sample: 4.9,3.6,1.4,0.1,"Iris-setosa" where the errors are in the second and third features.」。实际上只有一个样例被错判已经是相当不错的结果了,没有过多的必要纠结这一个错例,而是应该转而用其他数据集去验证算法的可行性与正确性。在50个数据集上都达到95%的准确率比在一个数据集上达到100%的准确率更有意义。另外,你用了150个样本进行训练,又用了这些样本去计算正确率,这么做通常是会有问题的,尤其是可能会产生过拟合的现象。建议拿60个样本训练,剩余90个样本测试,得到的正确率数字会更有意义。
■网友
【UCI iris 数据集分类正确率问题】 你好,请问准确度是怎么计算的。
推荐阅读
- “一部手机读云南”上线力争建成国家方志大数据中心西南中心
- 联合国大数据全球平台中国区域中心在杭州成立
- 银行的数据中心可以跳槽去互联网公司吗
- |大数据赋力 半个多月前拉客的“黑车”精准落网
- 数据采集终端|
- 关于用phpfsocket 写Post, 模拟http 报文怎样写入要传输的处理数据
- 特斯拉|Lucid Motors 位于亚利桑那电动车工厂完成一期建设
- 假如把中国电信监测到的3亿人一个月每天上网的所有行为打个包,哪些数据应该被提出从这些数据能得到啥
- 游戏公司一般咋识别游戏脚本
- 城市数据团是怎么样一个团队
