怎么将分类数据集导入数据挖掘开源平台orange
Orange使用一种专有的数据结构,扩展名为.tab,其实就是用tab分隔每个数据的纯文本。文档的第一行为属性的名称,用tab分隔,第二行为属性对应的数据类型, 包含连续性,间断型和字符型。第三行包含一些元信息,用于指明依赖的特征(分类),不相关的特征(需要忽略的特征)和元特征。
import Orange
data = Orange.data.Table("iris")
通过以上的代码,就可以获得一个Orange的数据表,数据表是Orange中基本数据单元(类似DataFrame在Pandas中的地位)。iris是Orange自 带的样例数据,其扩展名即为.tab。
Orange也可以读取其他格式的数据文件,比如csv,txt等。...
18504