新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     >>计算机科学论坛<<     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 搜索引擎, 信息分类与检索, 语义搜索, Lucene, Nutch, GRUB, Larbin, Weka
    [返回] 计算机科学论坛计算机技术与应用『 Web挖掘技术 』 → [求助]关于weka的回归树的输出(考试,急) 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 15723 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: [求助]关于weka的回归树的输出(考试,急) 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     allegory 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:2
      积分:61
      门派:XML.ORG.CN
      注册:2007/7/29

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给allegory发送一个短消息 把allegory加入好友 查看allegory的个人资料 搜索allegory在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看allegory的博客楼主
    发贴心情 [求助]关于weka的回归树的输出(考试,急)

    下面是个weka回归树的输出,每个最终节点后有个百分比,LM1 (75/3.056%)谁知道是什么吗?我考试要用,谢谢了
    MMAX <= 14000 :
    |   CACH <= 8.5 :
    |   |   MMAX <= 6100 : LM1 (75/3.056%)
    |   |   MMAX >  6100 :
    |   |   |   MYCT <= 83.5 :
    |   |   |   |   MMAX <= 10000 : LM2 (8/2.545%)
    |   |   |   |   MMAX >  10000 : LM3 (3/2.137%)
    |   |   |   MYCT >  83.5 : LM4 (22/3.81%)
    |   CACH >  8.5 :
    |   |   CHMIN <= 7 :
    |   |   |   MYCT <= 95 : LM5 (7/7.521%)
    |   |   |   MYCT >  95 : LM6 (18/5.501%)
    |   |   CHMIN >  7 : LM7 (8/25.484%)
    MMAX >  14000 :
    |   MMAX <= 22485 :
    |   |   CACH <= 27 :
    |   |   |   CHMIN <= 5 : LM8 (14/3.914%)
    |   |   |   CHMIN >  5 : LM9 (5/7.243%)
    |   |   CACH >  27 : LM10 (18/14.185%)
    |   MMAX >  22485 :
    |   |   CHMIN <= 10 :
    |   |   |   MYCT <= 44 : LM11 (11/25.643%)
    |   |   |   MYCT >  44 : LM12 (5/7.62%)
    |   |   CHMIN >  10 :
    |   |   |   MMAX <= 48000 : LM13 (11/69.192%)
    |   |   |   MMAX >  48000 : LM14 (4/113.733%)

       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/11/3 20:00:00
     
     DMman 帅哥哟,离线,有人找我吗?魔羯座1984-1-11
      
      
      威望:1
      头衔:数据挖掘青年
      等级:研二(Pi-Calculus看得一头雾水)(版主)
      文章:803
      积分:5806
      门派:W3CHINA.ORG
      注册:2007/4/9

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给DMman发送一个短消息 把DMman加入好友 查看DMman的个人资料 搜索DMman在『 Web挖掘技术 』 的所有贴子 点击这里发送电邮给DMman 访问DMman的主页 引用回复这个贴子 回复这个贴子 查看DMman的博客2
    发贴心情 
    决策树可以认为分为分类树和模型树。回归树是模型树的一种特例,在叶节点存储了能预测达到叶节点的实例类值的一个线性回归模型。您使用的是cpu.arff 共209条数据。建立的回归树共有14个叶子,代表建立了14个线性模型(LM = liner model)。
    如 LM1 (75/3.056%)代表 线性模型1 共有75个实例,错误率为3.056%

    ----------------------------------------------
    数据挖掘青年 http://blogger.org.cn/blog/blog.asp?name=DMman
    纪录片之家 (很多纪录片下载)http://www.jlpzj.com/?fromuid=137653

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/11/4 12:19:00
     
     allegory 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:2
      积分:61
      门派:XML.ORG.CN
      注册:2007/7/29

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给allegory发送一个短消息 把allegory加入好友 查看allegory的个人资料 搜索allegory在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看allegory的博客3
    发贴心情 
    不是呀,比如有超过100%的是什么呢?还有,回归树是用这个叶子的全部点的平均值作为值,那么,怎么算是错误呢?
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/11/4 15:47:00
     
     DMman 帅哥哟,离线,有人找我吗?魔羯座1984-1-11
      
      
      威望:1
      头衔:数据挖掘青年
      等级:研二(Pi-Calculus看得一头雾水)(版主)
      文章:803
      积分:5806
      门派:W3CHINA.ORG
      注册:2007/4/9

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给DMman发送一个短消息 把DMman加入好友 查看DMman的个人资料 搜索DMman在『 Web挖掘技术 』 的所有贴子 点击这里发送电邮给DMman 访问DMman的主页 引用回复这个贴子 回复这个贴子 查看DMman的博客4
    发贴心情 
    提成"错误率"确实不恰当,称为 误差 或者 方差 可能还恰当点。回归树本质就是决策树,叶子上的若干点可以建立一个线性模型,模型用来分类,肯定是要有误差的。
    对线性模型的一套理论我也不是很明了了。关于线性模型的误差的理论,应该有定义的计算公式的。就比如在2维空间有N个点,然后求一条直线的方程来拟合这N个点,每个点与直线的距离就可以认为是误差,如何衡量整体误差是有公式的。
    您可以下载“数据挖掘:实用机器学习技术”好像在第6章有些详细的说明

    ----------------------------------------------
    数据挖掘青年 http://blogger.org.cn/blog/blog.asp?name=DMman
    纪录片之家 (很多纪录片下载)http://www.jlpzj.com/?fromuid=137653

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/11/4 16:42:00
     
     allegory 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:2
      积分:61
      门派:XML.ORG.CN
      注册:2007/7/29

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给allegory发送一个短消息 把allegory加入好友 查看allegory的个人资料 搜索allegory在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看allegory的博客5
    发贴心情 
    我已经看过了,真的没有,而且,误差怎么超过的100%呢?+我msn吧,pku_allegory@hotmail.com
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/11/4 17:20:00
     
     DMman 帅哥哟,离线,有人找我吗?魔羯座1984-1-11
      
      
      威望:1
      头衔:数据挖掘青年
      等级:研二(Pi-Calculus看得一头雾水)(版主)
      文章:803
      积分:5806
      门派:W3CHINA.ORG
      注册:2007/4/9

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给DMman发送一个短消息 把DMman加入好友 查看DMman的个人资料 搜索DMman在『 Web挖掘技术 』 的所有贴子 点击这里发送电邮给DMman 访问DMman的主页 引用回复这个贴子 回复这个贴子 查看DMman的博客6
    发贴心情 
    误差函数的计算公式就在英文版 248 页。它的值域并非限定在0-1之间

    ----------------------------------------------
    数据挖掘青年 http://blogger.org.cn/blog/blog.asp?name=DMman
    纪录片之家 (很多纪录片下载)http://www.jlpzj.com/?fromuid=137653

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/11/4 17:48:00
     
     GoogleAdSense魔羯座1984-1-11
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 Web挖掘技术 』 的所有贴子 点击这里发送电邮给Google AdSense 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2024/5/2 21:10:49

    本主题贴数6,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    78.125ms