新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     >>计算机科学论坛<<     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 搜索引擎, 信息分类与检索, 语义搜索, Lucene, Nutch, GRUB, Larbin, Weka
    [返回] 计算机科学论坛计算机技术与应用『 Web挖掘技术 』 → 将信息源中的数据从HTML转换成XML中的问题 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 11135 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: 将信息源中的数据从HTML转换成XML中的问题 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     fangel2000 帅哥哟,离线,有人找我吗?
      
      
      头衔:w3china第一水王
      等级:大四寒假(收到Microsoft的Offer啦)
      文章:283
      积分:1503
      门派:W3CHINA.ORG
      注册:2006/5/30

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给fangel2000发送一个短消息 把fangel2000加入好友 查看fangel2000的个人资料 搜索fangel2000在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看fangel2000的博客楼主
    发贴心情 将信息源中的数据从HTML转换成XML中的问题

    大家好,今天看了基于 Web 的数据挖掘,知道 Tidy 来 生成 XHTML(XML 的子集)格式的这些文档

    但是在转换过程中,我遇到了一个问题,“我们将通过构造名为 XMLHelper (由 static helper 函数 组成)的 Java 类来完成这一任务以及其它与 XML 相关任务。这个类的全部信息源可以 通过以下到 XMLHelper.java 和 XMLHelperException.java 的 链接找到。”

    我导入了JTidy的Jar包,但是当我运行XMLHelper.java 时出错了,错误的代码为:(在tidyHTML这个方法中)

    org.w3c.tidy.TagTable tags = org.w3c.tidy.TagTable.getDefaultTagTable();  
    //我找了一下发现TagTable下根本就没getDefaultTagTable这个方法
    tags.defineBlockTag("script");

    怎么办啊,目前的研究就这么停滞不前了,大家一定要帮帮我啊

    其中两个java文件的网址为:
    http://www-128.ibm.com/developerworks/cn/xml/x-wbdm/XMLHelper.java
    http://www-128.ibm.com/developerworks/cn/xml/x-wbdm/XMLHelperException.java


       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/12/20 16:28:00
     
     menghuan1979 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:3
      积分:70
      门派:XML.ORG.CN
      注册:2007/1/23

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给menghuan1979发送一个短消息 把menghuan1979加入好友 查看menghuan1979的个人资料 搜索menghuan1979在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看menghuan1979的博客2
    发贴心情 [灌水]
    我也是你这个问题,大家一起讨论下。我的QQ:3384318
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/3/19 15:37:00
     
     fangel2000 帅哥哟,离线,有人找我吗?
      
      
      头衔:w3china第一水王
      等级:大四寒假(收到Microsoft的Offer啦)
      文章:283
      积分:1503
      门派:W3CHINA.ORG
      注册:2006/5/30

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给fangel2000发送一个短消息 把fangel2000加入好友 查看fangel2000的个人资料 搜索fangel2000在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看fangel2000的博客3
    发贴心情 
    大家有知道的能帮忙一下么?很急
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/4/10 20:54:00
     
     fangel2000 帅哥哟,离线,有人找我吗?
      
      
      头衔:w3china第一水王
      等级:大四寒假(收到Microsoft的Offer啦)
      文章:283
      积分:1503
      门派:W3CHINA.ORG
      注册:2006/5/30

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给fangel2000发送一个短消息 把fangel2000加入好友 查看fangel2000的个人资料 搜索fangel2000在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看fangel2000的博客4
    发贴心情 
    这个问题还没有得到解决,望知道的朋友或者曾经做过这个例子的朋友告诉我一声。
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/5/28 20:14:00
     
     DMman 帅哥哟,离线,有人找我吗?魔羯座1984-1-11
      
      
      威望:1
      头衔:数据挖掘青年
      等级:研二(Pi-Calculus看得一头雾水)(版主)
      文章:803
      积分:5806
      门派:W3CHINA.ORG
      注册:2007/4/9

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给DMman发送一个短消息 把DMman加入好友 查看DMman的个人资料 搜索DMman在『 Web挖掘技术 』 的所有贴子 点击这里发送电邮给DMman 访问DMman的主页 引用回复这个贴子 回复这个贴子 查看DMman的博客5
    发贴心情 
    楼主的问题,在下不懂,我把它留言到一位java高手(邢红瑞先生)的博客上了,不知他是否遇到过,请关注:
    http://blogger.org.cn/blog/message.asp?name=hongrui

    ----------------------------------------------
    数据挖掘青年 http://blogger.org.cn/blog/blog.asp?name=DMman
    纪录片之家 (很多纪录片下载)http://www.jlpzj.com/?fromuid=137653

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/5/31 13:54:00
     
     fangel2000 帅哥哟,离线,有人找我吗?
      
      
      头衔:w3china第一水王
      等级:大四寒假(收到Microsoft的Offer啦)
      文章:283
      积分:1503
      门派:W3CHINA.ORG
      注册:2006/5/30

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给fangel2000发送一个短消息 把fangel2000加入好友 查看fangel2000的个人资料 搜索fangel2000在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看fangel2000的博客6
    发贴心情 
    呵呵,感谢DMman
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/6/6 20:02:00
     
     DMman 帅哥哟,离线,有人找我吗?魔羯座1984-1-11
      
      
      威望:1
      头衔:数据挖掘青年
      等级:研二(Pi-Calculus看得一头雾水)(版主)
      文章:803
      积分:5806
      门派:W3CHINA.ORG
      注册:2007/4/9

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给DMman发送一个短消息 把DMman加入好友 查看DMman的个人资料 搜索DMman在『 Web挖掘技术 』 的所有贴子 点击这里发送电邮给DMman 访问DMman的主页 引用回复这个贴子 回复这个贴子 查看DMman的博客7
    发贴心情 
    以下是引用fangel2000在2007-6-6 20:02:00的发言:
    呵呵,感谢DMman

    不客气 小弟无能 不能为楼主分忧 只能借花献佛
    但好像邢老师不大回复 他只些博客很少回复网友的留言...希望楼主早日解决问题!

    ----------------------------------------------
    数据挖掘青年 http://blogger.org.cn/blog/blog.asp?name=DMman
    纪录片之家 (很多纪录片下载)http://www.jlpzj.com/?fromuid=137653

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/6/7 17:10:00
     
     GoogleAdSense魔羯座1984-1-11
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 Web挖掘技术 』 的所有贴子 点击这里发送电邮给Google AdSense 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2026/3/12 8:30:45

    本主题贴数7,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    76.172ms