新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 搜索引擎, 信息分类与检索, 语义搜索, Lucene, Nutch, GRUB, Larbin, Weka
    [返回] 中文XML论坛 - 专业的XML技术讨论区计算机技术与应用『 Web挖掘技术 』 → Web 文本挖掘技术研究 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 43271 个阅读者浏览上一篇主题  刷新本主题   平板显示贴子 浏览下一篇主题
     * 贴子主题: Web 文本挖掘技术研究 举报  打印  推荐  IE收藏夹 
       本主题类别: 信息检索    
     wuchenlu 帅哥哟,离线,有人找我吗?
      
      
      等级:大一(高数修炼中)
      文章:5
      积分:104
      门派:XML.ORG.CN
      注册:2006/5/30

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给wuchenlu发送一个短消息 把wuchenlu加入好友 查看wuchenlu的个人资料 搜索wuchenlu在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看wuchenlu的博客楼主
    发贴心情 Web 文本挖掘技术研究


    摘 要 作为从浩瀚的W eb 信息资源中发现潜在的、有价值知识的一种有效技术,W eb 挖掘正悄然兴起, 倍受关注. 目前,W eb 挖掘的研究正处于发展阶段, 尚无统一的结论, 需要国内外学者在理论上开展更多的讨论. 同时,W eb 挖掘系统的开发对其研究也将起到很大推进作用. 首先探讨了W eb 挖掘的有关理论, 从W eb 挖掘的定义、W eb 挖掘与W eb 信息检索的关系、W eb 挖掘任务的分类与功能等方面加以阐述. 然后重点分析了W eb 文本挖掘的方法, 包括: 文本的特征表示、文本分类与文本聚类. 在此基础上简单介绍了一个W eb 文本挖掘系统原型WebMiner. W ebM iner 采用了多agent 体系结构, 将多维文本分析与文本挖掘这两种技术有机地结合起来, 以帮助用户快速、有效地挖掘W eb 上的HTML 文档.
    关键词 W eb 挖掘, 文本挖掘, 文本分类, 文本聚类, 多维文本分析



       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/6/5 10:28:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 Web挖掘技术 』 的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2024/5/8 6:29:59

    本主题贴数12,分页: [1] [2]

     *树形目录 (最近20个回帖) 顶端 
    主题:  Web 文本挖掘技术研究(746字) - wuchenlu,2006年6月5日
        回复:  不错,抱走了!谢谢!(20字) - lixuezhu18,2008年5月15日
        回复:  学习中…………(14字) - faithg,2008年1月15日
        回复:  A Brief Survey of Web Data Extraction Tools.pdfh..(312字) - BlueSky_DM,2007年8月31日
        回复:  呵呵,这个网站上介绍的文章比较多,不错的。关于Web信息提取的综述的文章,比较旧了:..(83字) - BlueSky_DM,2007年8月31日
        回复:  学习ing。。。(13字) - chairmanwei,2007年8月19日
        回复:  我有一个问题想请教大家:我现在想选一个方向写论文,但是我的计算机基础很差(因为我是半路出家的),你..(147字) - 侬侬,2007年8月6日
            回复:  [quote][b]以下是引用[i]侬侬在2007-8-6 11:17:00[/i]的发言:[/b..(274字) - DMman,2007年8月6日
        回复:  赫赫,多谢楼主,不用筛选了(26字) - suiyun0234,2006年11月29日
        回复:  知识普及了(10字) - eviltear,2006年10月10日
        回复:  太早了,还是非常感谢(20字) - liangchenshell,2006年7月27日
        回复:  2000年的有点早了(16字) - wuchenlu,2006年6月5日

    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    105.469ms