新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 搜索引擎, 信息分类与检索, 语义搜索, Lucene, Nutch, GRUB, Larbin, Weka
    [返回] 中文XML论坛 - 专业的XML技术讨论区计算机技术与应用『 Web挖掘技术 』 → web 挖掘工具一览,及详细介绍 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 70550 个阅读者浏览上一篇主题  刷新本主题   平板显示贴子 浏览下一篇主题
     * 贴子主题: web 挖掘工具一览,及详细介绍 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     pennyliang 帅哥哟,离线,有人找我吗?白羊座1979-4-7
      
      
      威望:8
      等级:大二期末(C++考了100分!)
      文章:266
      积分:1911
      门派:Lilybbs.net
      注册:2005/3/11

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给pennyliang发送一个短消息 把pennyliang加入好友 查看pennyliang的个人资料 搜索pennyliang在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看pennyliang的博客楼主
    发贴心情 web 挖掘工具一览,及详细介绍

    1)MALLET

    A Machine Learning for Language Toolkit
    http://mallet.cs.umass.edu/
    “an integrated collection of Java code useful for statistical natural language processing, document classification, clustering, information extraction, and other machine learning applications to text”
    Minimally documented but has lots of stuff:
    Building feature vectors
    Various classification methods (Naïve Bayes, max-ent, boosting, winnowing)
    Evaluation: precision, recall, F1, etc.
    N-grams
    Selecting features using information gain
    They have some examples of front-end code


       收藏   分享  
    顶(1)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/9/10 17:29:00
     
     GoogleAdSense白羊座1979-4-7
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 Web挖掘技术 』 的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2024/5/5 10:50:29

    本主题贴数29,分页: [1] [2] [3]

     *树形目录 (最近20个回帖) 顶端 
    主题:  web 挖掘工具一览,及详细介绍(575字) - pennyliang,2006年9月10日
        回复:  很不错,顶一下(14字) - graduter,2009年11月8日
        回复:  真的不错,看看好用不(326字) - amongchina,2009年10月15日
        回复:  看不懂的啦,555(15字) - 青鸟之梦,2009年6月3日
        回复:  ok(2字) - yjf19830610,2009年4月13日
        回复:  请问这些工具在哪儿可以下载呀?(30字) - serenabear,2009年3月13日
        回复:  请问这些工具在哪儿可以下载呀?(30字) - serenabear,2009年3月13日
        回复:  不错,介绍的比较及时(20字) - freedom2k,2008年12月3日
        回复:  weka就不翻了吧大家都很熟悉了(30字) - sesamfox,2008年10月28日
        回复:  1)MALLET一种基于Toolkit语言的机器学习工具。http://mallet.cs.um..(687字) - sesamfox,2008年10月28日
        回复:  赞一个!(8字) - dingshanhu,2008年6月30日
        回复:  lz真是好人啊,谢谢(18字) - maxiaoyan123,2008年6月17日
        回复:  为什么好东西都是英文的?!~~~~~~~(40字) - zhkf603,2008年5月15日
        回复:  很好,很强!~~~~(20字) - zhkf603,2008年5月10日
        回复:  Net percerptions,不是都说这个。(32字) - senjoso,2007年10月7日
        回复:  大师们多是用matlab编写改进算法做实验的(42字) - DMman,2007年9月29日
        回复:  Weka还稍微熟悉一点顶(22字) - JustWind,2007年9月29日
        回复:  天呀,要学的太多了(18字) - locoroco,2007年9月27日
        回复:  真实太好了!!(14字) - lovezhou_2006,2007年7月7日
        回复:  有免费的么?(12字) - ippocket,2007年6月9日

    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    8,820.313ms