新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 搜索引擎, 信息分类与检索, 语义搜索, Lucene, Nutch, GRUB, Larbin, Weka
    [返回] 中文XML论坛 - 专业的XML技术讨论区计算机技术与应用『 Web挖掘技术 』 → [求助]关于Weka的文本挖掘问题,求各位大仙帮忙~ 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 18261 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: [求助]关于Weka的文本挖掘问题,求各位大仙帮忙~ 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     Jennyeleven 美女呀,离线,快来找我吧!
      
      
      等级:大一新生
      文章:1
      积分:52
      门派:XML.ORG.CN
      注册:2011/1/15

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给Jennyeleven发送一个短消息 把Jennyeleven加入好友 查看Jennyeleven的个人资料 搜索Jennyeleven在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看Jennyeleven的博客楼主
    发贴心情 [求助]关于Weka的文本挖掘问题,求各位大仙帮忙~

    最近在写一篇论文,是关于文本挖掘的,中间遇到了一个问题,我是属于菜鸟级的,不知道如何解决,希望大家能帮帮忙?
    我是要对网上的评论进行挖掘,以句为单位,分好词后,把每句话中的名词抽取出来,然后想用关联规则算法对其进行挖掘

    举个例子,比如我要对手机的评论进行挖掘,分词后得到下面的形式的信息:
      
    第一句:手机 智能型 手机 智能型 办公 游戏 软件
    第二句:屏幕 新闻 方便 手指 地方 键
    第三句:照相 性能  手机 录像 照相 定位
    第四句:强光 屏幕 通讯录 塑料感 桌面 快捷键
    第五句:手机 阳光 桌面 快捷键
    第六句:屏幕 性价比 电池 音效
    第七句:屏幕 画面 外形 后盖 女生 手机
      
    其中每行是一个句子里面抽取出的关键词,但是这里我不知道应该把这些关键词存成什么样的格式,因为每个句子最后抽取出来的关键词数目会不一样,没办法存成二维表的形式,大家能给我点提示吗?这样的信息应该怎么用weka来挖呢?具体怎么操作呢?不知道我表述清楚没有……万分感谢!


       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2011/1/15 19:21:00
     
     xhp3057 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:3
      积分:64
      门派:XML.ORG.CN
      注册:2011/12/31

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给xhp3057发送一个短消息 把xhp3057加入好友 查看xhp3057的个人资料 搜索xhp3057在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看xhp3057的博客2
    发贴心情 
    期待有人解答
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2011/12/31 11:19:00
     
     boyboyvox 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:1
      积分:54
      门派:XML.ORG.CN
      注册:2013/1/29

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给boyboyvox发送一个短消息 把boyboyvox加入好友 查看boyboyvox的个人资料 搜索boyboyvox在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看boyboyvox的博客3
    发贴心情 
    同问?
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2013/1/29 14:30:00
     
     hyh5800 美女呀,离线,快来找我吧!
      
      
      等级:大一新生
      文章:11
      积分:95
      门派:XML.ORG.CN
      注册:2012/5/7

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给hyh5800发送一个短消息 把hyh5800加入好友 查看hyh5800的个人资料 搜索hyh5800在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看hyh5800的博客4
    发贴心情 
    我也期待答案!
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2013/6/8 9:36:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 Web挖掘技术 』 的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2024/4/19 23:13:37

    本主题贴数4,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    78.125ms