新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 搜索引擎, 信息分类与检索, 语义搜索, Lucene, Nutch, GRUB, Larbin, Weka
    [返回] 中文XML论坛 - 专业的XML技术讨论区计算机技术与应用『 Web挖掘技术 』 → LJFeatureDet特征词发现技术中间件下载 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 5062 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: LJFeatureDet特征词发现技术中间件下载 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     lingjoin 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:13
      积分:87
      门派:XML.ORG.CN
      注册:2010/3/5

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给lingjoin发送一个短消息 把lingjoin加入好友 查看lingjoin的个人资料 搜索lingjoin在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看lingjoin的博客楼主
    发贴心情 LJFeatureDet特征词发现技术中间件下载

    特征词发现技术能够识别出词典中没有出现过的词汇、短语、命名实体、流行用语,是语言文献分析方面的一把利器。特征词发现脱胎于语言自动分词技术,又是对分词技术的有效提升和补充。

        LJFeatureDet采用基于语义的统计语言模型,所处理的文档不受行业领域限制,能够有效地挖掘出新出现的特征词汇,所输出的词汇可以配以权重。

        LJFeatureDet特征词发现组件的主要特色在于:

        1、速度快:可以处理海量规模的网络文本数据,平均每小时处理至少60万篇文档;
        2、处理精准:Top N的分析结果往往能反映出当时的时事流行语和热点实体,适合于舆情热点计算;与国际上著名厂商的技术相比,灵玖的各项指标远远领先,或许是灵玖更懂中文吧;
        3、精准排序:特征词汇按照影响权重排序,可以输出权重值;
        5、开放式接口:灵玖特征词发现组件作为LJParser的一部分,采用灵活的开发接口,可以方便地融入到用户的业务系统中,可以支持各种操作系统,各类调用语言。

        LJFeatureDet可以应用于文本挖掘、知识管理、词典编辑、舆情监测等多种应用中。 下载地址:

    http://www.lingjoin.com:8080/bbs/viewthread.php?tid=48&extra=page%3D1


       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2010/3/5 13:13:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 Web挖掘技术 』 的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2024/4/27 12:09:04

    本主题贴数1,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    265.625ms