文本挖掘中若干关键问题研究
温馨提示:5折以下图书主要为出版社尾货,大部分为全新(有塑封/无塑封),个别图书品相8-9成新、切口有划线标记、光盘等附件不全详细品相说明>>
- ISBN:9787312022807
- 装帧:暂无
- 册数:暂无
- 重量:暂无
- 开本:16开
- 页数:117
- 出版时间:2008-12-01
- 条形码:9787312022807 ; 978-7-312-02280-7
本书特色
自动文本分类是将自然文本文件根据内容自动分为预先定义的一个或几个类别的过程,基于统计学习、机器学习的文本分类技术已经成为主流技术,本书对基于统计学习的文本分类及其相关技术进行了研究,为解决文本分类的稀疏性和高维性问题,基于偏*小二乘理论,提出一种新的维数约简算法,从提高文本分类性能和准确性出发,运用偏*小二乘的*新理论成果,提出了一种能较好提取潜在语义的新文本分类模型,对于数量庞大的文档类别,传统的平坦文本分类的性能受到很大的制约,层次文本分类是一种有效的解决方法,由此提出了一种新的层次文本分类模型。
内容简介
本书介绍了文本分类和偏*小二乘回归,提出了基于变量投影重要性指标的文本分类特征选择方法,论述了偏*小二乘logistic文本分类模型,阐述了chtc层次文本分类模型的研究工作,本书可供相关领域科研工作者、大学高年级学生和研究生阅读。
目录
第1章 导论
1.1 研究背景
1.2 文本分类综述
1.3 本书的内容结构
1.4 本书的创新工作
第2章 文本分类概述
2.1 文本分类的数学定义
2.2 文本分类任务的特点
2.3 文本分类系统的组成
2.4 文档预处理
2.5 文档的表示
2.6 常用文本分类模型
2.7 文本分类器学习、测试和评价
第3章 偏*小二乘回归方法的基本理论
3.1 偏*小二乘回归的发展历史
3.2 偏*小二乘回归的基本原理
3.3 偏*小二乘回归的基本思想
3.4 数学原理
3.5 偏*小二乘回归的理论算法
3.6 成分数的确定
第4章 基于变量投影重要性指标的特征选择方法研究
4.1 维数约简技术
4.2 符号约定
4.3 常用的特征选择方法
4.4 常用的特征抽取方法
4.5 基于变量投影重要性指标的特征选择方法
4.6 实验结果和分析
第5章 偏*小二乘logistic文本分类模型研究
5.1 logistic回归模型
5.2 偏*小二乘logistic回归模型
5.3 偏*小二乘logistic文本分类模型
5.4 实验结果和分析
第6章 ghtc层次文本分类模型研究
6.1 层次分类概述
6.2 层次特征选择
6.3 ghtc层次文本分类模型
6.4 实验结果和分析
第7章 总结与展望
7.1 总结
7.2 研究展望
附录1 reuters-21578前10个常见类和前10个稀有类的前20个特征vip值
附录2 复旦文本分类语料库部分类别的前20个特征vip值
附录3 ohsumed语料库层次结构
附录4 20 newsgroups语料库各节点各特征维数的微平均f1值和宏平均f1值变化情况
参考文献
后记
节选
《文本挖掘中若干关键问题研究》介绍了文本分类和偏*小二乘回归,提出了基于变量投影重要性指标的文本分类特征选择方法,论述了偏*小二乘Logistic文本分类模型,阐述了CHTC层次文本分类模型的研究工作,《文本挖掘中若干关键问题研究》可供相关领域科研工作者、大学高年级学生和研究生阅读。
-
深度学习的数学
¥43.5¥69.0 -
全图解零基础word excel ppt 应用教程
¥12.0¥48.0 -
机器学习
¥59.4¥108.0 -
有限与无限的游戏:一个哲学家眼中的竞技世界
¥37.4¥68.0 -
智能硬件项目教程:基于ARDUINO(第2版)
¥31.9¥65.0 -
硅谷之火-人与计算机的未来
¥14.3¥39.8 -
元启发式算法与背包问题研究
¥38.2¥49.0 -
AI虚拟数字人:商业模式+形象创建+视频直播+案例应用
¥62.9¥89.8 -
UNIX环境高级编程(第3版)
¥164.9¥229.0 -
剪映AI
¥52.8¥88.0 -
深度学习高手笔记 卷2:经典应用
¥90.9¥129.8 -
纹样之美:中国传统经典纹样速查手册
¥76.3¥109.0 -
UG NX 12.0数控编程
¥22.1¥45.0 -
MATLAB计算机视觉与深度学习实战(第2版)
¥90.9¥128.0 -
界面交互设计理论研究
¥30.8¥56.0 -
微机组装与系统维护技术教程(第二版)
¥37.8¥43.0 -
明解C语言:实践篇
¥62.9¥89.8 -
Linux服务器架设实战(Linux典藏大系)
¥83.3¥119.0 -
Visual Basic 语言程序设计基础(第6版)
¥32.0¥45.0 -
贝叶斯推理与机器学习
¥139.3¥199.0