
包邮文本挖掘中若干关键问题研究

- ISBN:9787312022807
- 装帧:暂无
- 册数:暂无
- 重量:暂无
- 开本:16开
- 页数:117
- 出版时间:2008-12-01
- 条形码:9787312022807 ; 978-7-312-02280-7
本书特色
自动文本分类是将自然文本文件根据内容自动分为预先定义的一个或几个类别的过程,基于统计学习、机器学习的文本分类技术已经成为主流技术,本书对基于统计学习的文本分类及其相关技术进行了研究,为解决文本分类的稀疏性和高维性问题,基于偏*小二乘理论,提出一种新的维数约简算法,从提高文本分类性能和准确性出发,运用偏*小二乘的*新理论成果,提出了一种能较好提取潜在语义的新文本分类模型,对于数量庞大的文档类别,传统的平坦文本分类的性能受到很大的制约,层次文本分类是一种有效的解决方法,由此提出了一种新的层次文本分类模型。
内容简介
本书介绍了文本分类和偏*小二乘回归,提出了基于变量投影重要性指标的文本分类特征选择方法,论述了偏*小二乘logistic文本分类模型,阐述了chtc层次文本分类模型的研究工作,本书可供相关领域科研工作者、大学高年级学生和研究生阅读。
目录
第1章 导论
1.1 研究背景
1.2 文本分类综述
1.3 本书的内容结构
1.4 本书的创新工作
第2章 文本分类概述
2.1 文本分类的数学定义
2.2 文本分类任务的特点
2.3 文本分类系统的组成
2.4 文档预处理
2.5 文档的表示
2.6 常用文本分类模型
2.7 文本分类器学习、测试和评价
第3章 偏*小二乘回归方法的基本理论
3.1 偏*小二乘回归的发展历史
3.2 偏*小二乘回归的基本原理
3.3 偏*小二乘回归的基本思想
3.4 数学原理
3.5 偏*小二乘回归的理论算法
3.6 成分数的确定
第4章 基于变量投影重要性指标的特征选择方法研究
4.1 维数约简技术
4.2 符号约定
4.3 常用的特征选择方法
4.4 常用的特征抽取方法
4.5 基于变量投影重要性指标的特征选择方法
4.6 实验结果和分析
第5章 偏*小二乘logistic文本分类模型研究
5.1 logistic回归模型
5.2 偏*小二乘logistic回归模型
5.3 偏*小二乘logistic文本分类模型
5.4 实验结果和分析
第6章 ghtc层次文本分类模型研究
6.1 层次分类概述
6.2 层次特征选择
6.3 ghtc层次文本分类模型
6.4 实验结果和分析
第7章 总结与展望
7.1 总结
7.2 研究展望
附录1 reuters-21578前10个常见类和前10个稀有类的前20个特征vip值
附录2 复旦文本分类语料库部分类别的前20个特征vip值
附录3 ohsumed语料库层次结构
附录4 20 newsgroups语料库各节点各特征维数的微平均f1值和宏平均f1值变化情况
参考文献
后记
节选
《文本挖掘中若干关键问题研究》介绍了文本分类和偏*小二乘回归,提出了基于变量投影重要性指标的文本分类特征选择方法,论述了偏*小二乘Logistic文本分类模型,阐述了CHTC层次文本分类模型的研究工作,《文本挖掘中若干关键问题研究》可供相关领域科研工作者、大学高年级学生和研究生阅读。
-
造神:人工智能神话的起源和破除 (精装)
¥32.7¥88.0 -
大数据技术导论(第2版)
¥28.9¥41.0 -
人工智能
¥20.3¥55.0 -
人人都能学AI
¥40.4¥68.0 -
数据结构基础(C语言版)(第2版)
¥41.7¥49.0 -
系统架构设计师教程(第2版)(全国计算机技术与软件专业技术资格(水平)考试指定用
¥102.7¥158.0 -
过程控制技术(第2版高职高专规划教材)
¥27.6¥38.0 -
WPS OFFICE完全自学教程(第2版)
¥97.3¥139.0 -
智能视频目标检测与识别技术
¥43.5¥59.0 -
人工智能基础及应用
¥36.0¥48.0 -
深入浅出软件架构
¥117.2¥186.0 -
工业互联网安全创新技术及应用
¥79.4¥128.0 -
计算机网络基础(微课版)
¥39.0¥55.0 -
零信任架构
¥62.4¥89.0 -
剪映:即梦AI绘画与视频制作从新手到高手
¥66.0¥89.0 -
红蓝攻防 技术与策略(原书第3版)
¥95.9¥139.0 -
Web前端开发基础
¥37.5¥57.0 -
软件设计的哲学(第2版)
¥52.0¥69.8 -
人工智能的底层逻辑
¥58.7¥79.0 -
软件工程理论与案例
¥63.4¥99.0