本星期工作内容及结果
1.和王松,艾明,卞云龙一起组成一个小组,准备明年的数据挖掘竞赛;为此我们先熟悉了一下竞赛流程,规则及要点。经过分工作将竞赛网站的内容简单的翻译成了中文,方便以后查看。
2.借阅了一些web数据挖掘方面的书藉并大概了解了一下;清楚了什么是web数据挖掘。其实web数据挖掘就是从web的超链接结构,网页内容和使用日志中探寻有用的信息。而web挖掘的任务主要分为三种类型:web结构挖掘,web内容挖掘,和web使用挖掘;
3. 继续翻阅了一下《商务推荐系统的设计研究》这篇论文;《商务推荐系统的设计研究》主要是从信息系统的角度,讨论推荐系统的设计实现的方法与原则,这更符合推荐系统实用性很强的应用背景,而不是过多地专注于对推荐算法的改进。
4.在网上查了一下matlab数据挖掘工具箱--spider+Weka结合使用,但还没去掌握其用法,将这工作留到下周继续;
问题/困难
- 目前,对于web数据挖掘很难找到一个切入点,还没有一个整体上的把握;
设想/建议/要求
如果孙老师时间允许的话,希望可以另外给王松,艾明,卞云龙和我这个小组开设一个小班,介绍一下目前数据挖掘的前沿领域以及主要人物和他们的研究工作;
下一工作周期计划
必须完成:
- 1.掌握matlab数据挖掘工具箱的使用;
- 2.主要掌握一些web数据挖掘的常用方法;
- 3.将《商务推荐系统的设计研究》这篇论文的第二章看完;
有时间则继续:
- 4.看一篇英文文献;
- 5.思考“构造数独”的解法;
- 6.看《c++ primer》;
- 7.看《网络安全开发包详解》,了解winpcap;


被折叠的 条评论
为什么被折叠?



