维普中文期刊产品整合服务
共被期刊论文引用了5次 您的检索式:您选中1篇文献正在查看引证文献汇总
    题名 作者 年代 出处 被引量
1基于Java的新浪微博爬虫研究与实现显示文摘为了高效获取更多的微博数据,针对调用微博API和网页版(com版)等传统微博爬虫在数据采集中所存在的问题,设计开发了一个基于Java的采集新浪微博Weibo.cn站点的网络爬虫系统。该系统通过广度遍历结合组拼URL的方式采集网页源码,使网页源码更加简洁,纯净度更高,降低了网络传输压力并减少了HTML源码解析时间。主要实现了微博模拟登陆、微博网页爬取、微博页面数据提取和任务调度控制,并对爬取数据进行了分析,在爬虫中添加了主题微博筛选功能。为验证该系统的有效性和可行性,与其他传统方法进行了分析对比。实验验结果表明,所提出的系统爬取效率更高,实现代码更简便。陈珂 蓝鼎栋 柯文德 黎树俊 邓文天 2017计算机技术与发展2017,27,9:8
2微博数据获取技术及展望显示文摘作为一种新兴的社会媒体形式,微博集博客、媒体、即时通讯功能于一身,兼具平台多样、传播迅速、交互性强等特点,在舆论传播方面发挥了重要作用。文中介绍了微博的基本概念,系统概括了微博数据获取的主流方法,总结了微博数据获取条件的选择方法和微博数据的表达方法,并讨论了数据获取中的瓶颈问题,给出了该领域中尚需解决的关键问题以及未来的发展方向。游翔 葛卫丽 2014电子科技2014,27,10:5
3基于微博信息的关键词库爬虫策略显示文摘通过研究对比不同网络爬虫策略的优缺点,提出了基于微博信息的关键词库爬虫策略,利用微博的特性以及数据挖掘算法的优势,生成关键词库指导爬虫模型进行微博信息的获取,解决了主题爬虫模型在数据获取时存在的时序性、正确性以及高效性的问题,提高了微博事件信息的覆盖率和准确率,最后通过设计实验系统Keys Crawler,验证了本文提出的策略的优越性.林红静 黄梦醒 2016海南大学学报(自然科学版)2016,34,2:3
4基于用户影响力的微博数据提取算法显示文摘微博作为舆情分析中基础数据的主要来源之一,如何对其进行有效提取是数据获取的关键问题。为此,提出一种基于用户影响力的数据提取算法,以满足舆情系统对数据的需求。该算法首先利用模拟登录技术获取用户关系并依此构建用户网络,再根据自主设计的用户影响力计算方法计算出影响力,进而建立符合微博特征的影响力最大化模型挖掘出最具传播能力的k个节点,最后爬取相应的微博数据。实验证明,该算法能够有效提高获取数据的质量,为舆情分析提供更好的数据支持。田霏霏 沈记全 2017计算机应用与软件2017,34,1:2
5微博数据采集的设计与实现显示文摘介绍了从互连网站上,通过微博网站提供的API接口方式和通过网络爬虫下载新浪微博数据的两种方法,并都予以实现。改进了Webcollector爬虫下载微博数据的方法,把下载数据保存到MySQL数据库中的表里,实现了通过多个代理服务器轮流交换来下载微博数据的方法,同时实现了多个帐号轮流交替的下载方法。朱烨行 张明杰 2017电脑编程技巧与维护2017,,17:2
返回顶部 每页显示:
共1页 首页 上一页 第1页 下一页 末页 /1 跳转

网站首页 | 关于我们 | 联系我们 | 产品服务 | 客服中心 | 广告服务 | 版权声明 | 网站联盟 | 友情链接 | 售卡网点

版权所有© 渝B2-20050021-1 渝公网安备 50019002500403号 违法和不良信息举报中心

互联网出版许可证 新出网证(渝)字10号 全国400电话 - 免长途话费