-
文本挖掘:手把手教你分析携程网评论数据
所属栏目:[大数据] 日期:2020-12-25 热度:117
文本分析的应用越来越广泛,这不,我的工作也开始涉及了文本分析,今天就讲讲关于评论数据的那点事。 首先评论数据如何获取? 一般通过 网络爬虫的方式 抓取各大网站的评论数据,本次分析数据就来源于携程网某酒店的评论,在同事的协助下,成功爬取该酒店的[详细]
-
R中文舆情包cnSentimentR
所属栏目:[大数据] 日期:2020-12-25 热度:162
该包使用jiebaR分词,svm[e1071]进行分类; 包括三个函数:cnsr.prepare,cnsr.train,cnsr.predict 目前还在开发中,功能不完整. 请见: https://github.com/leeshuheng/cnSentimentR[详细]
-
工作坊 | 大数据智能分析和挖掘在互联网中的应用实战案例
所属栏目:[大数据] 日期:2020-12-25 热度:136
大数据分析和挖掘在互联网公司中已经得到实质性的推进和应用,典型的应用场景包括搜索引擎的搜索结果和搜索广告排序、电商网站的商品推荐和虚假信息检测、电子邮件服务中垃圾邮件检测、互联网安全公司的病毒和木马检测、视频和新闻分享网站中视频和新闻推荐[详细]
-
亚马逊前首席科学家:大数据价值体现在AI、BI、CI、DI
所属栏目:[大数据] 日期:2020-12-25 热度:98
「 技术领导者 」的订阅首选 本文转载自灯塔大数据 无人机送货、阿法狗下棋、小冰和你谈场恋爱……人工智能领域的成果,一直是企业在大数据运用能力上的主要外在体现,但在亚马逊原首席科学家安德雷斯·韦思岸(Andreas Weigend)看来,大数据能为企业做的,还[详细]
-
bzoj 1670: [Usaco2006 Oct]Building the Moat护城河的挖掘 (凸
所属栏目:[大数据] 日期:2020-12-25 热度:190
1670: [Usaco2006 Oct]Building the Moat护城河的挖掘 Time Limit:? 3 Sec?? Memory Limit:? 64 MB Submit:? 524?? Solved:? 384 [ Submit][ Status][ Discuss] Description 为了防止口渴的食蚁兽进入他的农场,Farmer John决定在他的农场周围挖一条护城河。[详细]
-
微信红包先抢和后抢差距居然这么大!春节抢红包的大数据分析
所属栏目:[大数据] 日期:2020-12-24 热度:63
春节是中华民族隆重的农历新年 这是世界上规模最大的节日 在春节前后 炎黄子孙们不远万里衣锦还乡 与亲人们团圆 在此期间 中国的铁路上会发生 地球上最大规模的人口迁徙 作为世界上最能吃最能玩的种族 聪明勇敢的中国人发明了非常多的娱乐活动 比如 贴春联、[详细]
-
NMEA library数据处理过程分析
所属栏目:[大数据] 日期:2020-12-24 热度:96
? ? 今天学习一个 GPS 数据解析开源库—— NMEA lib 。使用这个库,可以轻松处理 GPS 接收机发出的数据,并不需要了解 NMEA 的具 体协议,这个库可 以解析所有 NMEA0813 规定的所有报文格式。不仅可以解析出原始数据中包含的所有参数,还可以计算两点之 间的[详细]
-
打车不再加价?大数据说可以有
所属栏目:[大数据] 日期:2020-12-24 热度:147
高峰期打车的供求关系不均衡的问题,一直被诟[详细]
-
算法训练 区间k大数查询
所属栏目:[大数据] 日期:2020-12-24 热度:151
问题描述 给定一个序列,每次询问序列中第l个数到第r个数中第K大的数是哪个。 输入格式 第一行包含一个数n,表示序列长度。 第二行包含n个正整数,表示给定的序列。 第三个包含一个正整数m,表示询问个数。 接下来m行,每行三个数l,r,K,表示询问序列从左往[详细]
-
内衣大数据分析:透过女生内衣的需求变化,看年轻人的情趣生活
所属栏目:[大数据] 日期:2020-12-24 热度:145
报道大数据企业: 大数据产品、大数据方案、 ? 大数据人物 分享大数据干货: 大数据书籍、大数据报告、 大数据视频 本文系大数据人精选自网络。 欢迎更多优质原创文章投稿给大数据人:admin@bigdata.ren 小编微信:data985 End. 版权声明 : 由“大数据人”[详细]
-
[bigdata-041] python3+re 正则表达式 手机号微信号qq号
所属栏目:[大数据] 日期:2020-12-24 热度:196
import reREGEX_PHONE = re.compile(r'1d{10}',re.IGNORECASE)REGEX_QQ = re.compile(r'[1-9]d{4,10}',re.IGNORECASE)REGEX_WX1 = re.compile(u'微信[w,-]{1,20}'.encode('utf8'),re.IGNORECASE)#正则手机号码def get_all_phone_num(s1): global REGEX_PH[详细]
-
数据挖掘:手把手教你做文本挖掘
所属栏目:[大数据] 日期:2020-12-24 热度:56
1 文本挖掘定义 文本挖掘指的是从文本数据中获取有价值的信息和知识,它是数据挖掘中的一种方法。文本挖掘中最重要最基本的应用是实现文本的分类和聚类,前者是有监督的挖掘算法,后者是无监督的挖掘算法。 ? 2 文本挖掘步骤 1)读取数据库或本地外部文本文[详细]
-
蓝桥杯-区间k大数查询
所属栏目:[大数据] 日期:2020-12-24 热度:199
从题目上看,用int类型数据就够了,没必要考虑long这些~~ 在题目中,直接用了Collection工具类中的sort方法,是从小到大排序,据了解,Java自带的排序算法应该是优化过的快速排序,算法可靠。 package 区间k大数查询 ; import java .util .ArrayList ; impor[详细]
-
数据挖掘中的模式发现(五)挖掘多样频繁模式
所属栏目:[大数据] 日期:2020-12-24 热度:153
挖掘多层次的关联规则(Mining Multi-Level Associations) 定义 项经常形成层次。 如图所示 那么我们可以根据项的细化分类得到更多有趣的模式,发现更多细节的特性。 Level-reduced min-support 使用的是Level-reduced min-support方法来设置最低支持度,即,[详细]
-
关于评论话题挖掘的研究及其实现代码(一)LDA
所属栏目:[大数据] 日期:2020-12-24 热度:72
引言 在 2016年中,我们参加了一个由厦门信研院举办的大数据比赛。当时,我们拿到的题目为影迷关注点分析。数据是来自于微博与豆瓣的影迷评论数据,其数据量达600多万条评论数据,分别对应于2000多部不同的电影。我们的想法是将影迷关注点分析尽量往评论话题[详细]
-
文思海辉与达梦完成产品兼容互认证
所属栏目:[大数据] 日期:2020-12-18 热度:73
继文思海辉与国产IT厂商南大通用、数腾软件完成产品兼容互认证,近日,文思海辉又与武汉达梦数据库股份有限公司(以下简称:达梦公司)完成产品兼容性互认证。[详细]
-
净利润同比下滑超60%,少了小米后华米科技能否独立“行走”?
所属栏目:[大数据] 日期:2020-12-18 热度:118
北京时间11月23日美股盘前,华米科技发布了2020财年第三季度的财务报告。在财报发布后,华米科技当天盘前股价累计下跌7.6%。在23日美股三大股指集体收涨情况下,[详细]
-
奏响5G“主旋律”,MWC将于明年2月重返上海
所属栏目:[大数据] 日期:2020-12-18 热度:130
如果没有因为疫情而停办,2021年将是MWC世界移动通信大会落地上海的第十年。按计划,它将在明年的6月份举办。但由于疫情的影响,2020年的MWC上海展没能如期举行,或许也因为如此,明年的大会比原计划来得更早一些。 据主办方GSMA近日宣布,2021年MWC上海展[详细]
-
戴尔全新产品搭载新一代NVIDIA高性能显卡
所属栏目:[大数据] 日期:2020-12-18 热度:83
历经数次迭代升级,戴尔于近日推出多款重磅新品。搭载新一代NVIDIA GeForce RTX 3070显卡的全新ALIENWARE Aurora游戏台式机、戴尔XPS设计旗舰台式机、G5智能电竞台式机,以更加强悍的性能、令人惊叹的视觉效果及极致的细节功能,为游戏爱好者打造了栩栩如[详细]
-
字节跳动Byte Camp冬令营报名启动,高质量赛题带你线下备战ICPC!
所属栏目:[大数据] 日期:2020-12-18 热度:139
12月7日,字节跳动 Byte Camp 冬令营宣布回归,开启第三期训练营报名。 Byte Camp 冬令营是针对ACM国际大学生程序设计竞赛(ICPC),面向全球顶尖高校在校生举办的国际顶级训练营,旨在提高 ICPC 参赛者竞赛实力,并为所有计算机精英提供国际性的技术交流[详细]
-
第十届吴文俊人工智能科学技术奖名单出炉 云天励飞荣获一等奖
所属栏目:[大数据] 日期:2020-12-18 热度:67
日前,2020年度第十届吴文俊人工智能科学技术奖获奖名单正式出炉,云天励飞荣获吴文俊人工智能专项奖芯片项目一等奖。 吴文俊人工智能科学技术奖被誉为中国智能科学技术最高奖,是人工智能领域的最高荣誉象征。 值得一提的是,这是云天励飞第二次斩获吴文[详细]
-
持续赋能人工智能产业生态 英特尔AI百佳创新激励计划硕果累累
所属栏目:[大数据] 日期:2020-12-18 热度:197
当前,人工智能市场快速发展,又调查数据显示,全球人工智能市场的规模2020年超过1500亿美金,并且未来几年保持17%的年增长率。而在中国,人工智能成为我国产业升级和经济转型的一个主要动力,计划到2025年核心产业规模超过4000亿,带动相关的产业规模超过[详细]
-
边缘计算产业峰会召开,华为计算获“2020边缘计算十大解决方案”奖
所属栏目:[大数据] 日期:2020-12-18 热度:179
2020年12月10日,由边缘计算产业联盟(ECC)主办的2020边缘计算产业峰会(ECIS)在北京香格里拉饭店成功举办。大会以智联边云,共创产业新价值为主题,邀请了来自全球的商业领袖、国际组织、政府机构、产业伙伴、学术大咖等共聚一堂,分享边缘计算技术、学[详细]
-
百度Apollo发布乐高式汽车智能化四大系列解决方案:智驾、智舱、智图、智云
所属栏目:[大数据] 日期:2020-12-13 热度:122
12月8日,第二届百度Apollo生态大会在广州举行。百度Apollo全面展示了其在智能交通、智能汽车和自动驾驶领域的最新进展。Apollo三驾马车齐飞,持续领跑中国交通与汽车智能化赛道,大步迈入商业化阶段,引领全球出行产业革命。 在本次大会上,Apollo全新发[详细]
-
英特尔神经拟态研究社区再扩大,联想、奔驰加入
所属栏目:[大数据] 日期:2020-12-12 热度:52
今天,英特尔分享了英特尔神经拟态研究社区(INRC)的最新进展。该社区自2018年成立以来发展迅速,现已拥有100多名成员。英特尔今天宣布,联想、罗技、梅赛德斯-奔驰和机器视觉传感器公司Prophesee加入INRC,共同探索神经拟态计算在商业用例上的价值。此外[详细]