×
请登录
账号
密码
登录 Use it
博客
随笔
网盘
建站
资源
古文赏析
标签
毒鸡汤
登录
注册
数据嗨客|第5期:支持向量机
SVM目前的应用主要在模式识别领域中的文本识别、中文文本分类、人脸识别等,同时也在许多的工程技术和信息过滤等方面有着重要作用。
star2017
博客
1年前
7904
0
数据分析入门之随笔记
数据分析是一个大话题,借这篇小笔记整理一下自己的思路:数据分析是什么?涉及到哪些技术?有哪些数据公司玩家?如何定位数据分析的价值?
star2017
博客
1年前
8698
0
趣味数据挖掘系列7:团拜会与鸡尾酒会上的聚类
用异于传统的方式,从讲课PPT上取些素材(这样比较快),来说明聚类的一些概念,为下篇做些铺垫,下篇将通过通俗的例子说明一个著名的方法。
star2017
博客
1年前
6794
0
数据分析职业发展1:我的理想是成为数据分析师
我小时候的理想是将来做一名数学家,可惜长大了发现自己天赋不够,理想渐行渐远,于是开始考虑现实,开始做一些人生规划,我一直在思考将来从事何种职业,专注什么样的领域,重新定义着自己的职业理想。我现在的职业理想,比较简单,就是做一名数据分析师。 为什么要做数据分析师? 在通信、互联网、金融等这些行业每天产生巨大的数据量(长期更是积累了大量丰富的数据,比如客户交易数…
star2017
博客
1年前
3518
0
拯救数据科学的“半贝叶斯人”
或许一场关于自然语言处理的精彩辩论可以告诉我们何谓“半个贝叶斯人”,让我们把时光拨回到几年前。
star2017
博客
1年前
12075
0
20个大家应该知道的大数据资源
我总是在证明这样一个论点,即数据无处不在——并且很多都是免费的。在开始大数据分析之前,公司不一定要建立自己的大规模数据仓库。企业和政府将大量信息投入到公共领域的举措,使得每个人都能够获得海量数据。
star2017
博客
1年前
9303
0
数据嗨客|第6期:不平衡数据处理
对于不平衡数据集,一般的分类算法都倾向于将样本划分到多数类,体现在模型整体的准确率很高。
star2017
博客
1年前
7778
0
数据分析的5个坑,你踩过几个?
产品数据是产品经理量化产品的重要方面,数据的客观性,让数据变成了发掘问题本质,寻找事物规律所需要用到的最有利的手段之一,但在与数据打交道的过程中,我们可能经常会犯一些错误,导致分析的结论出现较大的偏颇,本文罗列数据分析过程中5个常见误区。
star2017
博客
1年前
1410
0
趣味数据挖掘系列8:农村中学并迁选址、K-平均聚类及蛋鸡悖论
本文从农村中学并迁选址问题出发,介绍了数据挖掘十大算法中位居第二的K-平均聚类,后又借用牛顿迭代原理,议论蛋鸡悖论。
star2017
博客
1年前
6879
0
那些“中漂”的欧洲科学家们
就近几年的科技发展水平来看,中国已逐步向科技大国迈进,这在提升中国在全球的科研影响力之余,也在一定程度上改变了全球科学人才流动背后的格局。
star2017
博客
1年前
4071
0
数据科学家面试常见的77个问题
随着大数据概念的火热,数据科学家这一职位应时而出,那么成为数据科学家要满足什么条件?或许我们可以从国外的数据科学家面试问题中得到一些参考,下面是中国统计网翻译的数据科学家面试常见的77个问题。
star2017
博客
1年前
4104
0
数据嗨客|第7期:机器学习中的过拟合问题
“预测”就是根据已知的输入和输出进行学习,并依照给定的新输入给出我们自己的判断。
star2017
博客
1年前
9400
0
数据科学在各行各业中的差异
在雇佣数据科学家最多的十大行业中,有六个行业的研究型数据科学家数量超过了其他类型的数据科学家。
star2017
博客
1年前
9001
0
大嘴巴漫谈数据挖掘:聚类分析后安排,细分群组有特征
如前所述,用户细分包括前后两部分,即前一部分因子分析完成后,还要对获得的公共因子进行随后的聚类分析。 聚类分析按照相似度进行划分类别,相似度一般由数据对象间的距离远近来衡量。基于确定的业务需求和分析目标,可以从用户基本属性、用户使用行为两个方面选择变量,随后便要进一步明确样本数据的形式。 样本数据中性别、年龄及收入是离散变量,而使用频度和价值贡献是连续变量,…
star2017
博客
1年前
6662
0
无需大量算力训练,通过“读”解说员的评论,AI也能学会国际象棋
20世纪90年代后期,IBM深蓝(Deep Blue)研究了一系列的国际象棋算法,期望于打败当时的世界冠军加里•卡斯帕罗夫(Garry Kasparov)。
star2017
博客
1年前
7040
0
数据分析过程中最有效的七种降维方法
近来由于数据记录和属性规模的急剧增长,大数据处理平台和并行数据分析算法也随之出现。于此同时,这也推动了数据降维处理的应用。实际上,数据量有时过犹不及。有时在数据分析应用中大量的数据反而会产生更坏的性能。 最新的一个例子是采用 2009 KDD Challenge 大数据集来预测客户流失量。 该数据集维度达到 15000 维。 大多数数据挖掘算法都直接对数据逐…
star2017
博客
1年前
12225
0
数据嗨客|第8期:主成分分析
主成分分析是一种经典的降维方法,但如果你只把主成分分析作为一种降维手段,那么你就太OUT了。
star2017
博客
1年前
7797
0
数据分析在过去25年的回顾:大数据的下个转折点
这篇文章是一个投资者对数据分析在过去25年的回顾。作者西蒙迪斯从投资者的角度讨论了数据分析的变革,认知应用的价值,以及最受风投关注的大数据核心领域。
star2017
博客
1年前
8965
0
哈佛学霸教你用Python分析相亲网站数据,在两万异性中找到真爱
这是一次数学家独创的完美约会经验贴
star2017
博客
1年前
9735
0
如何全面掌握别人家的APP数据?
大部分数据都是模拟趋势数据,要获得一个产品的绝对历史下载量是一件很难的事情,你要知道每个App都是分版本向App store或者安卓应用商店提交的,所以理论上我们需要看的是这个版本的下载量和活跃度。
star2017
博客
1年前
8967
0
1
...
310
311
312
...
465
本文目录
热门标签
广告位
热门文章
1.
SpringBoot2实践系列(六):集成监控模块Actuator详解
2.
如何学习Python数据科学(2018)
3.
31个与大数据有关的非常不错的资源和文章(附全链接)
4.
这可能是人工智能、机器学习和大数据领域覆盖最全的一份速查表
5.
微服务应用(十五):一台服务器重启导致Redis集群宕机所有业务不可用问题分析
6.
史上最全的“大数据”学习资源(上)
阿里云新老用户最新优惠
阿里云新老用户最新优惠
最新发布
1.
分析binlog日志都是哪些操作
2.
连接配置了SSL的达梦数据库
3.
修改jar里的配置文件
4.
linux定时工具crontab使用
5.
桌面看盘工具dstock V2.0发布
6.
Claude Code自动代码工具安装配置使用
最新评论
签到
?
签到
签到
签到,学习
签到