×
请登录
账号
密码
登录 Use it
博客
随笔
网盘
建站
资源
古文赏析
标签
毒鸡汤
登录
注册
一文看懂统计学T检验、F检验、卡方检验
欢迎加群交流数据分析: 一、基本知识 数据的种类 我们都知道,一般数据可以分为两类,即定量数据(数值型数据)和定性数据(非数值型数据),定性数据很好理解,例如人的性别,姓名这些都是…
star2017
博客
1年前
307
0
Kano模型使用指南
So, What is the Kano Model? Noriaki Kano,一名日本研究学者、咨询师,他在1984年发表了一篇论文,提出一套帮助我们确定用户(和潜在用户)对产…
star2017
博客
1年前
434
0
淘系技术|生成式重排在内容推荐中的应用实践
本系列文章包含每平每屋过去一年在召回、排序和冷启动等模块中的一些探索和实践经验,本文为该专题的第四篇。 第一篇指路: 淘系技术 | 冷启动系统优化与内容潜力预估实践 第二篇指路: 淘系技术|GNN 在轻应用内容推荐中的召回实践 第三篇指路:淘系技术|基于特征全埋点的精排ODL实践总结 第四篇指路: ....
star2017
博客
1年前
5314
0
提高数据的颜值!一起看看Pandas中的那些Style
Pandas的style用法在大多数教程中见的比较少,它主要是用来美化DataFrame和Series的输出,能够更加直观地显示数据结果。 下面采用某商店的零售数据集,通过实际的应…
star2017
博客
1年前
403
0
模型故事:产品线优化的利器TURF分析
前年,手机开始流行渐变色,我们帮助某厂商做手机外观的CMF偏好测试。我们大概测了十几个手板,有经典的黑色银色,更多的是各种渐变色。研究设计时,我们遇到一个挑战:如果只能推出四种颜色…
star2017
博客
1年前
231
0
淘系技术|无尽流场景优化总结
本系列文章包含每平每屋过去一年在召回、排序和冷启动等模块中的一些探索和实践经验,本文为该专题的第六篇。 第一篇指路: 淘系技术 | 冷启动系统优化与内容潜力预估实践 第二篇指路: 淘系技术|GNN 在轻应用内容推荐中的召回实践 第三篇指路:淘系技术|基于特征全埋点的精排ODL实践总结 第四篇指路: ....
star2017
博客
1年前
6712
0
极验 | 对抗样本技术在互联网安全领域的应用
[图片] 分享嘉宾:苏涛 极验 高级算法工程师 编辑整理:王姝琪 北京理工大学 出品平台:DataFunTalk 导读: 验证码作为网络安全的第一道屏障,其重要程度不言而喻。当前,卷积神经网络的高速发展使得许多验证码的安全性大大降低,一些新型验证码甚至选择牺牲可用性从而保证安全性。针对对抗样本技术的 ....
star2017
博客
1年前
5416
0
Pandas数据处理——盘点那些常用的函数
这篇文章为大家整理一下实际使用中比较高频的一些用法,当然还会有一篇关于时间序列处理的文章。在这里需要强调一点就是,不建议初学者上来就把Pandas中所有的方法都啃一遍,这样效率太低…
star2017
博客
1年前
429
0
Pandas教程|Merge数据合并图文详解
为了方便维护,一般公司的数据在数据库内都是分表存储的,比如用一个表存储所有用户的基本信息,一个表存储用户的消费情况。所以,在日常的数据处理中,经常需要将两张表拼接起来使用,这样的操…
star2017
博客
1年前
421
0
阿里技术|多模态技术在淘宝主搜召回场景的探索
[图片] 作者幻士 大淘宝技术 稿 导语: 搜索召回作为搜索系统的基础,决定了效果提升的上限。如何在现有的海量召回结果中,继续带来有差异化的增量价值,是我们面临的主要挑战。而多模态预训练与召回的结合,为我们打开了新的视野。 前言 多模态预训练是学术界与工业界研究的重点,通过在大规模数据上进行预训练, ....
star2017
博客
1年前
4649
0
Pandas数据处理——玩转时间序列数据
进行金融数据分析或量化研究时,总避免不了时间序列数据的处理,时间序列是指在一定时间内按时间顺序测量的某个变量的取值序列。常见的时间序列数据有一天内随着时间变化的温度序列,又或者交易…
star2017
博客
1年前
696
0
Pandas教程|数据处理三板斧——map、apply、applymap详解
在日常的数据处理中,经常会对一个DataFrame进行逐行、逐列和逐元素的操作,对应这些操作,Pandas中的map、apply和applymap可以解决绝大部分这样的数据处理需求…
star2017
博客
1年前
398
0
阿里技术|阿里 TPP 图化框架技术实践—打造算法在线服务领域极致开发体验与性能
[图片] 作者:腾驹 稿 TPP图化致力于打造一个算法在线服务领域易用、性能极致、迭代效率远超普通方式的产品。本文将介绍TPP图化以及2021年在性能、开发体验上的改进,并介绍未来TPP图化的规划。 01 背景 TPP是阿里个性化算法开发平台,依托阿里AI·OS引擎(特征、召回、打分等引擎)为众多 ....
star2017
博客
1年前
3059
0
KANO模型
分析方法视频解读:B站优酷 案例数据下载 下载 数据格式说明 查看 KANO模型由东京理工大学教授狩野纪昭(Noriaki Kano)发明,其用于分析用户对于各类需求的排名偏好情况…
star2017
博客
1年前
404
0
网易数帆数据中台逻辑数据湖的实践
[图片] 导读: 本文将介绍过去15年中,网易大数据团队在应对不断涌现的新需求、新痛点的过程中,逐渐形成的一套逻辑数据湖落地方法。内容分为五部分: 关于网易数帆 为什么做逻辑数据湖 怎么做逻辑数据湖 未来规划 精彩问答 01 关于网易数帆 网易数帆是从网易杭州研究院孵化出来的。网易杭研的重要职责是公 ....
star2017
博客
1年前
716
0
什么是NPS?
一、什么是NPS? NPS的中文是净推荐值,是评估用户口碑的一种方式。评估用户/客户向朋友、其他人推荐公司的产品或服务的可能性的指标。 NPS概念属于用户口碑、用户体验评估的范畴。…
star2017
博客
1年前
245
0
决策树–Decisiontree
什么是决策树? 决策树学习的 3 个步骤 3 种典型的决策树算法 决策树的优缺点 决策树是一种逻辑简单的机器学习算法,它是一种树形结构,所以叫决策树。 本文将介绍决策树的基本概念、…
star2017
博客
1年前
4671
0
GDBT模型、XGBoost和LightGBM之间的区别与联系
GBDT提升树与XGBoost树 相比于经典的GBDT,xgboost做了一些改进,从而在效果和性能上有明显的提升,在这里,通过整理了一些资料,总结了一下: 第一,GBDT将目标函…
star2017
博客
1年前
374
0
用Python进行系统聚类分析
在进行机器学习时,我们往往要对数据进行聚类分析,聚类,说白了就是把相似的样品点/数据点进行归类,相似度高的样品点会放在一起,这样一个样本就会被分成几类。而聚类分析也有很多种方法,比…
star2017
博客
1年前
227
0
阿里|关于技术能力的思考和总结
[图片] 朱春茂(知明) 阿里开发者 稿 技术人成长的悖论 在程序员界有一个悖论持续在困惑着很多技术人:在写代码的人的困惑是一直写代码是不是会丧失竞争力,会不会被后面年轻的更能加班写代码的人汰换。典型代表就是工作5年左右的核心技术骨干,此时正处于编码正嗨但也开始着手规划下一个职业发展阶段的时候;没在 ....
star2017
博客
1年前
1902
0
1
...
54
55
56
...
472
本文目录
热门标签
广告位
热门文章
1.
SpringBoot2实践系列(六):集成监控模块Actuator详解
2.
如何学习Python数据科学(2018)
3.
31个与大数据有关的非常不错的资源和文章(附全链接)
4.
这可能是人工智能、机器学习和大数据领域覆盖最全的一份速查表
5.
微服务应用(十五):一台服务器重启导致Redis集群宕机所有业务不可用问题分析
6.
史上最全的“大数据”学习资源(上)
阿里云新老用户最新优惠
阿里云新老用户最新优惠
最新发布
1.
分析binlog日志都是哪些操作
2.
连接配置了SSL的达梦数据库
3.
修改jar里的配置文件
4.
linux定时工具crontab使用
5.
桌面看盘工具dstock V2.0发布
6.
Claude Code自动代码工具安装配置使用
最新评论
签到
?
签到
签到
签到,学习
签到