2022年3月15日
本文根据转转张青楠老师,在DataFun AI+ Talk中所分享的《二手电商知识图谱构建以及在价格模型中的应用》编辑整理而成。 一、知识图谱概述 这次的分享主要从以下四个部分:知识图谱概述、知识图谱构造、转转二手电商知识图谱、在价格模型中的应用。 **1.****1 ** 什么是知识图谱 知识图谱是谷歌在2012年……
阅读全文
2022年3月15日
以下文章来源于搜索与推荐Wiki ,作者Thinkgamer 1.推荐系统经典的级联架构 其实这里本来写的是「传统」的级联架构,后来思索万千,觉得不太合适,就改为了「经典」。因为级联架构目前依旧在各大互联网公司被应用,其扮演的角色也很重要。一般情况下我们常见级联架构主要是由四部分组成,……
阅读全文
2022年3月15日
人工智能一度被炒作为一项可以拯救世界或者毁灭世界的技术。 拨开喧嚣与炒作的迷雾,VentureBeat 与人工智能领域的杰出专家 Google Brain 联合创始人吴恩达,Cloudera 和 Fast Forward Labs 创始人 Hilary Mason,Facebook AI 研究院创始人 Yann LeCun,以及埃森哲人工智能全球负责人 Rumman Chowdhury 进行了一次交流……
阅读全文
2022年3月15日
1 什么是数据倾斜 数据倾斜即指在大数据计算任务中某个处理任务的进程(通常是一个JVM进程)被分配到的任务量过多,导致任务运行时间超长甚至最终失败,进而导致整个大任务超长时间运行或者失败。外部表现的话,在HiveSQL任务里看到map或者reduce的进度一直是99%持续数小时没有变……
阅读全文
2022年3月15日
黄鸿波 什么样的人容易被提升 对于一些已经工作了三年以上的同学来讲,已经到了为自己的未来考虑的时候了。在互联网行业,3 年就是一个坎,对于一个技术能力相对较强的同学,在一家比较大的企业 3 年的时间完全可以从一个新人晋升成为一个组的组长,在一个小公司甚至都有可能变成一个小的技术经理。 在成为……
阅读全文
2022年3月15日
作者: 彭渊 2018 年 11 月 20 日 背景介绍 对于腾讯庞大的大数据分析业务,几千台的 Hadoop 集群,近百 P 级的存储总量,每日产生万亿的消息数据入库,需要针对几十亿 IMEI 手机设备去重,并关联数千亿的历史全表,进行曝光、点击、PV、UV、日活、新增、留存等统计指标分析,当前所有业务的 ETL 清洗、统计计算、用户画像都……
阅读全文
2022年3月15日
作者 | 我爱雪糕 整理 | NewBeeNLP 面试锦囊之面经分享系列,持续更新中 PS. 本面经来自讨论组内大佬,欢迎订阅后台回复"面试"加入交流 写在前面 先说下感受吧。本人在今年 3 月 1 号(周日)投递简历,隔天周一 hr 就约了周四的面试,结果那天是 2 面视频技术面 +hr 面直接走完了,周五内推的学长就告诉……
阅读全文
2022年3月15日
收录自 DataFunTalk 公众号 分享嘉宾:刘金老师 编辑整理: 李亚俊 内容来源: DataFun AI Talk《饿了么推荐算法演进及在线学习实践》 出品社区: DataFun 本次分享的主要内容包括以下三个方面:首先是介绍推荐业务背景,包括推荐产品形态及算法优化目标;然后是算法的演进路线;最后重点介绍在线学习是如何在饿了么推荐领域实践的……
阅读全文
2022年3月15日
这里是 「王喆的机器学习笔记」 的第二十九篇文章。 最近写书的时候在总结一些深度学习模型线上 serving 的主流方法。之前的专栏文章也有所涉及( 如何解决推荐系统工程难题——深度学习推荐模型线上 serving)。 但是看到阿里妈妈去年 KDD 上的文章 *Practice on Long Sequential User Behavior Modeling for Click-Through Rate Prediction * 之后,还是有种相见恨晚的感觉,因为……
阅读全文
2022年3月15日
导读:本次报告曾老师主要分享了携程金融风控算法从0-1的发展进程,以时间为主线,经历了数据样本由少到多,特征由粗到细,模型由简单到复杂,效果由坏到好的全过程,重点以申请评分模型和反欺诈模型进行阐述,是一次很好的风控模型实践报告。 「业务介绍」 模型一定是基于业务的,所以首先介绍一下携……
阅读全文