2022年3月15日
分享嘉宾:刘祁跃 爱奇艺科学家 编辑整理:李婷婷 内容来源:爱奇艺技术沙龙 出品社区:DataFun 导读: 本次分享的主题为 AI 在爱奇艺视频广告中的探索。AI 可以对视频内容、广告素材进行理解和加工,并应用于视频广告,尤其在广告的点位挖掘和生成、点位分析、素材创作等方面已产生价值,进而有益于广……
阅读全文
2022年3月15日
本文根据58同城AI Lab负责人詹坤林在DataFunTalk人工智能技术沙龙所分享的《五八同城智能客服系统“帮帮”技术揭秘》编辑整理而成,在未改变原意的基础上稍做整理。 首先简单介绍一下58同城,58同城是一个生活服务平台,平台连接着B端商户和C端用户,B端商户在平台发布帖子信息……
阅读全文
2022年3月15日
分享嘉宾: 熊威,58同城TEG搜索排序部资深算法工程师 整理出品: 张劲, AICUG人工智能社区 PPT下载: http://www.aicug.cn/#/docs 浏览器不支持该媒体的播放 :( (视频回放) 导读 传统基于Term-Match检索技术可以较好的解决Query-Doc字面匹配问题,而对于没有词命中时的Query-Doc语义匹配问题……
阅读全文
2022年3月15日
分享嘉宾:陈天明 汽车之家 编辑整理:徐焱森 中经惠众 出品平台:DataFunTalk 导读: 本文主要介绍汽车之家离线计算平台的建设过程,如何应对集群大规模增长带来的性能和稳定性的挑战,如何解决多租户情况下集群面临的运维难题以及如何提升服务器资源利用率问题等问题。 01 汽车之家离线计算平台现……
阅读全文
2022年3月15日
原文发布于微信公众号 - 小小挖掘机(wAIsjwj) 原文发表时间:2018-09-25 1、引言 信息检索领域的一个重要任务就是针对用户的一个请求query,返回一组排好序的召回列表。 经典的IR流派认为query和document之间存在着一种生成过程,即q -> d 。举一个例子,搜索“哈登……
阅读全文
2022年3月15日
本文主要介绍 TNonblockingServer 服务模型,这是thrift框架提供的一种非阻塞式IO服务模型,目前是thrift框架中最好的模型,这也是我们重点介绍的模型。 thrift是Facebook开源的一款开源跨语言的RPC通信框架,主要提供三种服务模型:1)TThreadPoolServer 服务模型,这是……
阅读全文
2022年3月15日
导语:标签为用户提供了一种新的检索方式,用户和信息通过标签进行关联,信息的标签化、行为的标签化,在提供个性召回能力的同时,也有助于帮我梳理和挖掘业务品类的特征,做相关业务属性的聚合。 背景 当下全连接的信息场景,所有对于有助于连接转化效率提升的内容和考虑尤为重要,这就要求我们在实际业……
阅读全文
2022年3月15日
作者:果贝,阿里云资深技术专家 ,实时数仓Hologres负责人 2022年1月7日,阿里云实时数仓Hologres举行了年度发布会,在发布会上,来自阿里的资深技术专家从阿里的核心场景出发,为大家解读了实时数仓的新发展趋势“在线化、敏捷化、一站式”。通过本文,我们将会深入解读实时数仓……
阅读全文
2022年3月15日
摘要: 去年开始着手打造伴鱼公司级的实时计算平台,平台代号 Palink,由 Flink + Palfish 组合而来。 在伴鱼发展早期,出现了一系列实时性相关的需求,比如算法工程师期望可以拿到用户的实时特征数据做实时推荐,产品经理希望数据方可以提供实时指标看板做实时运营分析。 这个阶段中台数据开发工程师主要是基于……
阅读全文
2022年3月15日
原文: https://www.amazingkoala.com.cn/Lucene/yasuocunchu/2019/0130/29.html 去重编码是 Lucene 中对 int 类型数据的一种压缩存储方式,在 FacetsConfig 类中用到此方法来处理 int 类型数据。其优点在于,存储一个原本需要固定 4 个字节空间大小的 int 类型的数据,最好的情况下只要 1 个字节,最差的情况下需要 5 个字节。 处理过程 去重编码的过程主要分三步: 排序 去重 差值存储 关系图 根据 int 数值的大小,……
阅读全文