包含标签 机器学习 的文章

个你应该用用看的用于文本分类的最新开源预训练模型

作者:PURVA HUILGOL 编译:ronghuaiyang 英文原文: https://www.analyticsvidhya.com/blog/2020/03/6-pretrained-models-text-classification/ 导读: 文本分类是 NLP 的基础任务之一,今天给大家介绍 6 个最新的预训练模型,做 NLP 的同学一定要用用看。 介绍 我们正站在语言和机器的交汇处。我对这个话题很感兴趣。机器能写得和莎士比亚一样好吗?如果一台机器可以提高我自己的写作技能呢?……

阅读全文

机器学习中如何处理不平衡数据

准确率高达 96.2% 的模型跑在真实数据上却可能完全无法使用。一个可能的原因是:你所使用的训练数据是不平衡数据集。本文介绍了解决不平衡类分类问题的多种方法。 假设老板让你创建一个模型——基于可用的各种测量手段来预测产品是否有缺陷。你使用自己喜欢的分类器在数据上进行训练后,准确率达到了 96.2%! 你的老……

阅读全文

干货推荐系统中的深度匹配模型

辛俊波 腾讯 | 高级研究员 推荐系统概述 1.1 推荐系统本质 推荐系统就是系统根据用户的属性 ( 如性别、年龄、学历、地域、职业 ),用户在系统里过去的行为 ( 例如浏览、点击、搜索、购买、收藏等 ),以及当前上下文环境 ( 如网络、手机设备、时间等 ),从而给用户推荐用户可能感兴趣的物品 ( 如电商的商品、fee……

阅读全文

向量召回在阿里躺平的实践

作者:陈雷慧(豆苗) 背景 躺平APP是“躺平”这个大生态中生活记录社区,记录生活记录家。 该业务场景中,个性化推荐在充分利用流量实现精细化运营、促进信息流动方面有着不可或缺的地位。在业务成长初期,其内容推荐也面临着如下两个问题: 用户冷启动: 对于无任何行为或行为稀疏的用户,难以有效的捕……

阅读全文

亿年天猫双成交总额是这样预测的

基于机器学习方法对销售预测 刚刚过去的双十一,大家可能更关心的是双十一的折扣,什么商品打了什么折扣。但是对于天猫而言,他们可能更关心的是双十一当天的销售额是多少,因为知道销售额,他就能提前做一个准备,做到未雨绸缪。 2016年我们这边有三组数据,第一组是在双十一的前十天,网上有一个专……

阅读全文

腾讯智能批改技术实践与探索

分享嘉宾:李超 腾讯 高级研究员 编辑整理:席建文 西南民族大学 出品平台:DataFunSummit 导读: 这次我们主要介绍智能批改相关的技术探索与实践,更多的分享实际场景、问题和解决方案。在作业和试卷的批改技术部分会重点讲解,其他地方会相对的简略介绍。主要内容包括:① 背景介绍;② 典型问题……

阅读全文

论文笔记结合叶节点嵌入的可解释推荐模型

“ 本文主要介绍了发表在 WWW2018 的论文《TEM: Tree-enhanced Embedding Model for Explainable Recommendation》,利用 GBDT 叶子节点进行嵌入表示来获得一个具有解释性的推荐模型” 本文来源:RecLismCat https://zhuanlan.zhihu.com/p/96124874 3 TREE-ENHANCED EMBEDDING METHOD 首先提出 TEM,它结合 MF 用于稀疏数据建模和 GBDTs 用于交叉特征学习的优点。还讨论了可解释性,分析了其复杂性……

阅读全文

张俊林对比学习在微博内容表示的应用

分享嘉宾:张俊林博士 新浪微博 编辑整理:李桂荣 中南财经政法大学 出品平台:DataFunTalk 导读: 深度学习的成功往往依赖于海量数据的支持,根据训练数据标记与否,可以分为有监督学习和无监督学习/自监督学习。监督学习技术已相对成熟,但是对海量的数据进行标记需要花费大量的时间和资源。自……

阅读全文

微软小冰如何构建人格化的对话系统

导读:微软小冰是领先的跨平台人工智能系统, 本次分享将介绍微软小冰最新的对话技术框架,以及在这套框架的基础之上,如何一步步构建 人格化 的 对话系统,并且在社交娱乐及实用场景当中的具体运用。主要包括: 如何构建基本的对话系统? 人格化的定义及如何部分实现人格化 如何构建基本的对话系统? 广义对话……

阅读全文

机器学习一文理解的原理

https://zhuanlan.zhihu.com/p/29765582 现在网上介绍gbdt算法的文章并不算少,但总体看下来,千篇一律的多,能直达精髓的少,有条理性的就更稀少了。我希望通过此篇文章,能抽丝剥茧般的向初学者介绍清楚这个算法的原理所在。如果仍不清楚可以在文后留言。 1、如何在不改变原有模型的结构上提升模型的拟合能力 假设现在你有样本集 ,然后……

阅读全文

最近文章

福利派送

分类

标签

360搜索 58同城 AB测试 AFM模型 AI AIGC AILab AI平台 AKF架构 ANN AOF AOP AQS ASR AUC AdaBoost AdaDeltaW AdamW AdvancedFeaturesOfNetty Airbnb Alink AnnotationFormatterFactory Announcement ApacheFlink AresDB Augur AutoML Automaton BERT BI BI平台 BPR Bagging Bandits BigGAN CNN CRF CTR CTR模型 CTR预估 CV CVPR ClickHouse ConcurrentProgramming Condition DDD DDD实战 DIN DKN模型 DMP平台 DPP DRN DSP DSSM DeepFFM DeepFM DeepFM模型 DesignPattern DevOps DevOps Dgraph Doris Druid Dubbo EE问题 ELK ELMo ESSM ETL Embedding EncodingSpecification Epoll FFM FFM模型 FM FM模型 FST FTRL Faraday Feed流 FixMatch FixedBitSet Flink FreeWheel FullGC GAN GBDT GBDT+LR融合 GBM GC GNN GRU4REC Git Google GraphScope Ha3 Hbase Hologres Hystrix IM IOTechnologyBase IRGAN IT博士 IT移民 Iceberg ImageNet Impala InnoDB IntBlockPool IoC JDBC JDK js JanusGraph java JavaScript KBQA KV存储 Kubernetes LDA LSTM LSTM网络 LambdaMART LearningExperience Linux LruCache Lucence MKR模型 MLflow MMoE MRR Milvus MoE Mock Monorepo mysql Mybatis NDCG NER NIO NIPS NLP Netty Netty主要组件源码分析 Netty多协议开发 Netty技术细节源码分析 Netty编解码 nextjs nextjs OCR OKR OPPO PageRank Parser PersonalExperience Pinot PlaceholderResolver Printer PropertySource Pulsar Push系统 Q&A Que2Search Query扩展 Query理解 R-Tree RMI ROC RPC RTree reactjs Redis RippleNet rocketmq SD SHAP SIGAI SPI SVM Sentinel Serverless SimCLR Softmax Spring Spring5新特性 SpringBoot SpringBootBatch SpringCloud SpringMVC SpringSecurity SpringTransaction Spring整体脉络 Spring源码故事(瞎编版) Stable Diffusion Stage TCP粘拆包 TFServing TX TensorFlow Tomcat Topk Transformer TurboSearch Typora UX WebRTC Wide&Deep Word2vec XDL XDeepFM XGBoost XLNet Yoo视频 YoshuaBengio ZeroSearch Zookeeper abtest android apache apollo architectureDesign basic boosting checkpoint clazz cluster collection concurrentCoding css cto docs elasticsearch flutter format game github gitlab go golang graphql hadoop java JDBC js kafka lab linUCB方法 lucene message mvc Mybatis mysql nacos nexp nextjs nifi node2vec nodejs npm olap one-hot oss python pytorch query纠错 react reactjs reactor Redis region registry remote rocketmq RPC scala select sharding skleam solr spark sqllit storm storybook tailwind trace vivo vuejs web web3 一致性 丑小鸭定理 业务 业务线 个性化推荐 个性化海报 中关村 中文分词 中文纠错 主题建模 书籍 事件驱动架构 事务 亚马逊 交叉验证 人工智能 人机问答 供应链 依存句法分析 信息检索 信息流推荐 倒排索引 倒排表 假设检验 全文索引 全民K歌 全链路压测 公平锁 关系 兴趣 内容挖掘 内容理解 决策树 冷启动 出轨 分层实验 分布式 分布式事务 分布式系统 分布式锁 分词 创业 加权融合 北京 区块 区块链 协同记忆网络 协同过滤 协方差 单元测试 博士 博士offer 压测 原则 双塔模型 反作弊 反欺诈 反脆弱 变量 召回 召回率 可观测性 可解释性 合约 后厂村 向量召回 向量检索 向量索引 吴恩达 命名实体识别 响应式编程 商汤科技 回归模型 因果分析 图像检索 图像识别 图数据库 图灵平台 图片翻译 图计算 在线学习 坐标回归 基于Netty开发服务端及客户端 基础支持层 增量学习 多多 多模态 多目标优化 大数据 大数据开发 头条 奥卡姆剃刀 学习 学习资料 学习资源 学会提问 实体识别 实时推荐 实时数仓 实时数据 实时日志收集 实时计算 实验平台 容灾体系建设 对比学习 对话系统 小城市 小米 小米搜索 小群效应 工作 布隆过滤器 帮帮 年轻人 广告 广告系统 序列标注 建模调参 开源数据集 开源项目 异常检测 异步IO 张嘉佳 强化学习 归一化 待分类 微服务 微软EXP 微软亚洲研究院 思维 性能优化 情感分析 意图识别 房租 技术 拆分 招聘 拼多多 持续交付 持续集成 损失函数 排序 排序模型 排队 推理系统 推荐 推荐理由 推荐系统 推送平台 提问的智慧 搜索 搜索广告 搜索引擎 搜索排序 搜索架构 搜索系统 支持向量 支持向量机 数仓体系 数仓平台 数据中台 数据仓库 数据分析 数据分析平台 数据同步 数据平台 数据指标 数据挖掘 数据治理 数据湖 数据科学 数据结构 数据集 数据驱动 文字识别 文摘 文本分类 文本情感分类 文本挖掘 文本纠错 文本表征 新闻推荐 方法论 日志架构 日志检索 时序特征挖掘 智慧物流 智能合约 智能客服 智能物流 智能语音 智能问答 智能预警 服务 机器学习 机器学习爱好者 机器学习面试题 机器翻译 机器视觉 机器阅读 条件随机场 架构 架构师 标签 标签平滑 标签识别 标签选择 校招 样本 核心处理层 检索引擎 槽位识别 模型剪枝 模型压缩 模型融合 模型评估 模型部署 模型预估 模式匹配 模式识别 正则化 注意力机制 洋码头 流批一体 消息队列 深度 深度兴趣网络 深度学习 深度树匹配 深度树检索 混排 混沌工程 火焰图 热点挖掘 熔断降级 爬虫 爱奇艺 牛顿-莱布尼茨 物流 特征工程 特征平台 特征系统 猜你喜欢 用户建模 用户画像 电商搜索 白兔 百度 相关系数 真话 矢量语义 知乎架构 知识图谱 知识增强 知识蒸馏 短文本解析 短视频 短语抽取 短语挖掘 碧桂园 神经网络 神马搜索 离线计算 秒杀架构 秒杀系统 程序人生 程序员 稳定性规范 空间索引 窗口函数 端上智能 端智能 算法 类协同训练 类目识别 粗排 索引 线程 线程池 缓存 网络图 置信度 美团 美团大脑 美团点评 职场 联邦学习 腾讯技术 腾讯音乐 自动化测试 自动驾驶 自然语言处理 色情识别 花椒直播 苞谷 蚂蚁金服 规则平台 规则引擎 视频推荐 计算广告 计算机视觉 认知 讨论区 记忆建模 记忆网络 论文 评价指标 评测指标 词向量 词嵌入 词权重 语义分割 语义匹配 语义检索 语义模型 语义理解 语言模型 语音内容识别 语音识别 谷歌面试 贝叶斯个性化排序 贝壳找房 贝壳智搜 货币化 起步 趋势科技 路径规划 软实力 边缘计算 达摩院 迁移学习 过拟合 逻辑回归 逻辑思维 采购 重叠实验框架 重排序 重构 金融 银汤匙 链表 链表求交集 阿里 阿里云 阿里妈妈 阿里小蜜 阿里达摩院 陈薇 陌陌 降纬打击 随机变量 零拷贝 面经 面试 项目管理 预估引擎 预训练 领域设计 领域驱动 风控 风控系统 高可用 高并发 高斯热图 高维数据索引 黄峥 黑盒模型

友情链接

其它