推荐系统的架构

下载本文档

阅读 97
下载 25
格式 pdf
大小 1.24 MB
约9页
2025-03-03 发布于天津市
收藏
评论
点赞(0)
海报
举报

1/9页

2/9页

3/9页

在线预览已结束，请下载后查看完整版，加入VIP享文档下载特权

文本预览下载提示常见问题

本文从互联网收集并整理了推荐系统的架构，其中包括一些大公司的推荐系统框架（数据流存储、计算、模型应用），可以参考这些资料，取长补短，最后根据自己的业务需求，技术选型来设计相应的框架。后续持续更新并收集。。。图 1 界面 UI 那一块包含 3 块东西：1) 通过一定方式展示推荐物品(物品标题、缩略图、简介等)；2) 给的推荐理由；3) 数据反馈改进个性化推荐；关于用户数据的存放地方：1)数据库/缓存用来实时取数据；2) hdfs文件上面；抽象出来的三种推荐方式图 2 图3 图3 中，推荐引擎的构建来源于不同的数据源(也就是用户的特征有很多种类，例如统计的、行为的、主题的)+不同的推荐模型算法，推荐引擎的架构可以试多样化的(实时推荐的+离线推荐的)，然后融合推荐结果（人工规则+模型结果），融合方式多样的，有线性加权的或者切换式的等图4 图4 中，A 模块负责用户各类型特征的收集，B 模块的相关表是根据图3 中的推荐引擎来生成的，B 模块的输出推荐结果用来C 模块的输入，中间经过过滤模块 (用户已经产生行为的物品，非候选物品，业务方提供的物品黑名单等)，排名模块也根据预设定的推荐目标来制定，最后推荐解释的生成（这是可能是最容易忽视，但很关键的一环，微信的好友推荐游戏，这一解释已经胜过后台的算法作用了） HU LU 的推荐系统总结：这个也就跟图3 有点类似了，葫芦的推荐系统，至少在他blog 中写的比较简单。更多的是对推荐系统在线部分的一种描述，离线部分我猜想也是通过分布式计算或者不同的计算方式将算法产生的数据存储进入一种介质中，供推荐系统在线部分调用。系统的整个流程是这样的，首先获取用户的行为，包括 (watch、subscribe、vote)，这样行为会到后台获取show-show 对应的推荐数据。同时这些行为也会产生对应的topic，系统也会根据topic到后台获取topic-show 对应的推荐数据。两种数据进行混合，然后经过fliter、explanation、ranking 这一系列过程，最后生成用户看到的推荐数据。淘宝的推荐系统(详细跟简单版) 总结：淘宝的推荐系统，描述了推荐引擎搭建的整体架构，包括离线的分布式计算和存储、监控、数据统计和分析、实验平台等。给我们搭建推荐引擎提供了很好的建议。整体流程大致这样。通过后台的分布式计算，将算法产生的算法结果数据存储进入一种介质中，首推hbase。然后，通过一种叫做云梯的机制将算法结果推入中间层介质中，供推荐系统在...

1、当您付费下载文档后，您只拥有了使用权限，并不意味着购买了版权，文档只能用于自身使用，不得用于其他商业用途（如 [转卖]进行直接盈利或[编辑后售卖]进行间接盈利）。
2、本站所有内容均由合作方或网友上传，本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺！文档内容仅供研究参考，付费前请自行鉴别。
3、如文档内容存在违规，或者侵犯商业秘密、侵犯著作权等，请点击“违规举报”。

碎片内容

推荐系统的架构

本文从互联网收集并整理了推荐系统的架构，其中包括一些大公司的推荐系统框架（数据流存储、计算、模型应用），可以参考这些资料，取长补短，最后根据自己的业务需求，技术选型来设计相应的框架

后续持续更新并收集

图 1 界面 UI 那一块包含 3 块东西：1) 通过一定方式展示推荐物品(物品标题、缩略图、简介等)；2) 给的推荐理由；3) 数据反馈改进个性化推荐；关于用户数据的存放地方：1)数据库/缓存用来实时取数据；2) hdfs文件上面；抽象出来的三种推荐方式图 2 图3 图3 中，推荐引擎的构建来源于不同的数据源(也就是用户的特征有很多种类，例如统计的、行为的、主题的)+不同的推荐模型算法，推荐引擎的架构可以试多样化的(实时推荐的+离线推荐的)，然后融合推荐结果（人工规则+模型结果），融合方式多样的，有线性加权的或者切换式的等图4 图4 中，A 模块负责用户各类型特征的收集，B 模块的相关表是根据图3 中的推荐引擎来生成的，B 模块的输出推荐结果用来C 模块的输入，中间经过过滤模块 (用户已经产生行为的物品，非候选物品，业务方提供的物品黑名单等)，排名模块也根据预设定的推荐目标来制定，最后推荐解释的生成（这是可能是最容易忽视，但很关键的一环，微信的好友推荐游戏，这一解释已经胜过后台的算法作用了） HU LU 的推荐系统总结：这个也就跟图3 有点类似了，葫芦的推荐系统，至少在他blog 中写的比较简单

更多的是对推荐系统在线部分的一种描述，离线部分我猜想也是通过分布式计算或者不同的计算方式将算法产生的数据存储进入一种介质中，供推荐系统在线部分调用

系统的整个流程是这样的，首先获取用户的行为，包括 (watch、subscribe、vote)，这样行为会到后台获取show-show 对应的推荐数据

同时这些行为也会产生对应的topic，系统也会根据topic到

小辰3 + 关注: 实名认证
内容提供者

出售各种资料和文档

收藏店铺进入空间

推荐系统的架构

推荐系统的架构

您可能关注的文档

相关文档

热门下载

相关标签