Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
Python推荐系统 Python协同过滤算法实现步骤_创想鸟

Python推荐系统 Python协同过滤算法实现步骤

协同过滤推荐系统可通过以下步骤用python实现:1. 数据准备:获取用户-物品评分数据,如movielens等;2. 构建用户-物品矩阵,使用pandas的pivot方法转换数据结构;3. 计算相似度,基于用户或物品,常用余弦相似度或皮尔逊相关系数;4. 预测评分并生成推荐,通过加权平均相似用户评分得出候选列表;5. 注意事项包括冷启动问题、评分标准化、稀疏性优化及性能优化。每一步均需结合代码实现并根据实际场景调整策略以提升效果。

Python推荐系统 Python协同过滤算法实现步骤

推荐系统是现在很多平台的核心功能之一,比如电商、视频网站、音乐平台等。Python 作为数据处理和算法开发的主力语言,在构建推荐系统方面非常合适。协同过滤(Collaborative Filtering)是最经典的推荐算法之一,实现起来也不算太难。

下面我来一步步说说怎么用 Python 实现一个简单的协同过滤推荐系统。

1. 数据准备:用户-物品评分矩阵

协同过滤的基础是用户对物品的评分数据。最常见的是“用户-物品-评分”的三列结构,比如:

立即学习“Python免费学习笔记(深入)”;

user_id | item_id | rating--------|---------|-------1       | A       | 51       | B       | 32       | A       | 4...

你可以使用公开的数据集,例如 MovieLens,也可以自己整理类似格式的数据。

常见问题:评分缺失太多怎么办?答案很简单:没关系,协同过滤本来就是用来处理稀疏矩阵的。

2. 构建用户-物品评分矩阵

有了原始数据之后,第一步是把它转成一个二维矩阵,行表示用户,列表示物品,值是评分。

可以用 Pandas 轻松完成这一步:

import pandas as pd# 假设你已经加载了数据到 df,包含 user_id, item_id, ratingratings_matrix = df.pivot(index='user_id', columns='item_id', values='rating')

这时候你会得到一个看起来像这样的矩阵:

item_id     A    B    Cuser_id                 1         5.0  3.0  NaN2         4.0  NaN  2.03         NaN  4.0  5.0

3. 计算相似度:用户之间 or 物品之间?

协同过滤分为两种:

基于用户的协同过滤(User-CF):找和当前用户兴趣相近的其他用户,然后推荐他们喜欢但当前用户没看过的东西。基于物品的协同过滤(Item-CF):找和目标物品相似的其他物品,推荐给喜欢过这些相似物品的用户。

这里以 User-CF 为例,计算用户之间的相似度常用方法是皮尔逊相关系数或余弦相似度。

from sklearn.metrics.pairwise import cosine_similarity# 填充 NaN 为 0,方便计算相似度similarity_matrix = cosine_similarity(ratings_matrix.fillna(0))

这样你就得到了一个用户之间的相似度矩阵。

4. 预测评分并生成推荐

接下来就是预测某个用户对未评分物品的兴趣程度。公式大致如下:

$$hat{r}_{ui} = bar{r}u + frac{sum{v in N(u)} text{sim}(u,v) cdot (r_{vi} – bar{r}v)}{sum{v in N(u)} |text{sim}(u,v)|}$$

不过在实际代码中可以简化处理,比如先找出最相似的几个用户,再根据他们的评分加权平均。

举个例子:

# 找出与用户1最相似的前3个用户similar_users = similarity_df[1].sort_values(ascending=False)[1:4].index# 收集这些用户评价过的电影,但用户1没有看过的candidate_items = ratings_matrix.loc[similar_users].mean(axis=0).sort_values(ascending=False)# 排除用户1已经评过分的项目user_rated = ratings_matrix.loc[1].dropna().indexrecommendations = candidate_items.drop(user_rated, errors='ignore')

最终 recommendations 就是你想推荐的内容。

5. 注意事项 & 小技巧

冷启动问题:新用户或新物品没有评分,无法推荐。这是协同过滤的硬伤,只能配合其他策略缓解。评分标准化:有些用户打分偏高,有些偏低,建议做去中心化处理(比如减去用户的平均评分)。稀疏性优化:矩阵太大太稀疏时,可以用稀疏矩阵(scipy.sparse)节省内存。性能优化:如果用户/物品太多,直接两两比较会很慢,可以考虑使用近似最近邻(ANN)加速。

基本上就这些步骤了。协同过滤虽然简单,但效果不错,尤其适合入门推荐系统。如果你能结合一些内容特征或者上下文信息,效果还能更上一层楼。

以上就是Python推荐系统 Python协同过滤算法实现步骤的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1362573.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2025年12月14日 01:57:13
下一篇 2025年12月14日 01:57:29

相关推荐

  • 如何在MXNet中训练AI大模型?高效构建深度学习的详细步骤

    如何在MXNet中训练AI大模型?高效构建深度学习的详细步骤如何在MXNet中训练AI大模型?高效构建深度学习的详细步骤如何在MXNet中训练AI大模型?高效构建深度学习的详细步骤如何在MXNet中训练AI大模型?高效构建深度学习的详细步骤

    答案是优化数据管道、采用分布式训练、应用内存优化技术、精细调参。具体包括:使用RecordIO格式和DataLoader多进程预取提升数据加载效率;通过KVStore选择device或dist_sync/dist_async实现单机或多机分布式训练;利用混合精度训练、梯度累积和模型符号化降低显存占用…

    2026年9月22日 用户投稿
    000
  • itextpdf freemarker渲染

    关于打印pdf操作的需求,经过研究,发现以下两种方法: 在现有的模板上进行编辑,这种方法操作难度较大。而通过FreeMarker生成静态页面,然后转换为HTML,操作更为顺畅。动态生成PDF的方法在网上参考较多,经过对比,我认为使用FreeMarker结合IText生成PDF最为简单。参考链接为ht…

    2026年9月22日
    300
  • Java多线程并发控制:告别线程优先级,拥抱锁机制

    本文深入探讨了在Java多线程环境中如何有效解决并发操作中断问题,特别是当多个线程尝试同时执行非原子性操作(如打印)时。文章指出,单纯依赖线程优先级并不可靠,并详细介绍了使用synchronized关键字配合共享锁对象实现互斥访问的关键技术,确保关键代码块的原子性执行,从而避免数据混乱和逻辑错误。 …

    2026年9月22日
    700
  • 使用空值合并运算符为数组元素设置默认值

    本文将介绍如何使用 PHP 的空值合并运算符 (??) 为数组元素设置默认值,尤其是在处理用户输入时。 通过该运算符,可以在变量值为 null 或不存在时,提供一个备选值,从而简化代码并提高可读性。我们将通过一个实际的 Laravel 邮件发送示例,演示如何在请求参数中缺失主题时,设置默认主题。 空…

    2026年9月22日
    600
  • 如何用AdobePremierePro制作AI视频?快速上手AI视频剪辑的完整教程

    如何用AdobePremierePro制作AI视频?快速上手AI视频剪辑的完整教程如何用AdobePremierePro制作AI视频?快速上手AI视频剪辑的完整教程如何用AdobePremierePro制作AI视频?快速上手AI视频剪辑的完整教程如何用AdobePremierePro制作AI视频?快速上手AI视频剪辑的完整教程

    答案:在Premiere Pro中制作AI视频需整合第三方AI工具生成的素材并进行精细化剪辑。首先明确主题,利用Midjourney、RunwayML、ElevenLabs等工具生成图像、视频和音频;随后导入PR并分类组织,通过粗剪与同步构建叙事框架;接着运用Lumetri Color统一色调,基本…

    2026年9月22日 用户投稿
    1200
  • 不懂技术也能做!蝴蝶号入口搭建与数据增长实战指南

    是的,不懂技术也能搭建“蝴蝶号入口”并实现数据增长。其核心在于明确目标与受众、选择合适的无代码工具、打造有价值的内容、积极推广、关注数据分析并持续优化。具体步骤为:1. 明确用户行为路径和转化目标;2. 选用linktree、notion、wix等无代码工具搭建入口;3. 输出简洁有吸引力的内容;4…

    2026年9月22日
    400
  • Reinstalling Alpine Linux on a Lighthouse Instance

    Start by creating an instance with Debian or your preferred operating system. Log into the instance. Download the Arch Linux ISO for booting. Although…

    2026年9月22日
    000
  • VSCode调试FPGA工程的技巧(结合Vivado,快速定位问题)

    vscode在fpga开发中并非替代vivado,而是作为高效辅助工具提升开发效率。1. 在代码编写方面,vscode提供 superior 的语法高亮、自动补全和代码管理功能,显著优化verilog、systemverilog和tcl脚本的编写体验,并通过git实现无缝版本控制;2. 在仿真与自动…

    2026年9月22日
    1200
  • 小米双11正式开启!覆盖全品类 单品最高可省4000元

    10月13日,小米官方宣布“小米双11”大促活动全面启动。此次活动涵盖小米全品类产品,优惠力度空前,部分单品最高直降4000元。 在手机产品线中,小米最新旗舰大折叠屏MIX Fold 4迎来大幅让利,最高降价1000元,最终到手价为7999元。搭载顶级影像系统的旗舰机型小米15 Ultra也下调50…

    2026年9月22日
    400
  • Apache Pulsar 主题分区创建与管理指南

    本文深入探讨Apache Pulsar主题分区的创建与管理。Pulsar主题分区是实现高吞吐量和可伸缩性的关键,但必须在主题创建时进行配置。文章详细介绍了两种主要的分区主题创建方法:通过Broker配置实现自动分区,以及利用Pulsar Admin API进行显式创建,并强调了分区主题一旦创建后不可…

    2026年9月22日
    100
  • 如何查看Linux文件系统类型 df -T与lsblk -f命令对比

    如何查看Linux文件系统类型 df -T与lsblk -f命令对比如何查看Linux文件系统类型 df -T与lsblk -f命令对比如何查看Linux文件系统类型 df -T与lsblk -f命令对比如何查看Linux文件系统类型 df -T与lsblk -f命令对比

    在linux中查看文件系统类型时,df -t 适合查看已挂载分区的文件系统,而 lsblk -f 可查看所有块设备信息。1. df -t 显示已挂载的文件系统类型、磁盘使用情况及挂载点,适用于快速了解当前挂载目录所用文件系统;2. lsblk -f 列出包括未挂载设备的详细信息,如 uuid、lab…

    2026年9月22日 用户投稿
    300
  • 用AI打造沉浸式蝴蝶号无人直播间操作实录

    用AI打造沉浸式蝴蝶号无人直播间操作实录用AI打造沉浸式蝴蝶号无人直播间操作实录用AI打造沉浸式蝴蝶号无人直播间操作实录用AI打造沉浸式蝴蝶号无人直播间操作实录

    用ai做蝴蝶号无人直播间确实可以“无人”,但关键在于流程跑通与细节做好。具体步骤包括:一、准备阶段要配齐账号、素材和工具,明确账号定位,建立丰富素材库,选对ai工具并从垂直领域测试;二、设计脚本时需预设规则匹配,整理常见问题与回答表格导入系统;三、实操上设置定时推流、语音讲解、弹幕监控和自动下播等流…

    2026年9月22日 用户投稿
    1200
  • PowerBI的AI混合工具怎么用?快速创建数据报表的详细操作方法

    PowerBI的AI混合工具通过Q&A、关键影响因素、异常检测和智能叙事等功能,降低数据分析门槛,加速从数据到决策的全过程。它让非技术人员用自然语言提问获取图表,自动识别数据异常与驱动因素,并生成文字解读,大幅提升分析效率。但需以高质量数据和合理建模为基础,结合业务逻辑验证结果,避免“垃圾进…

    2026年9月22日
    600
  • VSCode安装Go语言插件(图文详解,新手避坑指南)

    首先安装Go SDK并配置环境变量,再安装VSCode及Go插件,关键步骤是通过Go: Install/Update Tools命令安装gopls、dlv等核心工具链,确保代码补全、调试等功能正常;若遇问题,需检查Go版本、GOPROXY代理、权限及网络,结合输出面板错误信息定位解决。 配置VSCo…

    2026年9月22日
    400
  • 笔记—Linux安装OpenCV及VSCode的配置编译

    笔记—Linux安装OpenCV及VSCode的配置编译笔记—Linux安装OpenCV及VSCode的配置编译笔记—Linux安装OpenCV及VSCode的配置编译笔记—Linux安装OpenCV及VSCode的配置编译

    在学习新技能的过程中,我选择了在linux系统上进行操作,这对于从未接触过linux的人来说是一个绝佳的学习机会。这篇文章记录了我在linux上安装opencv的过程。 我选择的Linux发行版是Ubuntu 20.04.3,并将其安装在Virtual Box虚拟机中。Ubuntu的相关资料丰富,选…

    2026年9月22日 用户投稿
    100
  • PHP如何执行存储过程_PHP调用mysql存储过程的详细步骤

    PHP调用MySQL存储过程主要通过PDO实现,需先启用PDO扩展并建立数据库连接。1. 使用new PDO()连接MySQL;2. 调用无参存储过程如CALL get_users(),执行后获取结果集;3. 对带输入参数的存储过程使用bindParam绑定参数;4. 处理OUT参数时通过用户变量(…

    2026年9月22日
    000
  • 使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本

    使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本使用Sublime管理MySQL数据库结构_高效编辑表结构与字段定义脚本

    用 sublime text 管理 mysql 数据库结构脚本高效且灵活。1. 适合习惯文本编辑、需自定义流程的开发者;2. 启动快、资源占用低,支持多光标、正则替换,插件丰富,易配合 git;3. 建议每张表单独文件、按模块分目录、主脚本汇总建表语句,索引外键单独文件;4. 推荐插件有 sqlto…

    2026年9月22日 用户投稿
    000
  • 群友不讲武德,编写命令来获取蘑菇积分?

    群友不讲武德,编写命令来获取蘑菇积分?群友不讲武德,编写命令来获取蘑菇积分?群友不讲武德,编写命令来获取蘑菇积分?群友不讲武德,编写命令来获取蘑菇积分?

    大家好,我是陌溪 最近蘑菇不是上线了签到功能嘛,用户每天可以登录蘑菇,然后打卡进行签到。 蘑菇签到 同时,为了考虑到小伙伴们可能会忘记签到,还特意做了补签功能 发放补签卡 每周一只要在蘑菇排行榜的小伙伴,就会发放 1~2 张签到卡 蘑菇排行榜 目前蘑菇排行榜主要是通过积分来进行排序的,为了鼓励大家多…

    2026年9月22日 用户投稿
    400
  • mac怎么清理DNS缓存_mac刷新DNS缓存命令

    刷新DNS缓存可解决网站加载缓慢或显示错误问题。在macOS Sonoma系统中,可通过终端执行“sudo dscacheutil -flushcache; sudo killall -HUP mDNSResponder”命令清理缓存,输入管理员密码后生效;或使用第三方工具如OnyX一键清理,适用于…

    2026年9月22日
    100
  • 机械革命Z系列电脑开机要按F1因BIOS中硬盘参数异常重新设置参数解决

    开机需按F1通常因BIOS设置异常,如硬盘参数错误、软驱启用或CMOS电池没电。进入BIOS检查SATA设备列表,将未连接的设备设为“None”,并关闭软驱选项;若设置混乱,可恢复默认配置(Load Optimized Defaults)并保存退出;若问题仍存,建议更换CMOS电池或检查硬件连接。 …

    2026年9月22日
    200

发表回复

登录后才能评论
关注微信