使用face-api.js在浏览器中实现多目标人脸识别与Svelte集成

使用face-api.js在浏览器中实现多目标人脸识别与Svelte集成

本教程旨在解决使用face-api.js在svelte项目中进行人脸识别时,多个人脸被错误识别为同一人的问题。文章将深入探讨`labeledfacedescriptors`和`facematcher`的正确构建方法,确保每个已知人脸都能被准确识别。通过详细的代码示例和专业指导,读者将学会如何加载模型、初始化摄像头、实时检测并匹配多个人脸,并最终在canvas上绘制识别结果,从而构建一个健壮且高效的浏览器端人脸识别系统。

浏览器端人脸识别:使用face-api.js与Svelte实现多目标精确识别

在现代Web应用中集成人脸识别功能,face-api.js是一个强大且易于使用的JavaScript库。结合Svelte框架,我们可以构建高性能、响应式的用户界面。然而,在实现多目标人脸识别时,开发者会遇到一个常见问题:系统能够检测到多个人脸,但会将所有检测到的人脸错误地识别为同一个已知个体。本教程将深入分析这一问题的原因,并提供一个完善的解决方案,指导您如何正确地构建和使用face-api.js,以实现对多个已知人脸的精确识别。

1. 环境准备与模型加载

首先,确保您的Svelte项目中已安装face-api.js。您可以通过npm或yarn进行安装:

npm install face-api.js# 或 yarn add face-api.js

在Svelte组件中,我们需要导入必要的模块,并定义模型加载的URL。为了在浏览器中运行,通常会从CDN或本地服务器加载模型权重文件。

  import * as faceapi from 'face-api.js';  import { onMount, onDestroy } from 'svelte';  // 假设 $customers 和 $baseURL 是Svelte store,用于管理客户数据和基础URL  import { customers, baseURL } from './stores';   let video;  let detections = [];  let width = 640; // 调整视频和画布宽度  let height = 480; // 调整视频和画布高度  let canvas, ctx;  let container;  let faceMatcher; // 声明 faceMatcher 变量  const detectionOptions = {    withLandmarks: true,    withDescriptors: true,    minConfidence: 0.5,    // 模型URL,建议使用稳定可靠的CDN或自行托管    MODEL_URLS: {      Mobilenetv1Model: "https://raw.githubusercontent.com/ml5js/ml5-data-and-models/main/models/faceapi/ssd_mobilenetv1_model-weights_manifest.json",      FaceLandmarkModel: "https://raw.githubusercontent.com/ml5js/ml5-data-and-models/main/models/faceapi/face_landmark_68_model-weights_manifest.json",      FaceRecognitionModel: "https://raw.githubusercontent.com/ml5js/ml5-data-and-models/main/models/faceapi/face_recognition_model-weights_manifest.json",    },  };  // 组件销毁时清理资源  onDestroy(() => {    if (video) {      video.pause();      if (video.srcObject) {        video.srcObject.getTracks().forEach(track => track.stop());      }      video.remove();    }    if (canvas) {      canvas.remove();    }  });  // 组件挂载时初始化  onMount(() => {    initializeFaceRecognition();  });  export let view_sales_function; // 假设这是一个外部传入的函数

2. 获取视频流与创建画布

为了进行实时人脸识别,我们需要从用户的摄像头获取视频流,并创建一个Canvas元素用于绘制视频帧和识别结果。

  // 辅助函数:获取视频流  async function getVideo() {    const videoElement = document.createElement("video");    videoElement.setAttribute("style", "display: none;"); // 隐藏视频元素,只在canvas上显示    videoElement.width = width;    videoElement.height = height;    container.appendChild(videoElement);    const capture = await navigator.mediaDevices.getUserMedia({ video: true });    videoElement.srcObject = capture;    videoElement.play();    return videoElement;  }  // 辅助函数:创建Canvas  function createCanvas(w, h) {    const canvasElement = document.createElement("canvas");    canvasElement.setAttribute("style", "border-radius: 1rem");    canvasElement.width = w;    canvasElement.height = h;    container.appendChild(canvasElement);    return canvasElement;  }

3. 核心挑战:正确构建 LabeledFaceDescriptors

多目标人脸识别问题的根源在于faceapi.LabeledFaceDescriptors的构建方式。原始代码将所有客户的人脸描述符(descriptors)添加到一个共享的数组中,然后为每个客户都使用这个共享数组创建一个LabeledFaceDescriptors对象,导致所有客户最终都指向了同一个描述符集合,从而使FaceMatcher无法区分不同的人。

正确的做法是:为每个客户创建一个独立的LabeledFaceDescriptors对象,其中包含该客户自己的名称和其人脸描述符数组。

  // 核心函数:获取带标签的人脸描述符集合  async function getLabeledFaceDescriptors() {    console.log("Loading labeled face descriptors...");    const labeledDescriptors = await Promise.all(      $customers.map(async (customer) => {        if (!customer.image_url) {          console.warn(`Customer ${customer.name} has no image_url, skipping.`);          return null;        }        const descriptors = [];        try {          // 从客户图片URL获取图片          const img = await faceapi.fetchImage($baseURL + customer.image_url);          // 检测图片中的单个人脸并提取其描述符          const faceDetection = await faceapi            .detectSingleFace(img)            .withFaceLandmarks()            .withFaceDescriptor();          if (faceDetection && faceDetection.descriptor) {            descriptors.push(faceDetection.descriptor);            console.log(`Successfully processed image for ${customer.name}`);          } else {            console.warn(`No face detected in image for ${customer.name} or descriptor missing.`);          }        } catch (error) {          console.error(`Error processing image for ${customer.name}:`, error);        }        if (descriptors.length > 0) {          // 为当前客户创建一个 LabeledFaceDescriptors 对象          // 包含客户姓名和其对应的人脸描述符数组          return new faceapi.LabeledFaceDescriptors(customer.name, descriptors);        } else {          return null; // 如果没有获取到描述符,则返回 null        }      })    );    // 过滤掉未能成功获取描述符的客户    return labeledDescriptors.filter(d => d !== null);  }

4. 初始化模型与人脸匹配器

在模型加载完成后,我们需要调用getLabeledFaceDescriptors来准备已知人脸数据,并使用这些数据初始化faceapi.FaceMatcher。FaceMatcher将用于在实时视频流中识别人脸。

  // 初始化函数  async function initializeFaceRecognition() {    video = await getVideo();    canvas = createCanvas(width, height);    ctx = canvas.getContext("2d");    // 并行加载所有必要的模型    await Promise.all([      faceapi.nets.ssdMobilenetv1.loadFromUri(detectionOptions.MODEL_URLS.Mobilenetv1Model),      faceapi.nets.faceRecognitionNet.loadFromUri(detectionOptions.MODEL_URLS.FaceRecognitionModel),      faceapi.nets.faceLandmark68Net.loadFromUri(detectionOptions.MODEL_URLS.FaceLandmarkModel),    ]);    console.log("Face-API.js models loaded.");    // 获取并过滤出有效的带标签人脸描述符    const labeledFaceDescriptors = await getLabeledFaceDescriptors();    if (labeledFaceDescriptors.length === 0) {      console.warn("No valid labeled face descriptors found. Recognition will only identify 'Unknown'.");    }    // 初始化人脸匹配器,设置匹配距离阈值(0.6是常用值,可根据需求调整)    faceMatcher = new faceapi.FaceMatcher(labeledFaceDescriptors, 0.6);    console.log("FaceMatcher initialized.");    // 开始实时检测    startDetectionLoop();  }

5. 实时人脸检测与识别循环

通过setInterval函数,我们可以周期性地从视频流中检测所有人脸,并使用faceMatcher进行匹配。

  // 启动检测循环  function startDetectionLoop() {    const displaySize = { width: video.width, height: video.height };    setInterval(async () => {      // 检测视频流中的所有人脸,并提取地标和描述符      detections = await faceapi        .detectAllFaces(video)        .withFaceLandmarks()        .withFaceDescriptors();      // 将检测结果按显示尺寸进行调整      detections = faceapi.resizeResults(detections, displaySize);      // 对每个检测到的人脸,使用 faceMatcher 找到最佳匹配      const results = detections.

以上就是使用face-api.js在浏览器中实现多目标人脸识别与Svelte集成的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/1531160.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
解决 npm-remote-ls 依赖缺失问题:版本差异的洞察与实践
上一篇 2025年12月20日 22:37:10
在JavaScript数组循环中高效比较当前与前一个元素的ID
下一篇 2025年12月20日 22:37:20

相关推荐

  • 表单数据验证与过滤的最佳实践

    我们需要重视表单数据的验证和过滤,以确保应用的安全性和数据的完整性。1) 结合使用客户端和服务器端验证,客户端提供即时反馈,服务器端确保数据安全。2) 验证不同类型的数据,如字符串、数字、日期,确保格式和业务逻辑正确。3) 处理错误时提供友好的错误信息,并防止泄露敏感信息。4) 使用适当的函数过滤数…

    2026年8月26日
    000
  • 抖音星图任务赚钱是真的吗?巨量星图是骗了多少人

    随着抖音的持续火热,越来越多用户开始关注“抖音星图任务赚钱”这一话题。有人声称这是轻松变现的好机会,也有人质疑其真实性,甚至认为是骗局。那么,抖音星图任务到底能不能赚钱?今天我们就来深入剖析这个问题。 一、什么是抖音星图任务赚钱? 抖音星图任务赚钱,指的是通过参与抖音官方推出的“巨量星图”平台发布的…

    2026年8月26日
    300
  • 怎么进入路由器设置界面_浏览器登录路由器管理后台教程

    进入路由器设置界面,说白了就是通过浏览器访问路由器的管理后台。一般情况下,在浏览器地址栏输入路由器背面贴纸上的地址(通常是192.168.1.1或192.168.0.1),然后输入用户名和密码就能进去了。但实际操作中,可能会遇到各种小问题,下面就详细说说。 解决方案 确认路由器已连接: 确保你的电脑…

    2026年8月26日
    000
  • Java中静态方法能重写吗 分析Java静态方法隐藏现象的本质

    Java中静态方法能重写吗 分析Java静态方法隐藏现象的本质Java中静态方法能重写吗 分析Java静态方法隐藏现象的本质Java中静态方法能重写吗 分析Java静态方法隐藏现象的本质Java中静态方法能重写吗 分析Java静态方法隐藏现象的本质

    java中的静态方法不能被重写,但可以被隐藏,这是因为在编译时根据引用类型决定调用哪个类的静态方法。1. 静态方法属于类而非实例,因此它们在编译时绑定;2. 子类定义与父类相同的静态方法会隐藏父类方法,而不是实现多态;3. 调用时依据引用类型而非对象实际类型,导致parent.printmessag…

    2026年8月26日 用户投稿
    200
  • 第三方登录(微信、QQ等)集成方法

    集成第三方登录是为了简化用户注册和登录流程,提高用户体验和安全性。具体步骤包括:1)了解oauth 2.0协议;2)在应用中添加第三方登录入口;3)处理授权码和访问令牌;4)获取用户信息;5)处理常见问题和优化性能。 集成第三方登录(如微信、QQ等)是现代应用开发中常见的需求。为什么要集成第三方登录…

    2026年8月26日
    100
  • 如何使用guzzlehttp/promises优雅地解决PHP中的异步操作与并发难题

    Composer在线学习地址:[学习地址](https://pan.quark.cn/s/371f7205c512] 最近在开发一个电商后台服务时,我遇到了一个典型的性能瓶颈。我们的系统需要在一个请求中,同时从用户服务获取用户信息、从商品服务获取商品详情、再从库存服务查询库存量,最终整合数据后返回。…

    用户投稿 2026年8月26日
    000
  • “AI+科研”,科研范式革命真的来了?

    ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ AlphaFold2的问世,预示着算法驱动科研的时代已经到来。AI智能体日夜不息地运行,优化药物分子结构,分析海量数据,甚至自动生成研究报告,这不再是科幻小说中的场景。 “AI+科研”模式的兴起…

    2026年8月26日
    200
  • 如何在iPhone上有效跟踪航班

    一、使用系统自带功能:地图与Siri iPhone内置的地图应用(Apple Maps)不仅能导航,还能快速查询航班动态。你只需在搜索栏输入航班编号,或出发地与目的地机场名称,即可获取该航班的实时状态,例如预计起飞和到达时间、延误情况等。此外,通过语音助手Siri,只需说一句“帮我追踪我的航班”,系…

    2026年8月26日
    200
  • Java中远程调试的作用 解析attach机制

    Java中远程调试的作用 解析attach机制Java中远程调试的作用 解析attach机制Java中远程调试的作用 解析attach机制Java中远程调试的作用 解析attach机制

    远程调试java应用的核心在于通过jvm参数或attach机制实现本地ide对远端程序的调试。配置时需添加jdwp参数如-agentlib:jdwp=transport=dt_socket,server=y,suspend=n,address=5005,或运行时使用jdb、visualvm等工具at…

    2026年8月26日 用户投稿
    000
  • 如何举报谷歌邮箱里的诈骗_谷歌邮箱诈骗邮件举报步骤

    首先立即通过Gmail内置功能举报诈骗邮件,点击“报告垃圾邮件”或“举报为钓鱼式攻击”;其次将完整邮件转发至phishing@report.google.com纳入全球反欺诈库;最后同步向国家反诈中心官网或APP提交举报,上传截图并填写发件人、主题等信息,协助执法阻断诈骗链。 如果您在谷歌邮箱(Gm…

    2026年8月26日
    000
  • 如何在PHP中优雅处理异步操作?GuzzlePromises助你告别回调地狱!

    可以通过一下地址学习composer:学习地址 在日常的 php 开发中,我们经常会遇到这样的场景:需要从多个外部服务获取数据,或者执行一系列相互依赖但又耗时的操作。比如,你正在开发一个聚合新闻的平台,需要同时从 cnn、bbc 和 reuters 的 api 获取最新头条,然后将它们合并展示给用户…

    用户投稿 2026年8月26日
    000
  • 如何优雅地抓取网页数据?simplehtmldom助你轻松搞定

    可以通过一下地址学习composer:学习地址 在日常的web开发中,我们常常会遇到一个令人头疼的需求:从外部网站提取特定信息。比如,你需要构建一个比价工具来抓取不同电商平台的商品价格,或者开发一个内容聚合器来收集各大新闻网站的头条。 面对这些任务,你可能会尝试各种方法。如果HTML结构简单,也许几…

    用户投稿 2026年8月26日
    000
  • 曝阿维塔将自研下一代智能座舱 正在扩张研发团队

    阿维塔加码智能座舱自研,剑指下一代车型 据汽车像素报道,阿维塔正大力扩充其智能座舱研发团队,团队规模已近280人,并持续招聘研发、产品管理和测试等岗位人员。此举表明阿维塔将在智能座舱领域加大自研力度。 目前,阿维塔11、12、07以及即将上市的06车型均搭载华为鸿蒙座舱系统。然而,阿维塔计划从202…

    2026年8月26日
    100
  • 2025中国品牌多联机市场:海尔物联多联机占据第一份额

    在中央空调领域,多联机市场占比已超一半,成为各大品牌争夺的核心战场。 8月4日,《2025中国中央空调行业半年报》正式发布。报告显示,物联多联机市场竞争日趋激烈,大金以23.7%的市场份额领跑全行业,海尔紧随其后,占比达23.5%,两者差距微乎其微,共同构筑起“双巨头”竞争格局。 这一格局的形成并非…

    2026年8月26日
    100
  • 你管这玩意叫双系统?直接在 Windows 上体验 Linux

    你管这玩意叫双系统?直接在 Windows 上体验 Linux你管这玩意叫双系统?直接在 Windows 上体验 Linux你管这玩意叫双系统?直接在 Windows 上体验 Linux你管这玩意叫双系统?直接在 Windows 上体验 Linux

    现在可以在windows上体验linux的gui了,酷不酷?这绝对是酷毙了! 原来是Windows官方推出的Linux子系统(WSL)终于支持了Linux GUI!这意味着你可以直接在Windows系统中运行你喜欢的GUI编辑器和工具,来开发和测试Linux应用程序。曾经多少Linux爱好者的梦想—…

    2026年8月26日 用户投稿
    200
  • 如何实现热更新(代码无需重启服务)?

    热更新可以通过多种方式在不同编程环境中实现。1)在java中,使用java agent和instrumentation api可以动态修改类文件。2)在javascript中,通过webpack和parcel的模块热替换(hmr)实现热更新。3)在python中,使用importlib动态加载和更新…

    2026年8月26日
    000
  • java中的mapper是什么 mapper在数据访问层的角色

    java中的mapper是一种用于数据转换的设计模式。在数据访问层中,mapper的角色是将数据库数据映射到java对象,并封装数据访问逻辑。通过orm框架如mybatis或hibernate,mapper简化了数据访问,提高了代码的可读性和可维护性,但需注意避免过度依赖orm框架和接口设计的复杂性…

    2026年8月26日
    100
  • 政策铺路 一线城市领跑自动驾驶赛道

    ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 自动驾驶作为人工智能在汽车行业的典型应用,是数字经济与实体经济深度融合的新兴领域,也是发展新质生产力的关键。 随着技术成熟,越来越多的城市开放自动驾驶示范应用,北京、上海、深圳等一线城市正构建起…

    2026年8月26日
    000
  • 如何将163邮箱换绑手机号

    在使用163邮箱时,可能会遇到需要更换绑定手机号的情况。例如原手机号已停用,或出于账户安全的考虑,都需要及时更新绑定信息。那么,如何正确完成163邮箱手机号的更换操作呢?接下来将为你一步步说明具体流程。 第一步,打开浏览器并登录你的163邮箱账号。成功进入邮箱主界面后,点击顶部导航栏中的“设置”按钮…

    2026年8月26日
    000
  • 抖店关店公示怎么写?抖音小店关店公示的添加模块怎么填写

    随着互联网的飞速发展,抖音小店成为了越来越多人的创业选择。由于各种原因,有些抖店可能会面临关店的风险。当你的抖店需要关店时,应该如何撰写一份合格的关店公示呢?本文将为你详细解答。 一、抖店关店公示的重要性 抖店关店公示是商家对消费者负责的表现,也是遵守相关法律法规的体现。一份详细的关店公示,可以: …

    2026年8月26日
    100

发表回复

登录后才能评论
关注微信