Web 端实时防挡脸弹幕（基于机器学习）

程序猿 • 2025年12月1日 20:20:56 • 用户投稿 • 阅读 1

防挡脸弹幕，即大量弹幕飘过，但不会遮挡视频画面中的人物，看起来像是从人物背后飘过去的。

机器学习已经火了好几年了，但很多人都不知道浏览器中也能运行这些能力；

本文介绍在视频弹幕方面的实践优化过程，文末列举了一些本方案可适用的场景，期望能开启一些脑洞。

mediapipe Demo（https://google.github.io/mediapipe/）展示

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

主流防挡脸弹幕实现原理

点播

up 上传视频

服务器后台计算提取视频画面中的人像区域，转换成 svg 存储

客户端播放视频的同时，从服务器下载 svg 与弹幕合成，人像区域不显示弹幕

直播

主播推流时，实时（主播设备）从画面提取人像区域，转换成 svg将 svg 数据合并到视频流中（SEI），推流至服务器客户端播放视频同时，从视频流中（SEI）解析出 svg将 svg 与弹幕合成，人像区域不显示弹幕

本文实现方案

客户端播放视频同时，实时从画面提取人像区域信息，将人像区域信息导出成图片与弹幕合成，人像区域不显示弹幕。

实现原理

采用机器学习开源库从视频画面实时提取人像轮廓，如Body Segmentation（https://github.com/tensorflow/tfjs-models/blob/master/body-segmentation/README.md）将人像轮廓转导出为图片，设置弹幕层的 mask-image（https://developer.mozilla.org/zh-CN/docs/Web/CSS/mask-image）

对比传统（直播SEI实时）方案

优点：

易于实现；只需要Video标签一个参数，无需多端协同配合无网络带宽消耗

缺点：

理论性能极限劣于传统方案；相当于性能资源换网络资源

面临的问题

众所周知，JavaScript 的性能较差，因此不适合用于处理 CPU 密集型任务。由官方demo变成工程实践，最大的挑战就是——性能。

本次实践最终将 CPU 占用优化到 5% 左右（2020 M1 Macbook），达到生产可用状态。

实践调优过程

选择机器学习模型

BodyPix （https://github.com/tensorflow/tfjs-models/blob/master/body-segmentation/src/body_pix/README.md）

精确度太差，面部偏窄，有很明显的弹幕与人物面部边缘重叠现象

BlazePose（https://github.com/tensorflow/tfjs-models/blob/master/pose-detection/src/blazepose_mediapipe/README.md）

精确度优秀，且提供了肢体点位信息，但性能较差

返回数据结构示例

[{score: 0.8,keypoints: [{x: 230, y: 220, score: 0.9, score: 0.99, name: "nose"},{x: 212, y: 190, score: 0.8, score: 0.91, name: "left_eye"},...],keypoints3D: [{x: 0.65, y: 0.11, z: 0.05, score: 0.99, name: "nose"},...],segmentation: {maskValueToLabel: (maskValue: number) => { return 'person' },mask: {toCanvasImageSource(): ...toImageData(): ...toTensor(): ...getUnderlyingType(): ...}}}]

MediaPipe SelfieSegmentation （https://github.com/tensorflow/tfjs-models/blob/master/body-segmentation/src/selfie_segmentation_mediapipe/README.md）

精确度优秀（跟 BlazePose 模型效果一致），CPU 占用相对 BlazePose 模型降低 15% 左右，性能取胜，但返回数据中不提供肢体点位信息

返回数据结构示例

{maskValueToLabel: (maskValue: number) => { return 'person' },mask: {toCanvasImageSource(): ...toImageData(): ...toTensor(): ...getUnderlyingType(): ...}}

初版实现

参考 MediaPipe SelfieSegmentation 模型官方实现（https://github.com/tensorflow/tfjs-models/blob/master/body-segmentation/README.md#bodysegmentationdrawmask），未做优化的情况下 CPU 占用 70% 左右

const canvas = document.createElement('canvas')canvas.width = videoEl.videoWidthcanvas.height = videoEl.videoHeightasync function detect (): Promise {const segmentation = await segmenter.segmentPeople(videoEl)const foregroundColor = { r: 0, g: 0, b: 0, a: 0 }const backgroundColor = { r: 0, g: 0, b: 0, a: 255 } const mask = await toBinaryMask(segmentation, foregroundColor, backgroundColor) await drawMask(canvas, canvas, mask, 1, 9)// 导出Mask图片，需要的是轮廓，图片质量设为最低handler(canvas.toDataURL('image/png', 0)) window.setTimeout(detect, 33)} detect().catch(console.error)

降低提取频率，平衡性能-体验

一般视频 30FPS，尝试弹幕遮罩（后称 Mask）刷新频率降为 15FPS，体验上还能接受

window.setTimeout(detect, 66) // 33 => 66

此时，CPU 占用 50% 左右

解决性能瓶颈

分析火焰图可发现，性能瓶颈在 toBinaryMask 和 toDataURL

Remove.bg

AI在线抠图软件，图片去除背景

174 查看详情

重写toBinaryMask

分析源码，结合打印segmentation的信息，发现segmentation.mask.toCanvasImageSource可获取原始ImageBitmap对象，即是模型提取出来的信息。尝试自己编写代码，将ImageBitmap转换为遮罩（Mask），以代替使用开源库所提供的默认实现。

实现原理

async function detect (): Promise {const segmentation = await segmenter.segmentPeople(videoEl) context.clearRect(0, 0, canvas.width, canvas.height)// 1. 将`ImageBitmap`绘制到 Canvas 上context.drawImage(// 经验证 即使出现多人，也只有一个 segmentationawait segmentation[0].mask.toCanvasImageSource(),0, 0,canvas.width, canvas.height)// 2. 设置混合模式context.globalCompositeOperation = 'source-out'// 3. 反向填充黑色context.fillRect(0, 0, canvas.width, canvas.height)// 导出Mask图片，需要的是轮廓，图片质量设为最低handler(canvas.toDataURL('image/png', 0)) window.setTimeout(detect, 66)}

第 2、3 步相当于给人像区域外的内容填充黑色（反向填充ImageBitmap），是为了配合css（mask-image），不然只有当弹幕飘到人像区域才可见（与目标效果正好相反）。

globalCompositeOperation MDN（https://developer.mozilla.org/zh-CN/docs/Web/API/CanvasRenderingContext2D/globalCompositeOperation）

此时，CPU 占用 33% 左右

多线程优化

我原先认为toDataURL是由浏览器内部实现的，无法再进行优化，现在只有优化toDataURL这个耗时操作了。

虽没有替换实现，但可使用 OffscreenCanvas （https://developer.mozilla.org/zh-CN/docs/Web/API/OffscreenCanvas）+ Worker，将耗时任务转移到 Worker 中去，避免占用主线程，就不会影响用户体验了。

并且ImageBitmap实现了Transferable接口，可被转移所有权，跨 Worker 传递也没有性能损耗（https://hughfenghen.github.io/fe-basic-course/js-concurrent.html#%E4%B8%A4%E4%B8%AA%E6%96%B9%E6%B3%95%E5%AF%B9%E6%AF%94）。

// 前文 detect 的反向填充 ImageBitmap 也可以转移到 Worker 中// 用 OffscreenCanvas 实现， 此处略过 const reader = new FileReaderSync()// OffscreenCanvas 不支持 toDataURL，使用 convertToBlob 代替offsecreenCvsEl.convertToBlob({type: 'image/png',quality: 0}).then((blob) => {const dataURL = reader.readAsDataURL(blob)self.postMessage({msgType: 'mask',val: dataURL})}).catch(console.error)

可以看到两个耗时的操作消失了

此时，CPU 占用 15% 左右

降低分辨率

继续分析，上图重新计算样式（紫色部分）耗时约 3ms

Demo 足够简单很容易推测到是这行代码导致的，发现 imgStr 大概 100kb 左右（视频分辨率 1280×720）。

danmakuContainer.style.webkitMaskImage = `url(${imgStr})

通过canvas缩小图片尺寸（360P甚至更低），再进行推理。

优化后，导出的 imgStr 大概 12kb，重新计算样式耗时约 0.5ms。

此时，CPU 占用 5% 左右

启动条件优化

虽然提取 Mask 整个过程的 CPU 占用已优化到可喜程度。

当在画面没人的时候，或没有弹幕时候，可以停止计算，实现 0 CPU 占用。

无弹幕判断比较简单（比如 10s 内收超过两条弹幕则启动计算），也不在该 SDK 实现范围，略过

判定画面是否有人

第一步中为了高性能，选择的模型只有ImageBitmap，并没有提供肢体点位信息，所以只能使用getImageData返回的像素点值来判断画面是否有人。

画面无人时，CPU 占用接近 0%

发布构建优化

依赖包的提交较大，构建出的 bundle 体积：684.75 KiB / gzip: 125.83 KiB

所以，可以进行异步加载SDK，提升页面加载性能。

分别打包一个 loader，一个主体由业务方 import loader，首次启用时异步加载主体

这个两步前端工程已经非常成熟了，略过细节。

运行效果

总结

过程

选择高性能模型后，初始状态 CPU 70%降低 Mask 刷新频率（15FPS），CPU 50%重写开源库实现（toBinaryMask），CPU 33%多线程优化，CPU 15%降低分辨率，CPU 5%判断画面是否有人，无人时 CPU 接近 0%

CPU 数值指主线程占用

注意事项

兼容性：Chrome 79及以上，不支持 Firefox、Safari。因为使用了OffscreenCanvas不应创建多个或多次创建segmenter实例（bodySegmentation.createSegmenter），如需复用请保存实例引用，因为：创建实例时低性能设备会有明显的卡顿现象会内存泄露；如果无法避免，这是mediapipe 内存泄露解决方法（https://github.com/google/mediapipe/issues/2819#issuecomment-1160335349）

经验

优化完成之后，提取并应用 Mask 关键计算量在 GPU (30%左右)，而不是 CPU性能优化需要业务场景分析，防挡弹幕场景可以使用低分辨率、低刷新率的 mask-image，能大幅减少计算量该方案其他应用场景：替换/模糊人物背景人像马赛克人像抠图卡通头套，虚拟饰品，如猫耳朵、兔耳朵、带花、戴眼镜什么的（换一个模型，略改）关注Web 神经网络 API （https://mp.weixin.qq.com/s/v7-xwYJqOfFDIAvwIVZVdg）进展，以后实现相关功能也许会更简单

本期作者

刘俊

哔哩哔哩资深开发工程师

以上就是Web 端实时防挡脸弹幕（基于机器学习）的详细内容，更多请关注创想鸟其它相关文章！

版权声明：本文内容由互联网用户自发贡献，该文观点仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容，请发送邮件至 chuangxiangniao@163.com 举报，一经查实，本站将立刻删除。
发布者：程序猿，转转请注明出处：https://www.chuangxiangniao.com/p/975482.html

打赏

微信扫一扫

支付宝扫一扫

0 0

关于作者

程序猿签约作者

414.1K 文章

0 评论

2 粉丝

这个人很懒，什么都没有留下～

电脑音频故障排查与解决方案

上一篇 2025年12月1日 20:20:55

Java学习入门指南

下一篇 2025年12月1日 20:20:59

好文分享

css中的浏览器私有化前缀有哪些

css中的浏览器私有化前缀有：1、谷歌浏览器和苹果浏览器【-webkit-】；2、火狐浏览器【-moz-】；3、IE浏览器【-ms-】；4、欧朋浏览器【-o-】。浏览器私有化前缀有如下几个：（学习视频分享：css视频教程） -webkit-：谷歌苹果 background:-webkit-li…

程序猿
2025年12月24日
4000
好文分享

如何利用css改变浏览器滚动条样式

注意：该方法只适用于 -webkit- 内核浏览器滚动条外观由两部分组成： 1、滚动条整体滑轨 2、滚动条滑轨内滑块在CSS中滚动条由3部分组成立即学习“前端免费学习笔记（深入）”； name::-webkit-scrollbar //滚动条整体样式name::-webkit-scrollba…

程序猿
2025年12月24日
1000
css如何解决不同浏览器下文本兼容的问题

目标： css实现不同浏览器下兼容文本两端对齐。在 form 表单的前端布局中，我们经常需要将文本框的提示文本两端对齐，例如：解决过程：立即学习“前端免费学习笔记（深入）”； 1、首先想到是能不能直接靠 css 解决问题 css .test-justify { text-align: just…

程序猿
2025年12月24日 • 好文分享
3000
纯css实现加号一个的效果（代码示例）

本篇文章给大家带来的内容是关于纯css实现加号一个的效果（代码示例），有一定的参考价值，有需要的朋友可以参考一下，希望对你有所帮助。实现下图的加号效果：若想实现这个效果，只需一个p元素即可搞定。需要用到css的为了before和after，以及border特性。先设置一个div便签立即…

程序猿
2025年12月24日 • 好文分享
0000
关于jQuery浏览器CSS3特写兼容的介绍

这篇文章主要介绍了jquery浏览器css3特写兼容的方法,实例分析了jquery兼容浏览器的使用技巧,需要的朋友可以参考下本文实例讲述了jQuery浏览器CSS3特写兼容的方法。分享给大家供大家参考。具体分析如下： CSS3充分吸收多年了web发展的需求，吸收了很多新颖的特性。例如border-…

程序猿
好文分享 2025年12月24日
0000
360浏览器兼容模式的页面显示不全怎么处理

这次给大家带来360浏览器兼容模式的页面显示不全怎么处理，处理360浏览器兼容模式页面显示不全的注意事项有哪些，下面就是实战案例，一起来看一下。　由于众所周知的情况，国内的主流浏览器都是双核浏览器：基于Webkit内核用于常用网站的高速浏览。基于IE的内核用于兼容网银、旧版网站。以360的几款浏览…

程序猿
好文分享 2025年12月24日
2000
如何解决css对浏览器兼容性问题总结

css对浏览器的兼容性有时让人很头疼,或许当你了解当中的技巧跟原理,就会觉得也不是难事,从网上收集了ie7,6与fireofx的兼容性处理方法并整理了一下.对于web2.0的过度,请尽量用xhtml格式写代码,而且doctype 影响 css 处理,作为w3c的标准,一定要加 doctype声名.…

程序猿
好文分享 2025年12月23日
1000
关于CSS3中选择符的实例详解

英文原文： www.456bereastreet.com/archive/200601/css_3_selectors_explained/中文翻译： www.dudo.org/article.asp?id=197注：本文写于2006年1月，当时IE7、IE8和Firefox3还未发行，文中所有说的…

程序猿
好文分享 2025年12月23日
1000
阐述什么是CSS3？

网页制作Webjx文章简介：CSS3不是新事物，更不是只是围绕border-radius属性实现的圆角。它正耐心的坐在那里，已经准备好了首次登场，呷着咖啡，等着浏览器来铺上红地毯。 CSS3不是新事物，更不是只是围绕border-radius属性实现 …

程序猿
好文分享 2025年12月23日
1000
用CSS hack技术解决浏览器兼容性问题

什么是CSS Hack？　　不同的浏览器对CSS的解析结果是不同的，因此会导致相同的CSS输出的页面效果不同，这就需要CSS Hack来解决浏览器局部的兼容性问题。而这个针对不同的浏览器写不同的CSS 代码的过程，就叫CSS Hack。 CSS Hack 形式　　CSS Hack大致有3种表现形…

程序猿
好文分享 2025年12月23日
1000
如何使用css去除浏览器对表单赋予的默认样式

我们在写表单的时候会发现一些浏览器对表单赋予了默认的样式，如在chorme浏览器下，文本框及下拉选择框当载入焦点时，都会出现发光的边框，并且在火狐及谷歌浏览器下，多行文本框textarea还可以自由拖拽拉大，另外还有在ie10下，当文本框输入内容后，在文本框的右侧会出现一个小叉叉，等等。不容置疑，这…

程序猿
好文分享 2025年12月23日
0000
好文分享

jimdo能否添加html5弹窗_jimdo弹窗html5代码实现与触发条件【技巧】

可在Jimdo实现HTML5弹窗的四种方法：一、用内置“弹窗链接”模块；二、通过HTML区块注入精简dialog结构（需配合内联CSS）；三、外部托管HTML+iframe嵌入；四、纯CSS :target伪类无JS方案。如果您希望在Jimdo网站中实现HTML5弹窗效果，但发现平台默认不支持直接…

程序猿
2025年12月23日
1000
好文分享

jimdo如何添加html5表单_jimdo表单html5代码嵌入与字段设置【实操】

可通过嵌入HTML5表单代码、启用字段验证属性、添加CSS样式反馈及替换提交按钮并绑定JS事件四种方式在Jimdo实现自定义表单行为。如果您在 Jimdo 网站中需要自定义表单行为或字段逻辑，而内置表单编辑器无法满足需求，则可通过嵌入 HTML5 表单代码实现更灵活的控制。以下是具体操作步骤：一…

程序猿
2025年12月23日
1000
好文分享

html如何调整_调整HTML元素大小与样式属性【大小】

可通过CSS样式属性调整HTML元素尺寸与外观：一、内联style设宽高；二、class类名调用外部CSS；三、box-sizing控制盒模型；四、相对单位实现响应式；五、transform缩放视觉尺寸。如果您需要修改网页中某个HTML元素的尺寸或外观，可以通过CSS样式属性直接控制其宽度、高度、…

程序猿
2025年12月23日
0000
好文分享

html5能否禁用搜索框自动填充_html5autocomplete关闭方法【教程】

禁用HTML5搜索框自动填充有五种方法：一、设autocomplete=”off”；二、随机化name/id值；三、用无效autocomplete值如”nope”；四、JS动态设置autocomplete；五、设autocomplete=”…

程序猿
2025年12月23日
1000
好文分享

html5怎么导视频_html5用video标签导出或Canvas转DataURL获视频【导出】

HTML5无法直接导出video标签内容，需借助Canvas捕获帧并结合MediaRecorder API、FFmpeg.wasm或服务端协同实现。MediaRecorder适用于WebM格式前端录制；FFmpeg.wasm支持MP4等格式及精细编码控制；服务端方案适合高负载场景。如果您希望在网页…

程序猿
2025年12月23日
4000
好文分享

html5怎么设置单选_html5用input type=”radio”加name设单选按钮组【设置】

HTML5 使用 type=”radio” 实现单选功能，需统一 name 值构成互斥组；通过 checked 设默认项；可用 CSS 隐藏原生控件并自定义样式；推荐用 fieldset/legend 增强语义；required 可实现必填验证。如果您希望在网页中创建一组互…

程序猿
2025年12月23日
3000
好文分享

如何将内容居中html_将HTML页面内容整体居中【整体】

HTML页面整体居中可通过四种CSS方法实现：一、Flexbox设display: flex; justify-content/align-items: center; height: 100vh；二、绝对定位加transform: translate(-50%,-50%)；三、Grid设displ…

程序猿
2025年12月23日
0000
好文分享

node.js怎么运行html_node.js运行html步骤【指南】

答案是使用Node.js内置http模块、Express框架或第三方工具serve可快速搭建服务器预览HTML文件。首先通过http模块创建服务器并读取index.html返回响应；其次用Express初始化项目并配置静态文件服务；最后利用serve工具全局安装后一键启动服务器，三种方式均在浏览器访…

程序猿
2025年12月23日
4000
好文分享

html5能否插入带表单的文档_html5表单文档嵌入与数据提交【步骤】

HTML5中无法直接嵌入外部带表单的HTML文档并原生提交；可行方案有四：一、用iframe嵌入，需同源或CORS支持，并用postMessage通信；二、用fetch+DOMParser动态加载表单片段并手动绑定事件；三、在当前页面直接编写表单，最规范且兼容性好；四、用JavaScript+fet…

程序猿
2025年12月23日
1000