fig

  • 全自动打工「人」!波士顿动力Atlas进厂视频火了,不断电不下班

    全自动打工「人」!波士顿动力Atlas进厂视频火了,不断电不下班全自动打工「人」!波士顿动力Atlas进厂视频火了,不断电不下班全自动打工「人」!波士顿动力Atlas进厂视频火了,不断电不下班全自动打工「人」!波士顿动力Atlas进厂视频火了,不断电不下班

    波士顿动力atlas进厂打工,不靠远程操控,转身动作像惊悚电影。 波士顿动力的人形机器人,进厂了。 本周三,波士顿动力发来一条喜讯。其最新披露的视频展示了机器人在工厂环境中的任务完成能力。机器人现在已经可以全自动干活了,它可以在储物柜之间搬动汽车发动机零件: ☞☞☞AI 智能聊天, 问答助手, AI…

    2025年11月7日 用户投稿
    200
  • 基于paddlehub2.4.0: 让动态视频生成漫画书!【一键运行】

    基于paddlehub2.4.0: 让动态视频生成漫画书!【一键运行】基于paddlehub2.4.0: 让动态视频生成漫画书!【一键运行】基于paddlehub2.4.0: 让动态视频生成漫画书!【一键运行】基于paddlehub2.4.0: 让动态视频生成漫画书!【一键运行】

    该项目基于PaddleHub2.4.0,实现动态视频转漫画书功能。以人民美术出版社版《水浒传》连环画为风格学习数据,借助其预训练模型,通过安装依赖、处理数据、图片转漫画、视频关键帧转漫画等步骤,抽取视频关键帧并转为漫画风格,为视频创作提供新形式,展现了AI在文化创意领域的潜力。 ☞☞☞AI 智能聊天…

    2025年11月6日 用户投稿
    100
  • 【AI达人特训营第三期】时频图分类项目

    【AI达人特训营第三期】时频图分类项目【AI达人特训营第三期】时频图分类项目【AI达人特训营第三期】时频图分类项目【AI达人特训营第三期】时频图分类项目

    本项目基于ResNet50,将其BottleneckBlock模块中conv2特征层的标准卷积替换为DCN可变性卷积,构建ResNet50-DCN模型,用于科大讯飞24类语音时序图谱分类。使用2143条训练样本、429条验证样本训练,90轮后验证集最高准确率79%,未深入调优,有提升空间,还包含数据…

    2025年11月6日 用户投稿
    000
  • 点云生成:基于Paddle2.0实现WGAN-GP在点云上的一些尝试

    本文尝试在点云上应用WGAN-GP,判别器借鉴PointNet结构,生成器为自定义搭建。使用ModelNet40数据集,取1024个点训练。定义了FeatureNet、UFeatureNet等网络,通过Adam优化器训练,每2轮可视化生成结果,20轮保存模型,目前可运行但效果待提升。 ☞☞☞AI 智…

    2025年11月6日
    000
  • 【AI达人特训营第三期】Conv2Former:一种ViT风格的卷积模块

    【AI达人特训营第三期】Conv2Former:一种ViT风格的卷积模块【AI达人特训营第三期】Conv2Former:一种ViT风格的卷积模块【AI达人特训营第三期】Conv2Former:一种ViT风格的卷积模块【AI达人特训营第三期】Conv2Former:一种ViT风格的卷积模块

    本文复现了Conv2Former模型,其采用Transformer风格的QKV结构,以卷积生成权重加权,平衡全局信息提取与计算开销。在CIFAR-10数据集上,用Conv2Former-N参数({64,128,256,512}维度,{2,2,8,2}深度)训练50个epoch,验证集准确率达82%,…

    2025年11月6日 用户投稿
    200
  • 论文解读一篇关于语义生成论文(要求控制单独语义生成)

    论文解读一篇关于语义生成论文(要求控制单独语义生成)论文解读一篇关于语义生成论文(要求控制单独语义生成)论文解读一篇关于语义生成论文(要求控制单独语义生成)论文解读一篇关于语义生成论文(要求控制单独语义生成)

    本文聚焦语义多模态图像合成(SMIS)任务,旨在通过特定类控制器调整对应区域生成图像,且不影响其他部分。针对现有方法局限,提出GroupDNet,利用组卷积并逐步减少解码器组数,提升可控性与生成质量。实验表明其优越性,还能支持多种合成应用。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费…

    2025年11月6日 用户投稿
    100
  • 轻量级人像分割模型:SINet 和 ExtremeC3Net

    本文介绍SINet和ExtremeC3Net两个轻量级人像分割模型,二者参数分别为0.087M、0.038M,Flop为0.064G、0.128G。可通过PaddleHub快速调用,也能基于PaddleInference推理部署,并给出了Paddle2.0上的实现代码。 ☞☞☞AI 智能聊天, 问答…

    2025年11月6日
    100
  • 【PaddlePaddle】基础理论教程 – 卷积神经网络概论

    本文围绕二维卷积及卷积神经网络展开,先讲解二维卷积运算的概念、原理及Paddle框架实现,介绍卷积算子的定义、参数。还阐述卷积神经网络的卷积层、汇聚层算子,最后以LeNet为例,说明其在手写体数字识别任务中的数据集构建、模型构建、训练、评价与预测过程。 ☞☞☞AI 智能聊天, 问答助手, AI 智能…

    2025年11月6日
    400
  • 【论文复现赛第六期-语义分割】CCNet

    【论文复现赛第六期-语义分割】CCNet【论文复现赛第六期-语义分割】CCNet【论文复现赛第六期-语义分割】CCNet【论文复现赛第六期-语义分割】CCNet

    本文复现了CCNet语义分割模型,其核心为Criss-Cross Attention模块,通过循环操作让像素建立联系以获取丰富语义。使用PaddleSeg复现,采用ResNet101骨干网,在Cityscapes验证集上mIoU达80.95%,已合入PaddleSeg,还提供了训练、验证等流程及复现…

    2025年11月6日 用户投稿
    000
  • 【PaddleHub模型贡献】一行代码实现蛇种识别

    【PaddleHub模型贡献】一行代码实现蛇种识别【PaddleHub模型贡献】一行代码实现蛇种识别【PaddleHub模型贡献】一行代码实现蛇种识别【PaddleHub模型贡献】一行代码实现蛇种识别

    该内容围绕蛇类识别模型展开,先安装PaddleX,解压数据集并划分,设置GPU后进行图像预处理与增强,定义数据迭代器,用ResNet50_vd_ssld模型训练,接着导出并转换模型为PaddleHub模块,测试单张和多张图片识别效果,最后介绍在GitHub提pr的步骤。 ☞☞☞AI 智能聊天, 问答…

    2025年11月6日 用户投稿
    000
关注微信