udio
-
这段音频火爆外网!文字、图片一键生成逼真音效,音频界AIGC来了



近期 AIGC 如同上了热搜一般,火热程度居高不下,当然除了名头格外响亮,突破也是绝对斐然:输入自然语言就可自动生成图像、视频甚至是 3D 模型,你说意不意外? 但在音频音效的领域,AIGC 的福利似乎还差了一些。主要由于高自由度音频生成需要依靠大量文本 – 音频对数据,同时长时波形建模…
-
部署国产ChatGPT仅需6G显存!ChatYuan模型开放下载:业内首个功能型对话开源中文大模型



前段时间,元语智能开发团队训练了一个类似ChatGPT的功能型对话大模型ChatYuan,并在网页版中开放了试玩接口。 现在你也可以在自己的机器上部署一个ChatYuan了! 模型可用于问答场景,能够结合上下文做对话、做各种生成任务,包括创意性写作,也能回答法律、新冠等领域类问题。 并且在全中文任务…
-
PyTorch 2.0正式版发布!一行代码提速2倍,100%向后兼容



PyTorch 2.0正式版终于来了! ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 去年12月,PyTorch基金会在PyTorch Conference 2022上发布了PyTorch 2.0的第一个预览版本。 跟先前1.0版本相比,2…
-
【AI达人训练营第三期】手工搭建Resnet101分类道路情况



本文介绍基于ResNet101神经网络的道路垃圾识别项目。先说明智慧环卫背景及项目意义,接着阐述数据集处理过程,包括解压缩、分离训练集与测试集、预处理及自定义数据集,还讲解了ResNet101网络搭建、训练(优化器、损失函数及训练过程)与预测阶段的实现,可减少环卫劳动力。 ☞☞☞AI 智能聊天, 问…
-
自动编程NLP模型技术综述



Copilot、Codex和AlphaCode:自动编程的计算机程序现况 近年来,由于自然语言处理领域转换器(transformers)的兴起,我们看到了一系列令人震惊的代码编写深度学习模型。能够编写计算机程序的计算机程序,通常称为程序合成问题,至少从20世纪60年代末和20世纪70年代初就已开始研…
-
从零实现深度学习框架 基础框架的构建
本文介绍从零实现深度学习框架的思路,受飞桨框架学习活动及相关书籍启发。先解释深度学习框架是能自动求导的库,接着说明通过构建计算图实现,包含节点类设计及前向、反向传播逻辑,还以吃鸡排名预测挑战赛为例,展示用该简易框架处理数据、构建网络、训练和预测的过程。 ☞☞☞AI 智能聊天, 问答助手, AI 智能…
-
【Paddle打比赛】花样滑冰选手骨骼点动作识别(验证集方案)-62.89分



本文围绕基于骨骼点的细粒度人体动作识别展开,以花样滑冰数据集为研究对象,采用PaddleVideo的AGCN模型。通过划分训练集与验证集,调整mixup值为0.1,增加BN层加速收敛,并设置初始权重优化模型。经训练与测试,生成submission.csv用于评测,示例模型在A榜得62.89分,为细粒…
-
USB:首个将视觉、语言和音频分类任务进行统一的半监督分类学习基准



当前,半监督学习的发展如火如荼。但是现有的半监督学习基准大多局限于计算机视觉分类任务,排除了对自然语言处理、音频处理等分类任务的一致和多样化评估。此外,大部分半监督论文由大型机构发表,学术界的实验室往往由于计算资源的限制而很难参与到推动该领域的发展中。 为此,微软亚洲研究院的研究员们联合西湖大学、东…
-
文本相似度计算比赛-预训练模型baseline,直接上90%
该文介绍百度架构师课程内置的文本相似度计算比赛方案,用ERNIE预训练模型,将文本匹配转为分类任务,拼接query和title为输入。使用54614条训练集、7802条验证集、15604条测试集,经数据处理、模型训练,首 epoch 验证集准确率超90%,无需调参,可作基线,最后输出结果为resul…
-
【飞桨黑客松-AIGC – DreamBooth LoRA】HomeTown



该作品为基于PaddleNLP和PPDiffusers训练的AIGC趣味模型,主题是“我的家乡”,聚焦金昌紫金花海。介绍了花海背景,详述了环境安装、Hugging Face操作、模型训练参数调整、可视化及权重上传等步骤,模型已上传至Hugging Face和AI Studio,可生成相关场景内容。 …