模型
-
复旦等发布AnyGPT:任意模态输入输出,图像、音乐、文本、语音都支持



最近,OpenAI 的视频生成模型 Sora 爆火,生成式 AI 模型在多模态方面的能力再次引起广泛关注。 现实世界本质上是多模态的,生物体通过不同的渠道感知和交换信息,包括视觉、语言、声音和触觉。开发多模态系统的一个有望方向是增强 LLM 的多模态感知能力,主要涉及多模态编码器与语言模型的集成,从…
-
室温超导新瓜!LK-99团队展示全新材料完全悬浮及电阻测量结果,报告现场人挤人



☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 火龙果写作 用火龙果,轻松写作,通过校对、改写、扩展等功能实现高质量内容生产。 106 查看详情 以上就是室温超导新瓜!LK-99团队展示全新材料完全悬浮及电阻测量结果,报告现场人挤人的详细内容…
-
Anything in Any Scene:逼真物体插入(助力各类驾驶数据合成)



原标题:anything in any scene: photorealistic video object insertion 论文链接:https://arxiv.org/pdf/2401.17509.pdf 代码链接:https://github.com/AnythingInAnyScene/…
-
两张图2秒钟3D重建!这款AI工具火爆GitHub,网友:忘掉Sora



只需2张图片,无需测量任何额外数据—— 当当,一个完整的3D小熊就有了: ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 这个名为DUSt3R的新工具,火得一塌糊涂,才上线没多久就登上GitHub热榜第二。 有网友实测,拍两张照片,真的就重建…
-
挑战OpenAI的新模型免费上线,40%计算量性能逼近GPT-4



本周四,美国 AI 创业公司 Inflection AI 正式发布新一代大语言模型 Inflection-2.5。 据介绍,Inflection-2.5将结合强大的LLM技术和Inflection独有的“同理心微调”特性,综合了高情商和高智商的特点。它可以通过联网获取事实信息,性能媲美GPT-4和G…
-
40%算力训练效果比肩GPT-4,实测DeepMind联创大模型创业新成果



大模型竞赛,又杀出一匹黑马—— Inflection-2.5,由DeepMind联创Mustafa Suleyman的大模型初创公司打造。 只用40%的计算资源训练,表现就超过了GPT-4的九成,尤其擅长代码和数学。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSe…
-
扩散模型如何构建新一代决策智能体?超越自回归,同时生成长序列规划轨迹



设想一下,当你站在房间内,准备向门口走去,你是通过自回归的方式逐步规划路径吗?实际上,你的路径是一次性整体生成的。 最新研究指出,利用扩散模型的规划模块可以同时生成长序列的轨迹规划,更符合人类的决策方式。此外,扩散模型在策略表征和数据合成方面还能为现有的决策智能算法提供更为优化的方案。 来自上海交通…
-
GPT-4.5 Turbo提前泄露?Altman亲自暗示新模型要来,传言本周四上线



OpenAI的GPT-4.5 Turbo提前泄露了? 就在今天,网友纷纷发现,一款号称是GPT-4.5 Turbo的模型,竟然同时出现在了Bing、谷歌、DuckDuck Go的搜索结果里! 介绍信息显示:GPT-4.5 Turbo是OpenAI到目前为止推出的速度最快、准确度最高、可扩展性最强的模…
-
OpenAI大模型上身机器人,原速演示炸场!



openai大模型加持的机器人,深夜来袭! 名曰Figure 01,它能听会说,动作灵活。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 能和人类描述眼前看到的一切: 我在桌子上看到一个红色的苹果,沥水架上还摆放着几个盘子和一个杯子;你站在…
-
腾讯机器人研究登顶刊!能帮程序员安显示器,像真人一样协同干活



国产机器人新突破: 两只各自独立的机械臂,已经可以丝滑地打配合了! 不信你看这双手拧瓶盖: ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 拧完再端起杯子倒水: 活灵活现,如真人。 呐,还能搭把手帮程序员安装好显示屏: 甚至接过“同事”手里的…