幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂

上个月,马斯克疯狂呼吁叫停超级AI研发6个月。

还没等多久,老马就坐不住了,直接官宣推出一个名为TruthGPT的AI平台。

马斯克曾表示,TruthGPT将是一个「最大的求真人工智能」,它将试图理解宇宙的本质。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂

他强调,一个关心理解宇宙的人工智能不太可能灭绝人类,因为我们是宇宙中有趣的一部分。

然而,「幻觉」,到现在还没有哪个语言模型能够搞定。

最近,OpenAI联合创始人便解释为什么TruthGPT的远大理想的实现是如此地困难。

TruthGPT理想是泡沫?

马斯克的X.AI想要建立的TruthGPT,是一种诚实的语言模型。

这么做,直接将矛头对准ChatGPT。

幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂

因为,此前,像ChatGPT这样的AI系统经常产生错误输出等经典幻觉案例,甚至支持某些政治信仰的报道。

虽然ChatGPT可以让用户更多控制语言模型去解决问题,但「幻觉」仍然是OpenAI、谷歌以及未来马斯克的人工智能公司必须处理的核心问题。

OpenAI联合创始人兼研究员John Schulman在他的演讲「RL和Truthfulness – Towards TruthGPT」中讨论了这些挑战以及如何应对这些挑战。

幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂

为啥有「幻觉」?

根据Schulman的说法,幻觉大致可以分为两种类型:

1. 「模式完成行为」,即语言模型无法表达自己的不确定性,无法质疑提示中的前提,或者继续之前犯的错误。

2. 模型猜测错误。

由于语言模型代表一种知识图谱,其中包含来自其自身网络中训练数据的事实,因此微调可以理解为学习一个函数,该函数在该知识图谱上运行并输出token预测。

例如,微调数据集可能包含「星球大战的类型是什么?」这个问题,以及答案「科幻」。

幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂

如果这些信息已经在原始训练数据中,即它是知识图谱的一部分,那么模型不会学习新信息,而是学习一种行为——输出正确答案。这种微调也被称为「行为克隆」。

但问题是,如果问题是关于「Han Solo的衍生电影的名字是什么」出现在微调数据集中。

但如果答案「Solo」不是原始训练数据集的一部分(也不是知识图谱的一部分),即使网络不知道答案,它也会学习回答。

使用实际上正确但不在知识图谱中的答案进行微调,从而教会网络编造答案——即产生「幻觉」。相反,用不正确的答案进行训练会导致网络隐瞒信息。

因此,理想情况下,行为克隆应始终基于网络知识,但创建或评估数据集的人类工作者来说,通常不知道这种知识,例如指令调优。

根据Schulman的说法,当其他模型创建微调数据集时也存在这个问题,就像羊驼公式的情况一样。

他预测,具有较小知识图谱的较小网络,不仅会学会使用ChatGPT的输出给出答案和遵循指令,而且学会更频繁地产生幻觉。

OpenAI如何打击幻觉?

首先,对于简单的问题来说,语言模型大部分情况下能预测自己是否知道答案,还能表达不确定性。

因此,Schulman表示,微调数据集的时候,必须得让模型学会怎么表达不确定、怎么应对前提被更改的情况,以及错误被承认的情况。

要把这些情况的实例喂给模型,让它们学习。

但是模型在时机方面还是欠练,也就是说,它们并不知道该何时执行这些操作。

Schulman表示,这就是强化学习(RL)该出场的地方了。比如,基于人类反馈的强化学习(Reinforcement Learning with Human Feedback,RLHF)。

应用RL,模型就可以学习「行为边界」,学会何时做出何种行为。

而另一个难题,则是检索和引用来源的能力。

问题在于,有了复制行为的能力和RLHF,为什么ChatGPT还会产生幻觉?

幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂

原因在于问题本身的难易。

虽然上述方法对于简短的问题和答案效果不错,但对于ChatGPT中常见的长格式设置就会出现其他问题了。

一方面,完全错误的答案也不太可能,大部分情况都是错的和对的混在一起。

在极端情况下,可能就是100行代码中的一个错误而已。

在其他情况下,这些信息在传统意义上并不能说是错的,而是有误导性的。因此,在像ChatGPT这样的系统中,人们很难根据信息量或者正确性来衡量输出的质量。

但这种衡量对于旨在训练复杂行为边界的RL算法却非常重要。

目前,OpenAI依托于RLHF的基于排名的奖励模型,该模型能够预测它认为两个答案中哪个更好,但不会给出有效的信号来明确哪个答案好了多少、信息量大了多少或正确了多少。

Schulman表示,它缺乏向模型提供反馈以学习精细行为边界的能力。而这种精细的行为边界,才是有可能解决幻觉的道路。

此外,此过程还会因为RLHF标记过程中的人为出错而变得更加复杂。

因此,虽然Schulman将RL视作减少幻觉的重要方式之一,但他认为仍然存在许多还没解决的问题。

除了前面提到的奖励模型究竟需要什么样子才能引导正确的行为之外,RLHF目前仅依赖于人类的判准。

这可能会使知识的生成变得更加困难。因为对未来的预测有时会导致不那么令人信服的表述。

然而,Schulman认为,知识的生成是语言模型的下一个重要步骤,同时,他认为对未来的预测和给出推理规则等问题的理论构建,是亟待解决的下一类开放性问题。

Schulman说,一种可能的解决方案是,用其他AI模型来训练语言模型。

OpenAI也认为,这种方法对于AI对齐来说,很有意义。

ChatGPT架构师

作为ChatGPT架构师,John Schulman早在2015年还在读博士学位的他,就加入OpenAI成为联合创始人之一。

幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂

在一次采访中,Schulman解释了自己加入OpenAI的原因:

我想做人工智能方面的研究,我认为openai这家公司的使命雄心勃勃,并且致力打造通用人工智能。

尽管,在当时谈论AGI似乎有些疯狂,但我认为开始考虑它是合理的,我希望在一个地方谈论AGI是可以接受的。

另外,据Schulman透露,OpenAI将人类反馈强化学习这一方法 (RLHF)引入ChatGPT的想法可以追溯到17年了。

当时,也是OpenAI的成员,曾发表了一篇论文「从人类偏好中进行深度强化学习」就提到了这一方法。

幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂

论文地址:https://arxiv.org/pdf/1706.03741.pdf

OpenAI Codex OpenAI Codex

可以生成十多种编程语言的工作代码,基于 OpenAI GPT-3 的自然语言处理模型

OpenAI Codex 57 查看详情 OpenAI Codex

OpenAI安全团队之所以致力于这项工作,是因为想让自己的模型符合人类的偏好ーー试图让模型真正倾听人类意见,并试图做人类想做的事情。

在GPT-3完成训练的时候,然后Schulman决定加入这股潮流,因为他看到了整个研究方向的潜力。

当被问到第一次使用ChatGPT时,第一反应是什么的时候,Schulman的话语中透露着「无感」。

还记得去年ChatGPT横空出世,让许多人瞬间炸脑。

而在OpenAI内部没有人对ChatGPT感到兴奋。因为发布的ChatGPT是一个基于GPT-3.5较弱的模型,那时候同事们在玩转GPT-4了。

所以在那个时候,OpenAI没有人对ChatGPT感到兴奋,因为有这么一个更强大,更聪明的模型已经被训练过了。

对于未来人工智能下一前沿领域看法,Schulman称,AI在更艰难的任务上不断进步,然后,问题就来了,人类应该做些什么,在哪些任务下,人类可以在大模型帮助下有更大影响力,做更多的工作。

以上就是幻觉?马斯克TruthGPT也搞不定!OpenAI联合创始人直言很复杂的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/545352.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
诛神乾坤怎么切换角色 原神怎么轻松换角色
上一篇 2025年11月9日 17:20:18
安卓手机数据迁移到 iPhone 15怎么操作
下一篇 2025年11月9日 17:20:24

相关推荐

  • 大学论文怎么写?让AI工具助你一臂之力

    大学论文怎么写?让AI工具助你一臂之力大学论文怎么写?让AI工具助你一臂之力大学论文怎么写?让AI工具助你一臂之力大学论文怎么写?让AI工具助你一臂之力

    如果要选出大学学习过程中最令人头疼的事,写论文无疑能稳居榜首。从选题开题、内容撰写,到翻译润色、查重降重,每个步骤都耗时耗力,让人焦头烂额。然而,随着 ai 技术的发展,如今写论文这件事,已经可以借助智能工具变得更高效、更轻松。 开题太难?AI 来帮你破局! 论文的第一道难关就是开题。面对浩如烟海的…

    2026年9月24日 用户投稿
    100
  • 前端危!Gemini 3 内测结果获网友一致好评,“有史以来最强前端开发模型”

    前端危!Gemini 3 内测结果获网友一致好评,“有史以来最强前端开发模型”前端危!Gemini 3 内测结果获网友一致好评,“有史以来最强前端开发模型”前端危!Gemini 3 内测结果获网友一致好评,“有史以来最强前端开发模型”前端危!Gemini 3 内测结果获网友一致好评,“有史以来最强前端开发模型”

    谷歌下一代旗舰模型gemini 3未发布便已悄然走红! 原因很简单:强,实在是太强了。 在国外社交媒体平台上,一大波网友激动地分享了 Gemini 3 的内测结果—— 从曝光的这些案例来看,Gemini 3尤为擅长前端、SVG 矢量图生成,而且多模态能力变得更强。 立即学习“前端免费学习笔记(深入)…

    2026年9月23日 用户投稿
    100
  • Lightworks如何用于AI视频编辑?教你打造专业AI视频的步骤

    Lightworks如何用于AI视频编辑?教你打造专业AI视频的步骤Lightworks如何用于AI视频编辑?教你打造专业AI视频的步骤Lightworks如何用于AI视频编辑?教你打造专业AI视频的步骤Lightworks如何用于AI视频编辑?教你打造专业AI视频的步骤

    Lightworks在AI视频制作中扮演“总导演”角色,它将AI生成的文本、图像、音频等零散素材通过非线性编辑、多轨道剪辑、色彩校正和音频混音等功能整合为具有叙事性与情感表达的专业视频作品,实现AI效率与人类创意的融合。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 Deep…

    2026年9月23日 用户投稿
    600
  • OpenAI 与微软达成重磅交易:股权结构再变,投资者面临稀释风险

    据《金融时报》披露,OpenAI 近期完成了一系列关键性交易,使其股权架构日趋复杂,同时也加剧了投资者对未来收益前景的担忧。在这些新协议推动下,OpenAI 的估值已飙升至5000亿美元,跃居全球最具价值的未上市企业之列。这一惊人估值的背后,是公司与英伟达和AMD两家芯片巨头达成的数十亿美元合作协议…

    2026年9月23日
    100
  • Reflection AI 完成 20 亿美元融资,打造“开放智能”

    美国人工智能初创企业 reflection ai 宣布成功募集 20 亿美元资金,其中英伟达领衔投资 8 亿美元,推动公司估值跃升至 80 亿美元。这家成立仅一年的科技新星,致力于打造“人人可及的前沿开放智能(open intelligence)”。 Reflection AI 表示,已集结一支由顶…

    2026年9月23日
    500
  • 马斯克:不久的将来特斯拉将实现无人自动找车位泊车

    10 月 14 日消息,埃隆・马斯克再度释放信号,暗示特斯拉或将很快推出名为“banish”的全新功能。这一功能有望与今年早些时候发布的热门功能“辅助智能召唤”(assisted smart summon, ass)协同工作,进一步提升用户体验。 “Banish”是特斯拉长期承诺的一项技术,旨在实现…

    2026年9月22日
    000
  • 如何在DaVinciResolve中制作AI视频?教你利用AI工具优化视频流程

    如何在DaVinciResolve中制作AI视频?教你利用AI工具优化视频流程如何在DaVinciResolve中制作AI视频?教你利用AI工具优化视频流程如何在DaVinciResolve中制作AI视频?教你利用AI工具优化视频流程如何在DaVinciResolve中制作AI视频?教你利用AI工具优化视频流程

    达芬奇Resolve并非一键生成AI视频的%ignore_a_1%,而是通过内置AI功能与外部AI服务协同,提升视频制作效率。其核心在于利用Neural Engine驱动的智能工具,如Magic Mask实现精准抠像、Voice Isolation分离人声、Smart Reframe适配多平台构图、…

    2026年9月22日 用户投稿
    700
  • DALL-E3如何导出生成的AI图片?一步步教你保存高分辨率图像

    DALL-E 3生成图片的默认分辨率为1024×1024像素,获取高清原图的关键是使用平台提供的官方下载按钮,而非右键“图片另存为”,以避免保存低分辨率缩略图;为防止画质损失,应避免二次压缩,并通过建立清晰的文件夹结构、规范命名、本地与云端同步等方式进行有效管理和备份;根据OpenAI政策…

    2026年9月22日
    000
  • 如何用Animoto制作AI营销视频?快速生成商业AI视频的教程

    如何用Animoto制作AI营销视频?快速生成商业AI视频的教程如何用Animoto制作AI营销视频?快速生成商业AI视频的教程如何用Animoto制作AI营销视频?快速生成商业AI视频的教程如何用Animoto制作AI营销视频?快速生成商业AI视频的教程

    Animoto通过模板与拖放功能,结合AI生成的文案和配音,帮助用户快速制作品牌统一、节奏合理、带明确CTA的高效营销视频,适用于多平台推广。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ Animoto是一个非常适合快速制作AI营销视频的…

    2026年9月21日 用户投稿
    200
  • 马斯克xAI的Grok将推AI视频检测工具,能否破解深度伪造难题?

    随着ai视频生成技术飞速渗透网络,深度伪造内容不断扩散,网络信息真实性面临前所未有的挑战。在此背景下,马斯克的xai公司的grok模型即将推出一项关键升级,打造一款“真伪侦探”工具。 近日,马斯克在X平台回应网友担忧时表示,Grok即将获得识别AI生成视频并追踪其网络来源的能力,以此应对深度伪造内容…

    2026年9月21日
    100
  • 苹果痛失AI大将,Siri关键负责人转投Meta

    苹果痛失AI大将,Siri关键负责人转投Meta苹果痛失AI大将,Siri关键负责人转投Meta苹果痛失AI大将,Siri关键负责人转投Meta苹果痛失AI大将,Siri关键负责人转投Meta

    近日有消息显示,%ignore_a_1%公司负责siri改革的关键高管ke yang已确认离职,并将加入竞争对手meta。这一变动不仅为苹果雄心勃勃的ai计划蒙上了一层阴影,也再次凸显了其在留住顶尖人才方面面临的严峻挑战。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 Dee…

    2026年9月21日 用户投稿
    200
  • ChatGPT代码会出错吗_AI编程中5个常见错误及解决方法

    AI编程中常见错误包括语法不匹配、逻辑遗漏、API误用、安全漏洞和集成困难,需通过版本明确、测试验证、文档核对、安全扫描和上下文补充等方式解决,结合人工审查与测试才能确保代码质量。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ ChatGP…

    2026年9月20日
    100
  • 如何用ChatGPT来重构优化一段旧代码_提升代码质量与性能的步骤

    明确目标并提供上下文,分步引导ChatGPT优化代码结构、算法和语言特性,最后验证建议并本地测试,确保重构有效且安全。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 用ChatGPT来重构和优化旧代码是一种高效提升代码质量与性能的方式。关键…

    2026年9月12日
    200
  • 超300万用户的AI翻译插件被曝隐私泄露,敏感内容曾网上公开

    近日,AI网页翻译工具“沉浸式翻译”被曝存在隐私泄露隐患。当用户使用其翻译功能并生成分享链接时,相关翻译内容会被存储在公开可访问的服务器上,导致诸如商业合同、保险资料、签证文件等敏感信息可能被搜索引擎收录,从而暴露于互联网之中。尽管该插件已紧急下架涉事功能,但此前已被抓取的数据仍持续在网络中流传。!…

    用户投稿 2026年9月10日
    100
  • 太平洋科技AI产品热度榜(8月):DeepSeek拿下第一,你常用的排第几?

    太平洋科技AI产品热度榜(8月):DeepSeek拿下第一,你常用的排第几?太平洋科技AI产品热度榜(8月):DeepSeek拿下第一,你常用的排第几?太平洋科技AI产品热度榜(8月):DeepSeek拿下第一,你常用的排第几?太平洋科技AI产品热度榜(8月):DeepSeek拿下第一,你常用的排第几?

    2025年8月,ai领域激荡前行。 当大模型价格战的余波渐渐平息,当“一分钱用一天”的宣传语不再令人惊艳,行业的目光正从参数规模的“军备竞赛”悄然转向实际应用的落地成效。技术的喧嚣终将归于价值的本质——究竟哪些产品,正在被最广泛的用户所关注与热议? 为此,PHP中文网正式发布「AI产品热度TOP榜」…

    2026年9月10日 用户投稿
    200
  • 中国一线城市消费者已经抛弃了BBA?

    中国一线城市消费者已经抛弃了BBA?中国一线城市消费者已经抛弃了BBA?中国一线城市消费者已经抛弃了BBA?中国一线城市消费者已经抛弃了BBA?

    ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 2025年9月,易车发布的最新一线城市终端销量数据显示:中国顶级消费市场的汽车偏好正在经历一场深刻重构——新能源车型已全面占据主导地位,传统燃油车的市场份额持续萎缩,曾经不可撼动的BBA阵营正面…

    2026年9月8日 用户投稿
    100
  • Grok 正式推出新虚拟女友角色 “Mika”

    埃隆・马斯克旗下的 xAI 团队最近再次成为焦点,其人工智能聊天平台 Grok 正式上线了一位全新的虚拟女友角色——“Mika”。 Mika 的形象设计融合了多个经典二次元人物的特质,灵感主要来自草薙素子、Lucy 和山田凉。她身穿黑色皮夹克与牛仔裤,拥有一头引人注目的深绿色长发,整体造型散发出强烈…

    2026年9月8日
    100
  • 腾讯朱雀大模型入口 朱雀AI检测官网网页版工具

    腾讯朱雀大模型检测入口为https://matrix.tencent.com/ai-detect/,提供文本与图像AI生成内容检测服务,支持主流格式上传与多模型识别,准确率超90%,用于学术、内容审核等场景。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R…

    2026年9月8日
    500
  • 特斯拉 FSD 加入大量全新渲染模型 玩滑板的人都能识别

    近日,有汽车领域博主爆料,特斯拉的fsd(完全自动驾驶)辅助系统将迎来一次重要升级,或将实现更真实的环境场景还原。在最新曝光的软件代码中,发现了大量新增的渲染模型,涵盖多种车辆与行人类型。 这些新增模型包括救护车、消防车、垃圾清运车、校车、半挂式卡车、高尔夫球车、骑电动滑板车的行人、使用轮椅的行人、…

    2026年9月8日
    100
  • OpenAI智能体新线索曝光!网友:新ChatGPT时刻要来了

    OpenAI智能体新线索曝光!网友:新ChatGPT时刻要来了OpenAI智能体新线索曝光!网友:新ChatGPT时刻要来了OpenAI智能体新线索曝光!网友:新ChatGPT时刻要来了OpenAI智能体新线索曝光!网友:新ChatGPT时刻要来了

    openai的智能体时代真的要来了!据可靠消息源透露,openai在mac版chatgpt桌面应用中隐藏了启用/禁用智能体“operator”的选项。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 这一消息得到了多方证实,Operator智…

    2026年9月7日 用户投稿
    100

发表回复

登录后才能评论
关注微信