商汤科技联合创始人杨帆:大模型浪潮带来的 AI 产业发展新机遇

36 氪主办了名为「颠覆 · aigc」的产业发展峰会,时间为 5 月 23 日。本次峰会汇聚产业力量,共同探讨企业、行业在面临变革时的应对策略,分享思考,探索和发现产业中最具潜力的企业与最具价值的技术,在激荡的环境中探寻前行的方向。

大会上,商汤科技联合创始人、大装置事业群总裁杨帆发表了题为《大模型浪潮带来的 AI 产业发展新机遇》的主题演讲。杨帆认为,新一轮 AI 浪潮有两个特点:一是从技术突破到商业模式创新的周期更短,技术成果被更快地用于商业和产业探索、实践;二是相较于过去十年,当前的人工智能产业化更容易将技术优势转化为数据壁垒和规模优势。

杨帆也提出了自己的观点,解释了人工智能技术取得突破性进展的原因。他认为,尽管大模型的成功仍然印证了人工智能的 ” 数据、算力、算法 ” 暴力美学,但这三要素背后实际上是一个综合系统工程。以 OpenAI 为例,杨帆指出,如何做好数据工程,如何提升芯片的有效资源利用率,如何设计更低成本但结构优良的算法,每一个环节都需要专家经验知识和系统工程能力支撑。他认为,这不仅是模型层企业核心技术能力的最终体现,也是提供AI基础设施服务所必需的关键能力。

以下为杨帆演讲实录(经 36 氪整理编辑):

大家好!很荣幸今天能够在 36 氪的活动和大家一起交流大模型的一些产业趋势。

在这样一个产业极度变化期,我分享几个观点。首先,我们今天讲大模型,是没有被精确定义说法的,到底是千亿较大,还是百亿较大?在我看来,人工智能从 2012 年到现在,过去十几年,模型结构一直在变大,参数量也一直在变大,为什么现在大家好像突然有了一个概念,引爆更多的关注热点?我们可以看到,在 2016 年以 AlphaGo 为代表的新应用,和个人消费者之间有一个强关联,最近两年,人工智能技术取得了新的进展和突破,首先这些进展、突破和每个人更直接相关,大家能够直接感受到它,第二这些突破确实形成了更大的影响力,我觉得人工智能可以完成一些其他学科在科研领域里的创新工作,不管是生物、物理、化学,还是其他领域,比如:今天大家所关注的 ChatGPT 模型,就很有意义,因为它有可能驱动我们整个底层的科技,产生新的进步。这样新的进步有可能在未来给人类带来更多的增量。

从 2021 年开始,陆陆续续产生比较多的技术突破,同时我们看到一个很有意思的现象,这轮技术突破从技术形成一定的成果后,我们开始到产业、商业上做探索和实践,这个周期变得比原来更短。在此之后,国内外有大量的创新公司成立,教授、学者开始创业,我觉得可能过去市场上对此已有一些路径,投资人的认可度也变得更高,包括一些文生图的 API 公布后,很快就有人在小红书上做网红尝试。

我们看到很多趋势,从技术突破到商业化创新,这个周期似乎更短。在最近参加的一些论坛里面,我发现大多数人都在讲,想要做一个什么样的大模型,模型有多大,有多厉害,要拿这个模型做什么事情,在某些特定场景下去打造一个超级新的 APP,等等。在中国现在还没有任何一个大模型得到政府监管正式 API 许可的情况下,在最近两个月的时间内就有这样一个很大的扩张变化。

所以我觉得这是一个更值得我们去关注的现象,我们看到这轮大模型的商业化进程更快,为什么会产生这样的效果?很重要的一点是我们看到很多新技术,可以做更多 C 端应用,与此同时,可以天然形成数据积累闭环,这比起过去技术性创业更加容易建立起商业壁垒。我觉得这是我们看到的最近几个月在产业方面的趋势。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

商汤科技联合创始人杨帆:大模型浪潮带来的 AI 产业发展新机遇

商汤科技联合创始人、大装置事业群总裁 杨帆

第二,是我们今天做大模型技术背后的东西。大家有一个共识,不管是大模型,还是回顾过去 10 年,整个人工智能产业发展变迁,基本上都是一个暴力美学的成功,包括人工智能的传统三要素:数据、算力、算法。算法,大家可以理解成模型结构,今天我们所谓的这些大模型,或者技术上取得更新成绩的模型,几乎所有的模型在每个领域不管是数据集尺度所使用的算力规模,还是算法本身的结构,以及模型的参数量,其实都保持着非常高的增速,Transformer 这个模型非常稳定,效果非常好,可以解决很多领域问题,并能得到很好的结果。当我们发现数据量足够多,可以拿到很好泛化性的结果时,其实在某种意义上,也更加验证了人工智能技术的进步大方向就是暴力出奇迹,把更多资源整合起来就可以拿到更好的结果。

但是,光有这样一个资源,其实是远远不够的,我们去看对应的三要素,每个要素在形成好的结果之前,在每个领域都要做大量的专业工程实践。

商汤商量 商汤商量

商汤科技研发的AI对话工具,商量商量,都能解决。

商汤商量 36 查看详情 商汤商量

其实刚才嘉宾的演讲就解释了在算力领域,为什么我们需要大算力,这些大算力怎么连起来?如果今天有 1000 块卡,我们是不是能让它们发挥出好的性价比,是不是有效利用率能做到 60%、80%,甚至 90%?再或者,如果我们今天连了 1000 块,2000 块、4000 块卡,又会是什么样的效果?OpenAI 之前连了一万块 V100,目前国内还没有人可以把一万块卡连在一起去跑同一个训练任务,并使有效资源利用率达到 50%、60% 以上,现在可能有些人正在做,但还没有这样的成绩,为什么?其背后就是非常复杂的工程事件。比如:一个千亿参数量的模型,在训练时需要做大量数据交互和中间梯度信息交互,当你把分在成千上万块 GPU 卡上的大量传输数据和运算结果传输之间形成有效平衡,很多时候模型是在点对点之间进行,在网络结构上要做两两传输。我们把成千上万块卡连在一起时,效果有一个怎样的可接受状态,这背后其实也不复杂,就是大量的工程实践,就像你干过这件事,你踩过足够多的坑,就会比别人调的更好,这个事情就是很重要的经验问题。

算法也一样,今天的算法结构设计可以比原来成本更低。结构设计的好,用更少量参数、更小数据就可以达到类似一个设计不做特别优化的最终算法效果,这中间也存有大量专家知识,数据就更不用说了。

OpenAI 做 ChatGPT4 的时候,最后在收集到的数据中只取了中间可能不到 10% 的很小一部分做训练,这对于资源节省和全量训练的差距非常大,互联网量数据非常大,到底哪些数据更加有效,哪些数据有更高蕴含价值?我们在做训练的时候,先丢哪些数据,后丢哪些方式,这个中间其实也都有大量试错。为什么算力这么紧缺,大家需要拿更多算力?因为做大模型的很多人在试错,可能同时分三四个小组,在不同方向上试错,然后再逐步做迭代优化,暴力美学或者规模化资源聚集是今天能够让 AI 技术、AI 算法能够持续取得的原因。

一个综合系统工程是需要在每个环节上借助专家经验和系统工程能力的。这也是看到 OpenAI 让最优秀的科学家去做数据工程,而不是去做算法,这极大的超出了我们以往对于领域的认知,在未来,这可能会成为一个关键性的门槛,也会成为我们给市场提供服务的核心能力。

为什么在人工智能新技术出来以后,产业浪潮跟进的非常快,我们看到模型服务天然符合很多领域,互联网圈的人非常激动,投资人觉得它会像互联网一样飞速增长。商业化门槛和壁垒上的改变会为大型模型带来一些更新的机会,但是这些机会的获取取决于个体的不同差异和特长。无论如何,相比过去 10 年,如今的人工智能产业化会有非常大的优势,因为不是单一技术壁垒,今天的技术优势是有可能转化成数据壁垒和规模优势,我们相信在未来会有更多的产业应用。

商汤科技联合创始人杨帆:大模型浪潮带来的 AI 产业发展新机遇

商汤从 2019 年开始做早期的大模型,在我们看来,整个 AI 模型其实一直处在越来越大的状态,所以我们内部积累了大量能力,包括自研了一些 CV、NLP 的模型。在今年 4 月份,商汤把一些模型的 API 开放出来,给产业伙伴试用,包括一些大语言类的模型,在我们看来,这更多是核心基础技术能力积累的最终体现。

我们今年发布了一系列的模型,为市场提供服务支撑的背后是我们的大装置,我们觉得,人工智能整个产业往前走,需要有人提供这样大规模的高效率的基础设施,这基本是一个必然路径。整个 AI 技术浪潮,未来如果变成越来越多资源消耗加专家经验累计的游戏的话,其实门槛极高,是不利于 AI 被产业大量快速应用的,所以我们判断势必会形成分化,一定会有人提供基础设施服务,不管是调用模型 API 形式,还是在此基础上做小模型的方式,再或者以其他的方式,都可以低门槛、低成本的快速使用 AI 基础性的资源和能力,从而快速完善自己的商业模式闭环。

商汤大装置的定位就是做 AI 基础设施提供者,今天我们有全亚洲最大的人工智能的计算节点,我们拥有超过 5000P 的资源算力,也提供非常多的业界合作,让合作伙伴们能够使用他们的大模型在大装置上做训练,这体现了商汤的深厚积累,不管是在资源层面还是在专家工程认知层面,我们的能力一部分可以标准化,变成软件和服务,不能标准化的部分,我们可以把它变成专业类型分类服务,我们希望把这些能力打包提供给整个行业,帮助客户做好属于自己的领域模型或模型应用。

训 AI 大模型,用商汤大装置。

来源:36氪

以上就是商汤科技联合创始人杨帆:大模型浪潮带来的 AI 产业发展新机遇的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/537513.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
linux有几种负载均衡
上一篇 2025年11月9日 13:27:12
C++ Linux下如何进行异常处理
下一篇 2025年11月9日 13:27:19

相关推荐

  • 开发基于ChatGPT的自动写诗系统:Python让诗意流淌

    开发基于ChatGPT的自动写诗系统:Python让诗意流淌 自古以来,诗歌一直是人类表达感情和思想的一种重要方式。然而,写好一首优美的诗歌并不是每个人都能做到的,特别是对于那些没有诗歌创作经验的人来说。但是,现代技术的发展让自动写诗成为可能,人们可以利用计算机和人工智能技术来自动生成诗歌。在这篇文…

    2026年5月10日
    000
  • ai做html怎么运行_AI生成html运行步骤【教程】

    答案是使用AI生成HTML代码后,将其保存为.html文件并用浏览器打开即可运行。具体步骤为:1. 在AI工具中输入需求生成HTML代码;2. 将代码复制到文本编辑器并另存为index.html,编码选UTF-8,类型选“所有文件”;3. 双击该文件用浏览器打开,若无法正常显示需检查文件后缀、编码及…

    2025年12月23日
    000
  • p5.js中类方法声明的语法解析与常见错误修复指南

    本文旨在解决从java processing迁移至p5.js时常见的语法错误,特别是类内部方法声明不当引发的问题。我们将深入探讨javascript中全局函数与类方法声明的语法差异,提供清晰的示例代码,并指导如何识别和修复“unexpected token”及“declaration or stat…

    2025年12月21日
    600
  • p5.js中类方法声明的语法修正与迁移指南

    本文深入探讨了将Processing/Java代码转换为p5.js时,因JavaScript类方法声明语法差异而引发的常见错误。我们将重点解析`Unexpected token`和`Declaration or statement expected`等错误信息,明确全局函数与类成员方法在JavaSc…

    2025年12月21日
    000
  • TypeScript泛型函数中复杂对象结构类型推断的精确控制

    本文探讨了在typescript中处理复杂嵌套对象结构时,如何为泛型函数实现精确的类型推断。通过一个具体的汽车品牌和车型数据场景,我们分析了`object.values`等操作可能导致类型信息丢失的问题。核心解决方案是利用映射类型(mapped types)重构数据结构,以显式地建立泛型键与对应值之…

    2025年12月21日
    000
  • 解决 ChatGPT 扩展选择器失效问题:一个实战教程

    本文旨在帮助开发者解决 ChatGPT 网页更新导致扩展选择器失效的问题。通过分析问题原因,提供利用开发者工具查找新选择器的方法,并展示了使用 getElementsByClassName() 替代 querySelector() 的解决方案,以确保扩展功能在 ChatGPT 最新版本中正常运行。 …

    2025年12月20日
    000
  • ChatGPT 扩展失效:定位新版选择器并修复

    本文旨在帮助开发者解决因 ChatGPT 网页更新导致扩展失效的问题。通过分析失效原因,提供利用开发者工具定位新版选择器的实用方法,并给出示例代码,帮助开发者快速修复扩展,恢复其功能。 当 ChatGPT 网页更新时,依赖于特定 CSS 选择器的扩展程序可能会失效。这通常是因为网页结构的改变导致原有…

    2025年12月20日
    700
  • ChatGPT 扩展失效?定位新版选择器的实用指南

    本文旨在帮助开发者解决因 ChatGPT 网页更新导致扩展失效的问题。重点讲解如何定位新版 ChatGPT 网页中的目标元素,并提供使用 getElementsByClassName() 方法的示例代码,帮助开发者快速修复和更新扩展,使其重新适配新版 ChatGPT 网页。 ChatGPT 网页频繁…

    2025年12月20日
    500
  • ChatGPT 扩展插件选择器失效问题排查与解决方案

    本文旨在帮助开发者解决 ChatGPT 扩展插件因页面更新导致选择器失效的问题。通过分析页面结构变化,提供使用 getElementsByClassName() 方法替代 querySelector() 的解决方案,并提供在不同浏览器环境下调整选择器的思路,确保扩展插件的稳定运行。 由于 ChatG…

    2025年12月20日
    100
  • 应对ChatGPT界面更新:浏览器扩展选择器失效的定位与修复

    本文针对ChatGPT界面更新导致浏览器扩展选择器失效的问题,提供了一套定位与修复策略。核心在于利用浏览器开发者工具识别新的DOM结构和类名,并建议从不稳定的querySelector转向更适合动态UI的getElementsByClassName等方法,以确保扩展的稳定运行。 在开发浏览器扩展时,…

    2025年12月20日
    000
  • LINE Bot 多消息类型回复:文本与贴图的组合发送指南

    本文旨在解决 LINE Bot 开发中,通过 Messaging API 组合发送文本消息和贴图时遇到的 400 Bad Request 错误。核心问题在于对同一 replyToken 进行多次 replyMessage 调用,而正确的做法是利用 API 支持在单次调用中发送一个消息数组,从而实现文…

    2025年12月20日
    000
  • 使用LINE Bot与OpenAI API发送文本和贴图的完整教程

    本文详细介绍了如何在LINE Bot中集成OpenAI API生成文本回复,并在此基础上发送LINE贴图。核心挑战在于LINE Messaging API的replyToken通常只能使用一次,导致连续发送文本和贴图时出现400错误。解决方案是利用API支持一次性发送多条消息的特性,将文本和贴图消息…

    2025年12月20日
    000
  • 优化OpenAI API:解决GPT应用中意外代码生成问题

    本教程旨在解决使用OpenAI GPT-3.5 API(如text-davinci-003)时,模型意外生成无关代码的问题。文章强调了选择更适合代码生成任务的模型(如gpt-3.5-turbo或gpt-4)的重要性,并深入探讨了通过优化提示词(Prompt Engineering)来提升模型响应质量…

    2025年12月20日
    200
  • 解决 Next.js API 路由无法访问 Azure 云函数的问题

    第一段引用上面的摘要: 本文旨在帮助开发者解决 Next.js API 路由无法访问 Microsoft Azure 云函数的问题。主要原因通常是由于 process.env.VERCEL_URL 环境变量配置不正确,导致 Next.js 应用尝试通过 IPv6 的本地回环地址 ::1 连接云函数,…

    2025年12月20日
    000
  • 在Next.js API路由中高效传输OpenAI流式响应到客户端

    本文详细介绍了如何在Next.js应用的API路由中,以流式传输的方式将OpenAI的响应发送给客户端,从而实现类似ChatGPT的实时交互体验。针对旧版Node.js环境限制和API密钥暴露等常见问题,我们提出了一种基于Next.js App Router和Web标准API(如ReadableSt…

    2025年12月20日
    000
  • Node.js ES Modules中openai导入异常及误导性错误排查

    本文探讨了在Node.js ES Modules (ESM) 环境下使用openai npm包时,遇到的一个看似是SyntaxError的模块导入问题。文章详细分析了问题现象,揭示了其背后实则是一个与导入语句无关的运行时逻辑错误,并解释了为何这类深层问题可能导致误导性的编译或模块加载错误。通过代码示…

    2025年12月20日
    000
  • 深入解析Node.js中误导性模块导入错误的排查与解决方案

    本文深入探讨了Node.js项目中一个看似是模块导入错误(SyntaxError: The requested module ‘openai’ does not provide an export named ‘Configuration’),但实际根…

    2025年12月20日
    000
  • 探索chatgpt开发的挑战和局限性

    ChatGPT:机遇与挑战并存 OpenAI研发的ChatGPT彻底改变了人机交互方式,其应用范围涵盖客户支持、内容创作等诸多领域。然而,ChatGPT的发展并非一帆风顺,仍面临诸多挑战与局限。本文将深入探讨这些问题,并提出相应的应对策略。 1. 训练数据限制 ChatGPT的核心局限在于其依赖于预…

    2025年12月19日
    000
  • DeepSeek和Chatgpt可以&#t正确:如何使用元数据更新Cloudflare KV对

    使用cloudflare kv更新键值对及其元数据 本文提供使用Cloudflare KV API更新键值对及其元数据的代码示例。 虽然大型语言模型可以生成代码,但仔细阅读官方文档仍然至关重要。 以下代码片段演示了如何使用fetch API 更新Cloudflare KV中的键值对,同时更新其元数据…

    2025年12月19日
    000
  • RSS如何实现动态内容过滤?

    要实现rss动态内容过滤,核心在于引入“智能代理”对原始feed进行二次处理。具体路径包括:1.使用内置过滤功能的rss阅读器,如feedly、inoreader等,适合简单筛选;2.借助ifttt或zapier等自动化平台作为中间件,支持条件判断和内容分发;3.自建解析器,利用python、nod…

    2025年12月17日
    000

发表回复

登录后才能评论
关注微信