直追ChatGPT?千亿AI巨头,火速升级大模型!

中国基金报记者 冯尧

距离首次推出多模态大模型刚一个月有余,科大讯飞又马不停蹄对其“星火认知大模型”升级。

6月9日,科大讯飞公布其通用大模型新进展,发布“星火认知大模型”V1.5版,该版本在开放式问答方面取得突破,多轮对话和数学能力再升级,文本生成、语言理解、逻辑推理能力也得到提升。此外,科大讯飞推出了星火APP,并将其配备了“星火认知大模型”。

科大讯飞在一个月前发布时已计划在10月24日前达到与ChatGPT能力的对标。科大讯飞方面透露,计划于8月15日推出“星火认知大模型”的多模态交互升级。

瞄准待攻克的“三大缺陷”

在5月6日,科大讯飞首次公布“星火认知大模型”,当时科大讯飞董事长刘庆峰即为其立下目标:争取今年10月24日在中文方面超越GPT,在英文达到相当水平。

科大讯飞进行了升级并发布了“星火认知大模型”V1.5版本,这是在34天后的事情。刘庆峰介绍,该版本在开放式问答方面取得突破,在多轮对话和数学能力再升级,文本生成、语言理解、逻辑推理能力持续提升。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

直追ChatGPT?千亿AI巨头,火速升级大模型!

尤其在泛领域开放式问答方面,“星火认知大模型”V1.5版本瞄准了纯大模型技术有待攻克的“三大缺陷”:新知识难以更新、事实类问答容易“张冠李戴”、史实传统典籍等容易“编造情节”。

同时,多轮对话能力的跃迁,让讯飞星火的对话体验更加贴合真人。多轮对话是大模型的传统难题,简单来说即为“没记性”。

在会上,科大讯飞也对“星火认知大模型”进行现场演示。在谈及“中国关于人工智能有何新动向”这一问题时。“星火认知大模型”提及今年6月3日,长三角企业家联盟产业数字化峰会发布了《通用人工智能长三角(合肥)宣言》和《通用认知智能大模型评测体系》。

实际上,星火大模型在5月已经定型,而“星火认知大模型”给出的答案,已经包括6月相关政策动向,也表明大模型已处于实时更新学习状态。需要注意的是,”星火认知大模型”进一步揭示了当前中国人工智能所面临的差距。

“大模型与搜索给出一样的答案没有意义,而是要通过专业知识、推理能力给出具有建设性的方案,”科大讯飞研究院院长刘聪也在会上直言。另外,”星火认知大模型” 在会议上成功地回答了今年高考数学题和语文题。

下一节点:多模态交互再升级

科大讯飞计划在今年内进行三轮迭代升级,旨在在10月24日达到与ChatGPT相媲美的水平。除了6月9日,下一个升级阶段在8月15日,主要是为了提升代码能力和多模态交互能力。多模态领域的功能,例如虚拟人合成和图文理解,将在未来向客户开放。

科大讯飞董事长刘庆峰此前表示,目前科大讯飞的代码能力重点针对工业互联网,针对企业内部的很多应用,将来目标是不需要程序员,让大模型生成各种代码。但刘庆峰也坦言,星火大模型的这一功能和ChatGPT相比,还有很大差距,下一步升级的重点功能也是这一领域。

天工大模型 天工大模型

中国首个对标ChatGPT的双千亿级大语言模型

天工大模型 115 查看详情 天工大模型

而刘庆峰在会上透露,在更为前沿的领域,科大讯飞方面还将探索更多潜在人工智能技术路线,如博弈智能、类脑智能和神经网络模型。

除了大模型自身能力进一步提升外,科大讯飞此次还发布了“星火认知大模型”在学习、医疗、工业、办公等领域进一步的商业落地进展,包括推出星火APP和星火语伴APP。

同时,科大讯飞还进一步瞄准了细分领域,推出星火认知大模型+医疗诊后管理平台、星火认知大模型+工业互联网平台、星火认知大模型+讯飞听见智慧屏产品。在业内人士看来,此举意在推动其在细分领域的商业化,有望率先突破的场景即为上述医疗、工业制造以及办公领域。

同时,除了面向不同应用场景开发示范性应用产品外,科大讯飞面向AI开发者、大模型上下游企业、创业团队的星火生态,也在同步招募生态合作伙伴。

实际上,参考OpenAI的发展史,大模型研发的前提是对小模型的研发、训练、应用等已经足够成熟,OpenAI创立之初的产品也仅为游戏领域的垂直小模型,在完全摸透小模型的研发、落地后才不断扩大参数量最终形成1750亿参数的大模型GPT3。

国内大模型开启“百模大战”

自今年3月以来,国内的通用大模型如雨后春笋般陆续发布。其中,百度率先发布文心一言,阿里紧跟其后官宣通义千问,甚至清华大学、北京智源人工智能研究院、上海人工智能实验室等科研院所也发布了各自的AI大模型成果。

根据民生证券相关研报的统计,目前国内至少已经有30多家大模型亮相,出品方涵盖互联网巨头、AI概念上市公司、服务器龙头企业、科研院所与一级市场创业公司,有的大模型的参数规模已经接近,甚至超越ChatGPT的规模(上千亿条)。

IDC预测数据显示,中国人工智能市场支出规模将在2023年增至147.5亿美元,约占全球总规模十分之一。长远来看,AI技术的创新迭代驱动了应用场景的进一步落地,以AIGC、数字人、多模态、AI 大模型、智能决策为代表的热点为市场带来了更多想象力和可能性。

IDC预计,2026年中国AI市场将实现264.4亿美元市场规模,2021-2026五年复合增长率(CAGR) 将超20%。中信建投认为,国内大模型研发应用热潮持续高涨,大模型发展全面加速,但当前全球大模型产业落地仍然处于早期探索的阶段,需要与下游的场景企业合作来建立大模型的商业模式。

编辑:舰长

审核:许闻

版权声明

《中国基金报》对本平台所刊载的原创内容享有著作权,未经授权禁止转载,否则将追究法律责任。

刚刚,方星海重磅发声!

以上就是直追ChatGPT?千亿AI巨头,火速升级大模型!的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/525335.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
vivo V30拍照模糊怎么办 vivo V30相机优化
上一篇 2025年11月9日 07:39:02
携程App如何管理常用旅客信息 携程App个人资料同步与快速填单技巧
下一篇 2025年11月9日 07:39:06

相关推荐

  • PHP代码注入检测机器学习应用_机器学习在代码注入检测中的应用

    PHP代码注入检测机器学习应用_机器学习在代码注入检测中的应用PHP代码注入检测机器学习应用_机器学习在代码注入检测中的应用PHP代码注入检测机器学习应用_机器学习在代码注入检测中的应用PHP代码注入检测机器学习应用_机器学习在代码注入检测中的应用

    机器学习能超越传统方法的关键在于其对未知攻击的泛化识别能力。传统规则依赖已知模式,难以应对变种攻击;而机器学习通过分析代码的词法、句法、语义和数据流特征,构建抽象的行为模型,可识别未见过但模式相似的恶意代码。例如,即便攻击者使用编码或混淆技术,只要其数据流向敏感函数(如eval、system)的行为…

    2026年5月10日 用户投稿
    000
  • 开发基于ChatGPT的自动写诗系统:Python让诗意流淌

    开发基于ChatGPT的自动写诗系统:Python让诗意流淌 自古以来,诗歌一直是人类表达感情和思想的一种重要方式。然而,写好一首优美的诗歌并不是每个人都能做到的,特别是对于那些没有诗歌创作经验的人来说。但是,现代技术的发展让自动写诗成为可能,人们可以利用计算机和人工智能技术来自动生成诗歌。在这篇文…

    2026年5月10日
    000
  • ai做html怎么运行_AI生成html运行步骤【教程】

    答案是使用AI生成HTML代码后,将其保存为.html文件并用浏览器打开即可运行。具体步骤为:1. 在AI工具中输入需求生成HTML代码;2. 将代码复制到文本编辑器并另存为index.html,编码选UTF-8,类型选“所有文件”;3. 双击该文件用浏览器打开,若无法正常显示需检查文件后缀、编码及…

    2025年12月23日
    000
  • 表单中的AI助手怎么集成?如何添加智能填写建议?

    表单中添加ai助手的核心是通过前后端协同实现智能填写建议,具体需从后端智能服务构建、前端交互逻辑、性能优化及复杂场景处理等方面入手。首先应根据需求选择合适的ai能力:若仅需关键词匹配,可采用轻量级规则引擎或本地模型;若需语义理解,则调用大型语言模型(llm)api如gpt、文心一言等更为合适。后端需…

    2025年12月22日
    000
  • javascript的机器学习如何入门_有哪些可用的JavaScript库

    JavaScript适合浏览器端轻量推理与教学,不宜训练大模型;推荐从线性回归、KNN等简单任务入手,优先掌握张量操作、模型流程及Chrome调试技巧。 JavaScript 做机器学习确实可行,但得明确一点:它不适合训练大型模型,更适合在浏览器端做轻量推理、数据预处理、教学演示或与 Web 应用集…

    2025年12月21日
    000
  • p5.js中类方法声明的语法解析与常见错误修复指南

    本文旨在解决从java processing迁移至p5.js时常见的语法错误,特别是类内部方法声明不当引发的问题。我们将深入探讨javascript中全局函数与类方法声明的语法差异,提供清晰的示例代码,并指导如何识别和修复“unexpected token”及“declaration or stat…

    2025年12月21日
    600
  • p5.js中类方法声明的语法修正与迁移指南

    本文深入探讨了将Processing/Java代码转换为p5.js时,因JavaScript类方法声明语法差异而引发的常见错误。我们将重点解析`Unexpected token`和`Declaration or statement expected`等错误信息,明确全局函数与类成员方法在JavaSc…

    2025年12月21日
    000
  • TypeScript泛型函数中复杂对象结构类型推断的精确控制

    本文探讨了在typescript中处理复杂嵌套对象结构时,如何为泛型函数实现精确的类型推断。通过一个具体的汽车品牌和车型数据场景,我们分析了`object.values`等操作可能导致类型信息丢失的问题。核心解决方案是利用映射类型(mapped types)重构数据结构,以显式地建立泛型键与对应值之…

    2025年12月21日
    000
  • 解决 ChatGPT 扩展选择器失效问题:一个实战教程

    本文旨在帮助开发者解决 ChatGPT 网页更新导致扩展选择器失效的问题。通过分析问题原因,提供利用开发者工具查找新选择器的方法,并展示了使用 getElementsByClassName() 替代 querySelector() 的解决方案,以确保扩展功能在 ChatGPT 最新版本中正常运行。 …

    2025年12月20日
    000
  • ChatGPT 扩展失效:定位新版选择器并修复

    本文旨在帮助开发者解决因 ChatGPT 网页更新导致扩展失效的问题。通过分析失效原因,提供利用开发者工具定位新版选择器的实用方法,并给出示例代码,帮助开发者快速修复扩展,恢复其功能。 当 ChatGPT 网页更新时,依赖于特定 CSS 选择器的扩展程序可能会失效。这通常是因为网页结构的改变导致原有…

    2025年12月20日
    700
  • ChatGPT 扩展失效?定位新版选择器的实用指南

    本文旨在帮助开发者解决因 ChatGPT 网页更新导致扩展失效的问题。重点讲解如何定位新版 ChatGPT 网页中的目标元素,并提供使用 getElementsByClassName() 方法的示例代码,帮助开发者快速修复和更新扩展,使其重新适配新版 ChatGPT 网页。 ChatGPT 网页频繁…

    2025年12月20日
    500
  • ChatGPT 扩展插件选择器失效问题排查与解决方案

    本文旨在帮助开发者解决 ChatGPT 扩展插件因页面更新导致选择器失效的问题。通过分析页面结构变化,提供使用 getElementsByClassName() 方法替代 querySelector() 的解决方案,并提供在不同浏览器环境下调整选择器的思路,确保扩展插件的稳定运行。 由于 ChatG…

    2025年12月20日
    100
  • 应对ChatGPT界面更新:浏览器扩展选择器失效的定位与修复

    本文针对ChatGPT界面更新导致浏览器扩展选择器失效的问题,提供了一套定位与修复策略。核心在于利用浏览器开发者工具识别新的DOM结构和类名,并建议从不稳定的querySelector转向更适合动态UI的getElementsByClassName等方法,以确保扩展的稳定运行。 在开发浏览器扩展时,…

    2025年12月20日
    000
  • 如何构建一个支持AI辅助代码生成的开发工具?

    答案是构建AI辅助开发工具需聚焦开发者真实痛点,通过代码上下文感知引擎理解语义,结合本地与云端推理平衡速度与质量,强化安全隐私保护,并深度集成主流IDE实现反馈闭环,让AI成为响应快、理解准、可信赖的编程搭档。 构建一个支持AI辅助代码生成的开发工具,核心在于将AI能力无缝集成到开发者的工作流中,提…

    2025年12月20日
    100
  • LINE Bot 多消息类型回复:文本与贴图的组合发送指南

    本文旨在解决 LINE Bot 开发中,通过 Messaging API 组合发送文本消息和贴图时遇到的 400 Bad Request 错误。核心问题在于对同一 replyToken 进行多次 replyMessage 调用,而正确的做法是利用 API 支持在单次调用中发送一个消息数组,从而实现文…

    2025年12月20日
    000
  • JavaScript中的Web Assembly(WASM)带来了哪些性能突破?

    WASM通过接近原生的执行速度、更小的二进制体积和跨平台能力,显著提升Web性能;它与JavaScript互补,使浏览器能运行AutoCAD、Figma等重型应用,并支持4K视频处理、大模型训练等复杂任务,推动Web向桌面级体验演进。 WebAssembly(WASM)为JavaScript生态带来…

    2025年12月20日
    500
  • 使用LINE Bot与OpenAI API发送文本和贴图的完整教程

    本文详细介绍了如何在LINE Bot中集成OpenAI API生成文本回复,并在此基础上发送LINE贴图。核心挑战在于LINE Messaging API的replyToken通常只能使用一次,导致连续发送文本和贴图时出现400错误。解决方案是利用API支持一次性发送多条消息的特性,将文本和贴图消息…

    2025年12月20日
    000
  • 优化OpenAI API:解决GPT应用中意外代码生成问题

    本教程旨在解决使用OpenAI GPT-3.5 API(如text-davinci-003)时,模型意外生成无关代码的问题。文章强调了选择更适合代码生成任务的模型(如gpt-3.5-turbo或gpt-4)的重要性,并深入探讨了通过优化提示词(Prompt Engineering)来提升模型响应质量…

    2025年12月20日
    200
  • 解决 Next.js API 路由无法访问 Azure 云函数的问题

    第一段引用上面的摘要: 本文旨在帮助开发者解决 Next.js API 路由无法访问 Microsoft Azure 云函数的问题。主要原因通常是由于 process.env.VERCEL_URL 环境变量配置不正确,导致 Next.js 应用尝试通过 IPv6 的本地回环地址 ::1 连接云函数,…

    2025年12月20日
    000
  • 在Next.js API路由中高效传输OpenAI流式响应到客户端

    本文详细介绍了如何在Next.js应用的API路由中,以流式传输的方式将OpenAI的响应发送给客户端,从而实现类似ChatGPT的实时交互体验。针对旧版Node.js环境限制和API密钥暴露等常见问题,我们提出了一种基于Next.js App Router和Web标准API(如ReadableSt…

    2025年12月20日
    000

发表回复

登录后才能评论
关注微信