大模型2024规模化场景涌现,加速云计算走出第二增长曲线

news2024/11/16 1:25:17

导读:2024,大模型第一批规模化应用场景已出现。

如果说“百模大战”是2023年国内AI产业的关键词,那么2024年我们将正式迈进“应用为王”的新阶段。

不少业内观点认为,2024年“百模大战”将逐渐收敛甚至洗牌,而大模型在千行万业的应用将从小规模试水,逐渐走向规模化落地。

展望2024,哪些场景更有可能率先实现大模型的规模化应用?

如果将大模型的应用场景分为互联网和政企两大类,基于产业观察,「智能进化论」认为:

在互联网领域,搜索增强、多媒体内容生成(AIGC推理)、智能NPC、量化投研有望成为第一批规模化应用的场景;

在政企领域,政企AI算力调度平台、智能驾驶、销售预测、柔性制造、国产化AI大模型中心等场景走得更快,同时中小企业大模型体验版也有相当大的潜力。

透过大模型在TOP场景的落地,我们不妨追问,这些场景之间有什么共同之处吗?谁在推动大模型跨越规模化应用的奇点?

TOP场景盘点,大模型下一个杀手级应用在哪?

——大模型在互联网领域的规模化应用场景——

在互联网领域,2023年国内诞生了众多聊天机器人、文生文、文生图AI应用。其实,从搜索引擎、多媒体内容到游戏,中国领先的移动互联网生态与大模型的碰撞藏着无限可能,大模型下一个杀手级应用也许就会从中诞生。

  • 搜索增强

搜索增强/检索增强生成技术(RAG)已成为当前最火热的LLM应用方案,被认为能够有效解决知识的局限性和时效性、幻觉等大模型应用的核心痛点。

此前大模型的知识来自训练数据集,而对实时性、非公开的或离线的数据是无法获取到的。搜索增强能够让大模型与实时互联网信息和垂直专业知识库连接,极大拓展了大模型的应用范围。

比如,过去搜索引擎通过关键词检索的方式返回结果,用户还需要花费大量时间精力去筛选原始网页和内容,才能找到想要的信息。通过搜索增强,大模型可以带来更精准的搜索结果,让搜索引擎变成集知识的发现、处理、分析和重新组织为一身的个人智能助理。

搜索增强同时具备检索和生成两种能力。如果将互联网信息比作一座拥有海量知识的图书馆,搜索增强融合了图书管理员和作家两种角色。图书管理员首先能够精准理解用户意图,然后快速从海量知识库中找到最相关的内容,再由作家将内容生成一个清晰易懂的答案,交付给用户。

搜索增强应用范围极广,包括搜索引擎网站、各类垂直APP内的搜索功能、千行百业的智能客服、企业内部知识库构建等等。

  • 多媒体内容生成(AIGC推理)

麦肯锡数据显示,中国生成式AI市场2020~2025年复合增速将达到84% ,2025年中国市场将占全球市场规模的14%。

多媒体内容生成是普通人最有感知的AI场景,也是大模型最火热的应用领域之一。2023年,从AI孙燕姿到妙鸭相机,多个热门AI应用和现象都来自这一场景。AIGC也推动了影像、设计相关领域公司收入大涨。譬如根据2023年上半年财报,在AIGC推动下,美图公司以VIP订阅为主的影像和设计产品业务成为第一大收入,公司实现净利润同比增长320.4%。

多模态大模型提供的文生图、图生图、文生视频、文生3D、数字人生成等能力,能够快速、生成海量高质量创意内容,颠覆了内容产业的商业模式。此外,大模型结合AI增强、云渲染等技术,还能广泛应用于生成高分辨率图片和视频、噪点消除、老片修复和上色、高精度3D建模和3维重建等场景。

值得注意的是,2023年5月几名B站UP主基于开源模型推出的AI孙燕姿,通过AI歌手演绎翻唱歌曲获得了巨大关注度。这也说明大模型爆款应用,可能不一定来自大公司,也有可能来自初创企业甚至技术达人。

  • 智能NPC

传统游戏中,NPC就像工具人,只能按部就班运行早已设定好的指令。如果NPC变成一个个智能体,具备不同的思想、性格和记忆,游戏世界该有多么精彩?是不是有种《西部世界》的感觉?

在大模型加持下,智能NPC能够在与玩家的交互过程中不断进化,发展出独特的游戏剧情,推动整个游戏世界的自我发展,重塑玩家体验。

目前,Ubisoft、网易等头部游戏公司已经尝试应用智能NPC。2023年,Open AI收购了一家名为Global Illumination的游戏公司,看重的正是其用ChatGPT驱动每个NPC角色的能力。

更重要的是,智能NPC让人们看到大模型+游戏产业背后更大的想象力,未来游戏中的其他元素,会不会也逐渐向AI生成的方向发展?

  • 量化投研

量化投研是指金融机构通过分析大量金融和市场数据,预测市场走势与价格波动,从而提供投资策略和建议。然而金融市场瞬息万变,传统的投研工作面临信息爆炸、数据碎片化、预测准确率低、时效性差等挑战。

大模型投研工具成为金融行业提升投研效率的新解法。2023年已有多家金融科技平台推出大模型投研工具,让投研工作更高效更轻松。量化投研大模型可以通过分析市场行情、量价关系、研究报告、企业财报、舆情和热点等海量数据,为专业人士快速提供投资组合建议和风险管理策略。

——大模型在政企领域的规模化应用场景——

大模型在政企领域的热门应用场景在政企领域,那些率先实现规模化应用的场景将围绕政企客户、重点行业与中小企业展开。

比如,政企AI算力调度平台能够实现本地算力与云上算力的统一管理调度,国产化AI大模型中心为政企客户提供从芯片到平台应用全栈自主可控的基础设施。

在新能源汽车、新零售、新制造等产业,智能驾驶、销售预测、柔性制造是大模型的热门落地场景。

为降低中小企业使用大模型的资金、技术、人才门槛,中小企业大模型体验版可以让中小企业通过快速训练推理出适合自己的大模型,实现跨越式发展。

云计算,大模型走向规模化应用的必经之路

尽管上述场景分散在各行各业,但如果非要找出这些场景的共同点,它们背后都有同一个不可忽视的驱动力,那就是云计算。

观察最头部的大模型应用创新,从ChatGPT到MidJourney,不难发现一流的大模型初创公司都背靠强大的云厂商。

如今,大模型领域的竞争已经转化为“云+AI”的体系化技术竞争。尤其是当大模型步入规模化应用阶段,云计算已经成为AI大模型创新发展的土壤。换句话说,大模型在千行万业能不能用得好,关键在于云计算。

我们也是时候重新认识云计算对于AI的价值了。

首先,弹性、可靠、高效的云上算力支持

大模型是算力无底洞,此前业界曾预测OpenAI训练GPT-4可能使用了大约10000-25000张GPU,这背后离不开微软云上算力的支撑。而且,大模型不仅需要海量算力,还要求算力具备灵活、弹性、可靠、高效等特性,云计算可以给到最佳解决方案。

国内云上AI算力供给,不得不提到华为云。华为云在贵安、乌兰察布、芜湖3大AI云算力中心及30多分节点,能够为企业提供澎湃昇腾AI算力。目前,昇腾AI算力可实现千卡训练30天长稳率达到90%,训练作业故障自动恢复,非自动场景下恢复时长小于30分钟,为千行百业使用大模型提供了稳定可靠、高质量的云底座。

此外,云上AI算力的可用性也是中国AI企业面临的新挑战。面对美国商务部抛出的“云上AI算力禁令”,华为云提供了充沛的昇腾算力,大大降低了中国企业云上AI算力被卡脖子的风险。

其次,基于系统级优化能力,实现降本增效

大模型也是吞金兽。大模型要想取得突破,消耗的算力资源每3-4个月就要翻一番。不久前,马斯克称参与AI军备竞赛的企业每年需要在AI硬件上投入数十亿美元,才能保持竞争力。

云计算是解决大模型成本问题的必由之路。一方面,云计算可以通过容器或Serverless技术,能够极大提升资源的复用率,让客户无需为闲置资源付费。另一方面,近年来云计算还在不断产生大量细分领域技术创新,专门针对AI、大模型的降本增效而生。

以前面提到的搜索增强场景为例,要构建搜索大模型增强能力,需要海量数据和AI算力资源,资金和时间成本巨大。解决这些痛点必须靠云基础设施层面的系统性优化。比如,华为云SFS Turbo可以大幅提升数据加载、训练数据读取速度,而且故障备份恢复快,实现千亿大模型ckpt文件秒级保存,让企业省钱更省心。华为云ModelArts AI加速套件,通过AI训练组网、集合通信算子及训练框架优化,可实现6千卡集群并行训练性能领先业界30%。

在AIGC场景下,华为云针对该场景的算子优化,能将整体性能提升30%。在某客户案例中,将图像生成模型迁移到昇腾后,通过AIGC生成一张图片的时间从6.2秒减少到5.2秒,并且通过AI渲染加速可以提升渲染效率2-4倍,大幅降低了内容生成时间和成本。


第三、海量AI应用创新的平台

云服务商不仅是底层资源的提供者,也是创新服务的构建者。如今越来越多的云厂商在MaaS新商业模式下不断探索,将AI和大模型能力作为创新云服务对外赋能。

比如,高峰期智能NPC每天都要面临海量玩家的实时交互,这让智能NPC对实时交互的时延和推理算力弹性扩缩容要求非常高。华为云与网易伏羲进行联合创新,通过网易伏羲构AI多云平台与华为云昇腾AI云服务的适配,在算子层和框架层进行大量性能优化。满足了交互场景的秒级时延要求,让智能NPC做到“忙时不慌,闲时不废”,保障了各时段玩家的体验。

Cloud for AI,云厂商破局的新机会

AI已经成为云计算产业发展的第二增长曲线。

得益于AI技术的发展,全球云计算行业实现再次加速。Synergy Research数据显示,全球企业2023年四季度在云计算的总支出达740亿美元,环比增长56亿美元,环比增速创下历史新高。预计2023年全球云计算行业收入将达到2700亿美元。

Synergy分析师John Dinsdale表示:“云计算是一个规模很大的市场,需要付出很大努力才能获得进展,但人工智能已经做到了这点。”他认为,在AI的助力下,接下来云计算市场规模还会继续增长。

2023年,大模型与生成式AI的火爆,让一个大趋势日益明晰:未来,几乎所有应用都会接入AI/大模型能力,我们将迎来一个AI原生应用的时代。

大模型给千行万业带来了新的生产方式、交互方式、业务范式、商业模式,未来各个产业对AI的需求(包括大模型产业链、云上算力、生成式AI)一定是大规模增长,这也给云计算产业带来了新的增长点。

在这样的大趋势下,Cloud for AI不仅是云厂商的新机会,也是必答题。纵观全球头部云厂商,都在探索如何基于AI重塑云计算技术和服务体系,开辟出全新的服务场景和服务内容。

国际云厂商方面,微软是AI助力云业务腾飞的典型案例。在2024财年第二财季(截至2023年12月31日),微软智能云Azure和其他云业务实现营收同比增长30%。目前,在微软智能云的5.3万名客户中,有三分之一都是2023年新加入的。

在国内,华为云则是Cloud for AI的深度践行者。华为云提供了从昇腾AI云服务、盘古系列大模型以及一系列AI研发工具套件在内的完整AI全栈技术平台。可以预见的是,在Cloud for AI的时代,AI将成为华为云一张独特的名片。

过去,大模型高高在上,很难落地。在经过一番痛苦的摸索与实践后,人们才发现,大模型落地的解法不在大模型本身,而在Cloud for AI。当Cloud for AI已就绪,当第一批TOP场景诞生,大模型才能真正驶向规模化应用的广阔星空。

文中图片来自摄图网

END

本文为「智能进化论」原创作品。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/1439577.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

DC-7靶机渗透详细流程

信息收集: 1.存活扫描: 由于靶机和kali都是nat的网卡,都在一个网段,我们用arp-scan会快一点: arp-scan arp-scan -I eth0 -l └─# arp-scan -I eth0 -l Interface: eth0, type: EN10MB, MAC: 00:0c:29:dd:ee:6…

如何应对Android面试官->实战高级UI,用自定义View画一条锦鲤(上)

前言 如何用自定义View画一条鱼,其中涉及到哪些知识点?我们先上效果图: 涉及的知识点: 整体可以分为三大步骤 小鱼的绘制小鱼的摆动点击之后小鱼的游动 小鱼的绘制 想实现小鱼的绘制,我们首先需要分解下这个小鱼都由…

re:从0开始的CSS学习之路 5. 颜色单位

0. 写在前面 没想到在CSS里也要再次了解这些颜色单位,感觉回到了大二的数字图像处理,可惜现在已经大四了,感觉并没有学会什么AI的东西 1. 颜色单位 预定义颜色名:HTML和CSS规定了147种颜色名。例如:red yellow green …

如何使用websocket

如何使用websocket 之前看到过一个面试题:吃饭点餐的小程序里,同一桌的用户点餐菜单如何做到的实时同步? 答案就是:使用websocket使数据变动时服务端实时推送消息给其他用户。 最近在我们自己的项目中我也遇到了类似问题&#xf…

Django模板(二)

标签if 标签在渲染过程中提供使用逻辑的方法,比如:if和for 标签被 {% 和 %} 包围,如下所示: 由于在模板中,没有办法通过代码缩进判断代码块,所以控制标签都需要有结束的标签 if判断标签{% if %} {% endif %} : # athlete_list 不为空 {% if athlete_list %}# 输出 ath…

Qt 常用算法及正则表达式

目录 常用算法 正则表达式 常用算法 double c qAbs(a),函数 qAbs() 返回 double 型数值 a 的绝对值 double max qMax(b,c),函数 qMax() 返回两个数值中的最大值 int bnqRound(b),返回一个与浮点数最接近的整数值(四舍五入) int cn q…

PyTorch深度学习实战(23)——从零开始实现SSD目标检测

PyTorch深度学习实战(23)——从零开始实现SSD目标检测 0. 前言1. SSD 目标检测模型1.1 SSD 网络架构1.2 利用不同网络层执行边界框和类别预测1.3 不同网络层中默认框的尺寸和宽高比1.4 数据准备1.5 模型训练 2. 实现 SSD 目标检测2.1 SSD300 架构2.2 Mul…

【Git版本控制 02】分支管理

目录 一、创建分支 二、切换分支 三、合并分支 四、删除分支 五、合并冲突 六、分支策略 七、bug分支 一、创建分支 # 当前仓库只有 master 一个主分支 # 可通过 git branch 是进行分支管理的命令,可通过不同参数对分支进行查看、创建、删除(base) [rootloc…

FXTM富拓监管变更!2024开年连续3家交易商注销牌照

交易商的监管信息是经常发生变更的,即使第一次投资时查询平台监管牌照,投资者仍需持续关注其监管动态。千万不要以为第一步审核好后就万事大吉了! 2024年开年,就有3家交易商的重要信息发生变更,注销其金融监管牌照&…

Canvas的js库:Konva.js-像操作DOM一样,操作canvas

hello,我是贝格前端工场,最近在学习canvas,分享一些canvas的一些知识点笔记,本期分享Konva.js这个canvas框架,欢迎老铁们一同学习,欢迎关注,如有前端项目可以私信贝格。 Konva.js是一个强大的HT…

零基础学Python之整合MySQL

Python 标准数据库接口为 Python DB-API,Python DB-API为开发人员提供了数据库应用编程接口。 不同的数据库你需要下载不同的DB API模块,例如你需要访问Oracle数据库和Mysql数据,你需要下载Oracle和MySQL数据库模块。 DB-API 是一个规范. 它…

Spring Boot3整合Redis

⛰️个人主页: 蒾酒 🔥系列专栏:《spring boot实战》 🌊山高路远,行路漫漫,终有归途。 目录 前置条件 1.导依赖 2.配置连接信息以及连接池参数 3.配置序列化方式 4.编写测试 前置条件 已经初始化好一个spr…

【daily updating】k3s kubeedge + opendFaas搭建教程 —— 欢迎交流

OpenFaas从入门到实战 – 踩坑指南 | k3dOpenFaas | deploy your first python function https://blog.alexellis.io/first-faas-python-function/ https://docs.openfaas.com/deployment/kubernetes/ 搭建环境:第一种方法失败,第二种方法…

1572.矩阵对角线元素的和(Java)

题目描述: 给你一个正方形矩阵 mat,请你返回矩阵对角线元素的和。 请你返回在矩阵主对角线上的元素和副对角线上且不在主对角线上元素的和。 输入: mat [[1,2,3], [4,5,6], [7,8,9]] 输出: 25 解释:对角线的和为&…

cleanmymacX和腾讯柠檬哪个好用

很多小伙伴在使用Mac时,会遇到硬盘空间不足的情况。遇到这种情况,我们能做的就是清理掉一些不需要的软件或者一些占用磁盘空间较大的文件来腾出空间。我们可以借助一些专门的清理工具,本文中我们来推荐几款好用的Mac知名的清理软件。并且将Cl…

【Docker】Docker Image(镜像)

文章目录 一、Docker镜像是什么?二、镜像生活案例三、为什么需要镜像四、镜像命令详解docker rmidocker savedocker loaddocker historydocker image prune 五、镜像操作案例六、镜像综合实战实战一、离线迁移镜像实战二、镜像存储的压缩与共享 一、Docker镜像是什么…

上下固定中间自适应布局

实现上下固定中间自适应布局 1.通过position:absolute实现 定义如下结构 <body> <div class="container"> <div class="top"></div> <div class="center"></div> <div class="bottom"&…

2023年12月 Python(三级)真题解析#中国电子学会#全国青少年软件编程等级考试

Python等级考试(1~6级)全部真题・点这里 一、单选题(共25题,共50分) 第1题 一个非零的二进制正整数,在其末尾添加两个“0”,则该新数将是原数的?( ) A:10倍 B:2倍 C:4倍 D:8倍 答案:C 二进制进位规则是逢二进一,因此末尾添加一个0,是扩大2倍,添加两个0…

Redis篇之集群

一、主从复制 1.实现主从作用 单节点Redis的并发能力是有上限的&#xff0c;要进一步提高Redis的并发能力&#xff0c;就需要搭建主从集群&#xff0c;实现读写分离。主节点用来写的操作&#xff0c;从节点用来读操作&#xff0c;并且主节点发生写操作后&#xff0c;会把数据同…

LeetCode 133:克隆图(图的深度优先遍历DFS和广度优先遍历BFS)

回顾 图的Node数据结构 图的数据结构&#xff0c;以下两种都可以&#xff0c;dfs和bfs的板子是不变的。 class Node {public int val;public List<Node> neighbors;public Node() {val 0;neighbors new ArrayList<Node>();}public Node(int _val) {val _val;…