中国国产AI芯片的崛起

news2024/12/24 2:25:43

一、CUDA的垄断

        当讨论半导体行业面临的挑战时,你首先想到的是什么?光刻机?3纳米或者5纳米技术?我们无法生产的完美方形芯片?是的,但也不完全是。

        人们经常把半导体芯片归类为硬件产业,但实际上,半导体芯片是一个硬件和软件高度融合的产业,而且软件往往发挥更重要的作用。

        芯片的硬件是指运行指令的物理平台,包括处理器、内存、存储设备等。“晶体管数量”和“7 纳米工艺”等与芯片相关的术语就是硬件参数的示例。

        另一方面,软件包括固件、驱动程序、操作系统、应用程序、运算符、编译器、开发工具、模型优化、部署工具和应用程序生态系统等。软件指导硬件如何响应用户指令、处理数据和任务,同时通过特定算法和策略优化硬件资源的使用。“x86 指令集”、“深度学习运算符”和“CUDA 平台”等术语通常与芯片软件有关。

        没有硬件,软件就无法运行。然而,没有软件,硬件只是一堆毫无意义的硅片。

        2012年,随着深度学习与GPU的结合在ImageNet大赛上大放异彩,人工智能一夜之间风靡全球,科技界开始将目光聚焦人工智能领域,深耕CUDA人工智能计算平台的英伟达股价一路飙升,成为新时代的主导力量。

        然而,软件将成为人工智能时代的核心技术壁垒。

        为了打破 Nvidia 的垄断,前芯片老大英特尔和老对手 AMD 分别推出了 OneAPI 和 ROCm,与 CUDA 展开竞争。Linux 基金会联合英特尔、谷歌、高通、Arm、三星等公司成立了 UXL 基金会(俗称“反 CUDA 联盟”),致力于开发一套新的开源软件套件,让 AI 开发者可以在任何成员公司的芯片上进行编程,试图取代 CUDA 成为首选的 AI 开发平台。

        相反,Nvidia 一直在巩固其 CUDA 护城河。

        早在 2021 年,Nvidia 就公开表示禁止使用转换层在其他硬件平台上运行基于 CUDA 的软件,并于 2024 年 3 月将此升级为彻底禁止,直接在 CUDA 的最终用户许可协议中添加条款。

        对于中国用户来说,这项禁令的打击更大。

        2022年,英伟达被要求停止向中国市场供应高端GPU芯片,有效封锁了中国的GPU芯片采购渠道。

        如今其他芯片上运行CUDA软件也被禁止,中国AI企业该怎么办?

二、中国国产AI芯片的崛起

        其实早在禁令颁布之前,中国芯片企业就已做好了准备。2015年,中国人工智能产业蓬勃发展,出现了“人工智能四龙”引领产业发展。

        在这波因对卷积神经网络(CNN)的兴趣而引发的人工智能浪潮中,中国企业认识到了国产人工智能芯片的重要性。

        这一时期,中国涌现出近百家AI芯片企业,既有寒武纪、必任科技、厚墨等创业公司,也有华为、阿里巴巴、百度等科技巨头,以及传统芯片厂商、挖矿设备厂商。

        大家都纷纷加入这股潮流,整个行业蓬勃发展,似乎都有一个共同的目标:打造自主可控的国产AI芯片生态。

        在此推动下,中国AI芯片企业很早就意识到了软件、工具和生态对于芯片的重要性,因此在不断升级迭代硬件产品的同时,投入了大量的时间和精力去解决软件相关的问题。

        CUDA 是一个封闭的软件平台,因此从头开始构建原始软件堆栈是突破 CUDA 生态系统障碍的关键。

三、中国AI芯片软件平台概况

        中国的AI芯片创业公司在云端、边缘端领域蓬勃发展,各有千秋。例如,必韧科技开发了BIRENSUPA软件平台,包括硬件抽象层、编程模型、BRCC编译器、深度学习和通用计算加速库、工具链、支持主流深度学习框架、自研推理加速引擎以及适用于各种场景的应用SDK,是国内为数不多的综合性AI软件开发平台之一。

        此外,专注于云端及车规级AI芯片的寒武纪推出了基础软件平台;专注于集成式智能驾驶芯片的厚墨科技也推出了厚墨大道软件平台;专注于全GPU的摩尔线程推出了MUSA SDK及AI软件平台;专注于通用GPU(GPGPU)的天数芯推出了天数芯软件栈。

        与中国早期白手起家的芯片研究人员不同,当代中国AI芯片玩家大多拥有丰富的行业经验,并了解类似CUDA的软件工具对于AI开发人员的关键重要性。

        因此,在2015年至2022年期间,这些玩家努力构建自己的硬件和软件生态系统。他们设法在国际层面上赶上了一些,尽管他们仍然远远落后于像Nvidia这样的全球巨头,但Nvidia并没有闲着,而是利用其在深度学习方面的专业性巩固了自己的地位。

        然而谁也没有想到,新的变革契机这么快就到来了,2022年11月,ChatGPT横空出世,再一次打破了行业的平衡。

四、大型模型是天赐的机会吗?

        2022年11月,随着ChatGPT在全球引起轰动,大型语言模型(LLM)突然成为全球追捧的前沿技术,热度远超CNN。

        对于一些中国AI芯片制造商来说,这被视为赶上竞争潮流的天赐良机。

        更加有利的是,LLM的技术基础是Transformer网络,其最初有BERT、T5、GPT三条不同的路径。

        然而,自从ChatGPT的惊艳亮相后,GPT已经成为了绝对的主流,引领全球AI产业走向统一的认识。

        在AI技术发展史上,如此程度的团结几乎是闻所未闻的。

        CUDA的先发优势因此而突然缩小。

        正是因为这种快速的融合,中国AI芯片厂商才得以快速上手对大型模型进行调优和适配,更重​​要的是,此时他们已经可以与其他国际厂商在同一起跑线上。

        目前,在Nvidia严禁在其他AI芯片硬件平台上运行CUDA,加之美国芯片禁令进一步加重、全球算力紧缺的背景下,中国大模型软件公司难以获得最前沿的GPU芯片,因此如何将现有的大模型迁移到新的计算平台上成为首要解决的痛点。

        鉴于大模型训练对计算集群的迫切需求,国内AI芯片企业正致力于加强集群能力。以采用GPGPU架构的璧人为例,客户反馈璧人的SUPA在软件团队的支持下,短时间内完成了实际应用迁移,在主流开源大模型上的表现也呈现出良好的效果。

        如果AI芯片厂商能够提供简单易用、低成本的迁移工具,有完善的模型适配能力以及成熟的集群部署经验,那么大模型的快速落地就变得可行。

        包括必韧在内的多家中国公司已完成对国内大部分开源大模型的适配,积累了丰富的千卡集群部署经验,中国大模型合作伙伴自研模型适配时间已大幅缩短。除了帮助用户快速从CUDA迁移到SUPA生态之外,大型模型公司还可以利用Biren的架构特性和SUPA的能力来扩展CUDA生态,进一步提升性能。

        通过自下而上的开发,Biren 可以最大限度地发挥其硬件优势,确保无论硬件到终端应用程序如何变化,其软件堆栈始终能够进行优化、迭代和调整。

        当前,除了芯片层面,大机型软件、算力、云计算等层面的国产化也在积极推进。

        AI芯片公司作为整个AI生态的基础构建者,寻求与大型模型、框架、集群公司进行深度合作,以最大化整体性能。

        例如,必韧科技不仅与PaddlePaddle等框架开发商合作,不仅满足企业用户符合国际标准的开发需求,还专门定制了与国内环境兼容的解决方案,为中国AI企业提供更为顺畅的融入之路。

        同时,必韧还与Infinigence等中国算力优化公司达成合作,进一步高效推动AI计算的本土化发展。

        为破解生态瓶颈,璧人通过搭建算力平台、开源相关工具和库、开放上层模型等方式推进软件平台建设,与框架、大模型合作伙伴进行联合适配优化,建立生态合作,并通过与高校、科研机构、终端客户等开展产学研合作等多种方式推进落地。

        软件无疑是最难突破的一道坎,也是目前各大AI芯片公司的共识重点。通过产学研的共同努力,一定可以取得突破。例如浙江大学的AI教学平台Mo,就利用比人软硬件资源作为教学实践的基础,为学生提供实践机会,为国产软件生态的长远发展播下种子。

五、结论

        毫无疑问,算力已成为人工智能时代的战场,算力的严重短缺制约着各国人工智能技术的发展。

        据报道,OpenAI首席执行官Sam Altman曾表示,“计算能力将成为未来的货币”,暗示人工智能的发展将演变为公司、组织甚至国家之间的大规模权力斗争。

        目前,Nvidia的GPU硬件凭借CUDA软件方面的优势,受到市场热捧,长期处于供不应求的状态。而大模型取代深度神经网络成为新一代AI技术的兴起,恰恰给了中国AI芯片玩家一个难得的追赶机会。

        回顾过去二十年,英伟达之所以能主宰AI时代,得益于其在AI领域的先发优势,借助深度学习的浪潮,凭借CUDA平台取得对英特尔的战略优势。

        如今,一条崭新的道路即将再次出现,但这一次,中国企业已经做好准备。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/1890033.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

mmcv安装失败及解决方案

假如想安装的版本是mmcv1.4.0, 但是pip install mmcv1.4.0总是失败,若是直接pip install mmcv会安装成功,但是安装的就是最新版本,后面代码跑起来还会报错,怎么办呢? 接下来分享一个mmcv指定版本安装的方式。 网页&a…

PCL小笔记

一、常用概念 1,过滤器Filters 消除噪音 2,特征Features 集合点属性:曲面的曲率估计和查询点的法线 通过k-neighborhood计算得到这两个属性作为特征 查找方法:KD-tress、八叉树等 3,关键点Keypoints 可以利用明确标…

ios-实验室暑假培训(1)

一 组队 在正式培训之前,也是数模比赛的众中之重。 一定要商讨好组队的相关事宜!要求建模/编程/写作/写作三方能力交叉! 而这三个当中,决定比赛拿奖上限的是编程手,决定比赛能不能拿奖的是写作手。而建模的更像是一个…

【JavaWeb】登录校验-会话技术(一)Cookie与Session

登录校验 实现登陆后才能访问后端系统页面,不登陆则跳转登陆页面进行登陆。 首先我们在宏观上先有一个认知: HTTP协议是无状态协议。即每一次请求都是独立的,下一次请求并不会携带上一次请求的数据。 因此当我们通过浏览器访问登录后&#…

Cyuyan中的自定义类型——结构体

提示:文章写完后,目录可以自动生成,如何生成可参考右边的帮助文档 文章目录 前言一、结构体基础知识(一)、结构体类型的声明、变量的创建与初始化(二)、结构成员访问操作符(三&#…

近红外光谱脑功能成像(fNIRS):1.光学原理、变量选取与预处理

一、朗伯-比尔定律与修正的朗伯-比尔定律 朗伯-比尔定律 是一个描述光通过溶液时被吸收的规律。想象你有一杯有色液体,比如一杯红茶。当你用一束光照射这杯液体时,光的一部分会被液体吸收,导致透过液体的光变弱。朗伯-比尔定律告诉我们&#…

如何在主动动态安全中使用人工智能驱动的威胁分类提高防御精准度

面对当今世界不断演变的网络威胁,人工智能和网络安全将会发挥重要的防护作用。在数据泄露和网络攻击日益突出的时代,人工智能和网络安全之间的合作成为数字安全战场上的强大盟友。 本文将深入研究这两个领域的融合,揭示它们在彻底改变威胁检测…

未来的钥匙在于过去:学历史的真正意义,震惊!历史竟然是偶然的?从历史中寻找未来的方向!

我们自幼接受的教育是,学历史是为了相信历史是必然的。中国人民必然战胜日寇的侵略,解放思想和改革开放必定会发生,和平和发展必定是世界的主题,中国经济必定是高速增长…… 然而,在真正的历史学家眼中,历史…

什么是 Socks5 代理?了解和使用 SOCKS5 代理的终极指南

SOCKS5是什么以及它如何工作? 在网络和互联网协议领域,有多种工具和技术在确保安全高效的通信方面发挥着至关重要的作用。 SOCKS5 就是这样一个工具,它代表套接字安全版本 5。 在这篇博文中,我们将深入探讨 SOCKS5 的细节&…

实战项目——用Java实现图书管理系统

前言 首先既然是管理系统,那咱们就要实现以下这几个功能了--> 分析 1.首先是用户分为两种,一个是管理员,另一个是普通用户,既如此,可以定义一个用户类(user),在定义管理员类&am…

【后端面试题】【中间件】【NoSQL】MongoDB提高可用性的方案(主从结构、仲裁节点、分片、写入语义)

主从结构 MongoDB的高可用和别的中间件的高可用方案基本类似。比如在MySQL里,接触了分库分表和主从同步;在Redis里,Redis也有主从结构;在Kafka里,分区也是有主从结构的。 所以先介绍启用了主从同步 我们的系统有一个关…

【AIGC】DiffuToon:稳定的视频卡通化技术方案

论文:https://arxiv.org/pdf/2401.16224 github:https://github.com/modelscope/DiffSynth-Studio/tree/main/examples/Diffutoon 网络结构 两个主要分支:主要的卡通化管线和编辑分支 重要技术 使用了fastblend(无需模型的视频帧之间的平滑…

巴图自动化Profinet协议转Modbus协议模块接称重模块与PLC通讯

巴图自动化Profinet协议转Modbus协议模块(BT-MDPN10)是一种能够实现Modbus协议和Profinet协议之间转换的设备。Profinet协议转Modbus协议模块可提供单个或多个RS485接口,使得不同设备之间可以顺利进行通信,进一步提升了工业自动化…

IPFoxy Tips:为什么要选择动态住宅代理IP?

在大数据时代的背景下,代理IP成为了很多企业顺利开展的重要工具。代理IP地址可以分为住宅代理IP地址和数据中心代理IP地址。选择住宅代理IP的好处是可以实现真正的高匿名性,而使用数据中心代理IP可能会暴露自己使用代理的情况。 住宅代理IP是指互联网服务…

花两天手撸海纳嗨数数据分析系统,实现数据分析自给自足

我发现一款超好用的数据分析营销系统,且支持免费私有化部署。 机器准备 机器角色配置10.0.21.85主8核,12G,100G,Centos7.910.0.221.51辅8核,12G,100G,Centos7.910.0.221.55辅8核,12…

x86芯片定制,Ethercat芯片定制,适用于运动控制,工业总线等软硬一体机

x86芯片定制,Ethercat芯片定制 X86平台 我们的研发工程师已经积累了非常丰富的主板、整机设计经验,对接您的产品规格场景需求,快速交付样机,包含主板、BOX整机、平板电脑、CPCI等形态产品。降本、长生命周期、快速交付、及时响应…

电影院售票管理系统(小白)大佬求解

最近在写一个关于电影院售票管理系统的sm项目,但是在买票的环节出现了问题及点击选座购票,没有数据渲染出来,我不知道什么情况,所以问问。有没有大佬可以帮我解决这个问题?下面是我的。控制层,服务层&#…

systemctl命令使用

systemctl 作用:可以控制软件(服务)的启动、关闭、开机自启动 系统内置服务均可被systemctl控制第三方软件,如果自动注册了可以被systemctl控制第三方软件,如果没有自动注册,可以手动注册 语法 systemct…

《数据结构与算法基础 by王卓老师》学习笔记——2.5线性表的链式表示与实现1

1.链式表示 2.链表举例 3.链式存储的相关术语 4.三个讨论题

生成式人工智能与虚拟资产成为BGOV 2024的焦点议题

香港,2024年7月2日 — 一年一度的创新科技盛事BUSINESS GOVirtual (BGOV) 科技博览及会议将于2024年7月11日至12日在香港会议展览中心隆重举行。 展览及会议焦点两大科技趋势:生成式人工智能 (Generative AI) 和虚拟资产 生成式人工智能( Generative A…