科技云报道:从“奇点”到“大爆炸”,生成式AI开启“十年周期”

科技云报道原创。

世界是复杂的,没有人知道未来会怎样,但如果单纯从技术的角度,我们总是能够沿着技术发展的路径,找到一些主导未来趋势的脉络。

从Sora到Suno,从OpenAI到Copilot、Blackwell,这些热词在大众眼里或许还分不清楚,但很多人已经用上各种“ChatGPT”,或聊天或创作。不知不觉间,我们已经卷入新一轮AI浪潮中。

这轮人工智能浪潮,自ChatGPT这类生成式AI工具问世,被迅速引爆。AI大模型从研究走向应用,复用成本大幅降低,各种应用得以更快渗透进各行各业。

IDC发布报告称,2027年全球人工智能IT总投资规模有望从2022年的1324.9亿美元增至2027年的5124.2亿美元,年复合增长率(CAGR)为31.1%。

聚焦生成式AI,IDC预测,全球生成式AI市场年复合增长率将达85.7%,到2027年全球生成式AI市场规模将接近1500亿美元。

英伟达CEO黄仁勋表示,生成式AI已经开启了全新的投资周期,已经进入了“十年周期”(技术从出现、传播到大规模应用所需的时间)的第一年。

当生成式AI从一个“奇点”到迎来“大爆炸”时刻,其将在现实世界发生哪些改变?又将激发怎样的潜力?在这里插入图片描述
生成式AI迎来“三个转变”

生成式AI技术可分为四个层次,即面向消费者应用;大语言模型(LLM)等基础技术;支持服务的云基础设施;以及对于开发和运营至关重要的半导体。

从技术发展看,今年生成式AI将从纯理论探讨阶段,全面进入到业务应用阶段。过去一年,大部分企业和机构并没有真正打造出生成式AI系统;而今年,生成式AI系统将全面进入到生产当中,企业将真正地开始使用生成式AI工具。

对于生成式AI本身,即将迎来三个方面的转变。

首先,要把生成式AI投入到企业以及业务用例的过程中,就要从构建训练基础架构转向构建推理基础架构。

到目前为止,大部分企业往往是通过对开源基础模型进行调优、优化或者是互联,来实现自己的某些功能和需求。

对于各个企业、各个垂直行业领域的企业来说,无论是GenAI还是GPT4,大语言模型的训练成本是高昂的。特别是对于垂直行业的企业用户,不会在业务推进过程中直接采用这些模型。

如果未来需要将AI能力赋予企业的业务,那么企业就需要进一步开发已有的模型,从而让这些模型在部署到垂直行业的生产中时,可以真正地转化为生产力。

而这种转变也对企业提出了更加明确的要求:如何更好地设计出这种推理基础架构?该把它们放在哪里?如何确保其安全?

其次,是企业的关注点将越来越多地将从宽泛的实验转向自上而下的战略推进,即挑选出少数几个真正具有变革意义的生成式AI应用项目。

去年,很多企业都在考虑采用生成式AI技术。但如今,企业已经认识到,要应用生成式AI技术,每个项目都非常庞大,需要占用大量人力、物力、财力,才能构建和实施一个能够投入生产的生成式AI系统。

到了今年,一方面,生成式AI领域将会有成百上千乃至上万的潜在用例,但另一方面,由于每一个企业的资源有限,因此只能选择其中几个重点实施。

对于企业的CIO和领导者,必然会面临一个问题:就是从几百个AI项目中,优先选择几个进行实施。这其中的风险在于:一旦选对了,这些项目将对业务产生正向影响;而万一选错,可能就会造成大量的资源浪费。

要想做出一个正确的选择,各个企业必须要充分理解GenAI价值,以及生成式AI最有可能从哪些方面能够为企业提升生产力而赋能。

第三,是用户对于AI投入的成本考量,从对“训练成本”的计算转向对“运营成本”的衡量。

在理论研究和训练阶段,生成式AI的成本取决于构建模型的复杂程度,以及架构开发和维护人员的规模,除此之外再无其他成本可言。

但当企业用户开始实施部署和应用生成式AI工具时,现实的运营成本就会成为企业用户面临的最大经济考量。

以戴尔科技为例,其最初开始建立自己的生成式AI系统时,基本上会在三个月的时间里用到20台服务器,此刻其整体运营成本是未知的。

但当这套系统开始被戴尔科技内部的工程师应用时,6000名工程师每个月就需要大约5000万次处理量,因此该系统最大的成本不是建立一个模型的成本,而是基于大规模处理而产生的巨额运营成本。

这对企业用户而言,从训练成本到运营成本的考虑,将是未来必将面对的一个相当现实的问题。

从本质上说,生成式AI的转变其实是技术从研发到应用的商用化过程中必然要经历的过程。

只是由于AI自身业务形态的改变,也将带来更多行业的改变,其中的一个影响就是会带动一批相关技术和应用,成为未来的热点和趋势。

如何激发生成式AI更大潜力

仅仅一年,随着各大资本和巨头入场,AI从底层大模型,到基础设施,到机器学习操作(MLOps),再到消费端应用,生成式AI的生态已经初步建立。

随着今年生成式AI的进一步训练和稳定,行业发展将加速向下游移动,生成式AI将进一步改变人们的生活,乃至改变整个世界,其为企业提供了无限的想象空间,使产品和服务的研发过程更加高效、有趣。

面对生成式AI市场的巨大潜力,亚马逊、谷歌、微软、Meta等科技巨头不甘示弱。去年12月,谷歌多模态大模型Gemini发布,包含三个版本:Nano、Pro和Ultra。

Pro对标GPT-3.5,Ultra对标GPT-4,可以处理文本之外的信息,包括图像、视频和音频。同时,谷歌上线文生图模型Imagen 2、视频生成模型VideoPoet,推出医疗人工智能大模型MedLM,将大模型与医疗保健行业紧密结合。

去年11月,微软将集成了GPT的Bing Chat更名为Copilot,可以免费使用GPT-4、DALL·E 3功能,并且拥有了独立网站,Copilot将嵌入所有微软旗下应用中。微软还推出Copilot Studio,使用者可以自定义GPT、创建新插件、自定义工作流。

Meta则接连发布了650亿参数的开源大模型 LLaMA和700亿参数的LLaMA2。近日,Meta推出全新开源大模型Code Llama 70B,其准确率达到了53%,超过了GPT-3.5的48.1%,是目前评分最高的开源大模型。

2023年以来,看似默默无闻的亚马逊频频出击。去年9月,亚马逊宣布将向人工智能初创公司Anthropic投资40亿美元,近日,其再次宣布追加投资27.5亿美元,完成了对Anthropic40亿美元的投资,决心可见一斑。

更为重要的是,亚马逊云科技提出了基于生成式AI的三层技术栈。

第一层是高性能基础设施,过去五年,亚马逊云科技持续加大在自研芯片方面的投入,比如Amazon Trainium和Amazon Inferentia芯片,可以提供在云上训练模型和运行推理的最低成本。

除此之外,在GPU方面,NVIDIA多款先进算力均率先在亚马逊云科技落地。

第二层是最广泛的基础模型选择。亚马逊云科技认为“没有一个模型可以适用于所有业务场景”,因此推出Amazon Bedrock,企业可以灵活选择适合自己的模型,更容易地构建应用,并在保证数据安全和隐私基础上,进行定制化模型的开发,还无需大量的标注数据。

Amazon Bedrock提供各种领先的基础模型供客户选择:既有知名的开源模型,如Stable Diffusion XL、Llama、Mistral 7B和Mixtral 8*7B,也有如Anthropic Claude 3、AI21labs Jurassic、Cohere Command、Amazon Titan等非开源模型。

基于Amazon Bedrock云托管服务,企业可以通过API访问从文本到图像的一系列强大的基础模型。

值得一提的是,亚马逊和Anthropic在生成式AI领域有着广泛的合作,Anthropic在Amazon Bedrock上提供的Claude 3系列模型是全球最领先的大模型之一,共包含三个模型:Haiku、Sonnet、Opus,从模型尺寸来看,可以理解为模型的中杯、大杯、超大杯。

客户可以根据自己的商业需求,从中选择最合适的智能、速度和价格组合。

· Haiku:是响应速度最快的模型,也是成本最低的选项,在大多数纯文本任务上的表现仍然相当出色,也同时包含多模态能力(比如视觉)。

· Sonnet:适用于需要平衡性能和成本的场景,它在纯文本任务上的表现与后面的Opus相当,但在成本上更为经济,适合于那些需要性能稍微好点,但预算有限的企业和个人用户。

· Opus:具有强大的推理、数学和编码能力,接近人类的理解能力,适用于需要高度智能和复杂任务处理的场景,如企业自动化、复杂金融预测、研究和开发等。

对于Claude 3,更有行业人士认为其终结了GPT-4时代。Claude 3有两大亮点,一个是长文本,二是多模态能力。

长文本是Claude 3的一个显著优势,体现为在读论文、小说等字数更多的文本时,Claude 3更擅长理解和回答用户的相关问题。

此次Claude 3大大提升了上下文对话窗口,达到200k,可以理解为单次和模型对话能够输入的文本。

具体而言,Claude 3 200k的对话长度,相当于能够单次处理超过15万英文单词,而GPT-4 Turbo的上下文窗口为128k,大约是9.6万个英文单词。同时,Claude 3也第一次允许图像和文档上传。

和ChatGPT一样,Claude 3能够“认”出来图里的是什么东西,直接描述,回答用户的问题。更令人印象深刻的是,Claude 3在分析一些复杂问题时,已经能够和人一样,先拆解问题,并且交由子模型来进行调度。

第三层就是应用生成式AI技术的开箱即用的云服务,进一步降低使用门槛。目前已经推出Amazon Q这一AI助手,可以根据客户业务进行定制,专用于办公场景需要。

还与像Amazon QuickSight,包括智能客服的产品Amazon Connect,面向编程开发人员的平台Amazon CodeWhisperer,都实现了非常有效的结合。

可以看到,从底层基础设施到上层应用拓展,今年亚马逊云科技在生成式AI领域不断发力。不同的客户可以根据需求选择不同层级的产品,通过这三层来支持他们的业务创新。

此外,对于如何帮助企业快速具备生成式AI能力,亚马逊云科技拥有丰富的专业技术支持资源,包括SA、产品专家、人工智能实验室、数据实验室、快速原型团队、专业服务团队,帮客户打通应用生成式AI的“最后三公里”工程化挑战。

对于作为扮演“底层架构师”角色的亚马逊云科技而言,大模型固然重要,但关键技术能力的集合才是提升企业生产力的根本动力。

亚马逊云科技大中华区产品部总经理陈晓建表示,“尽管大模型非常重要,但仅靠大模型对企业的生产是远远不够的。从模型能力到真正的运营生产之间,企业还需要增加很多辅助能力。企业需要一系列周边的能力来正确、合理、安全、高效地使用大模型,这就是亚马逊云科技一系列产品所提供的价值所在。”

生成式AI领域接下来发展的最关键一步是什么?陈晓建表示,首先,从最底层来看,芯片性能仍然落后于需求。虽然半导体芯片的发展已经非常快,但模型本身参数规模的扩大实际上远超芯片的能力。

“以前一个几百万参数的模型,就觉得已经很大了,但现在动辄达到数百亿的规模。基础服务商仍需关注如何将底层能力、业务复杂度和大模型复杂度相匹配,使硬件发展赶上软件发展规模。”

其次,他认为大模型能力本身还有很多发展空间,今天看到的模型可能代表了一个博士生水平,但是能不能做得更好?比如达到教授或者院士水平?

包括亚马逊云科技在内的诸多生成式AI供应商需要在未来持之以恒地去做模型能力方面的工作。

在最上层与各行各业务相结合方面,陈晓建表示,相关的SaaS解决方案非常多。

从这点上看,将生成式AI能力与垂直场景的解决方案结合需要做巨大的工作。“我们需要思考大模型如何为人类社会各行各业中的应用提供更好的模型能力、更易用的方式和更低的成本。”

无论如何,人们对未来的期许总是充满希望。对于科技未来的走向,以AI为代表的技术进化,正在成为一场考验人类想象力的比赛。

科技企业能做的,就是通过技术普惠,降低AI参与门槛,先把大模型打造成像电、水一样随取随用的公共资源,再将生成式AI技术应用于各行各业,变成真正能够推动人类发展的生产力。

【关于科技云报道】

专注于原创的企业级内容行家——科技云报道。成立于2015年,是前沿企业级IT领域Top10媒体。获工信部权威认可,可信云、全球云计算大会官方指定传播媒体之一。深入原创报道云计算、大数据、人工智能、区块链等领域。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:/a/531434.html

如若内容造成侵权/违法违规/事实不符,请联系我们进行投诉反馈qq邮箱809451989@qq.com,一经查实,立即删除!

相关文章

【Redis】底层跳表实现

先巩固Redis的数据类型以及底层的数据结构: ZSet(有序集合)可以使用两种不同的内部数据结构来表示:压缩列表(ziplist)和跳跃表(skiplist)。 跳表是redis底层SortedSet(ZSet)的数据…

JAVA并发编程(二)_线程池

JAVA线程池 1.1Java 线程池之 Executor 框架 为了实现线程池和管理线程池,JDK 给我们提供了基于 Executor 接口的一系列接口、抽象类、实现类,我们把它称作线程池的 Executor 框架,Executor 框架本质上是一个线程池; ​ Java 线…

Linux LVM磁盘扩容

1、查看磁盘情况 df -h df -h2、查看逻辑卷 lvdisplay lvdisplay3、查看逻辑组 vgdisplay vgdisplay4、查看物理卷 pvdisplay pvdisplay5、查看磁盘 fdisk -l fdisk -l6、磁盘分区fdisk /dev/磁盘名 # 上一步查看到的新硬盘路径 fdisk /dev/vdb7、格式化磁盘mkfs -t ext4…

【负载均衡——一致性哈希算法】

1.一致性哈希是什么 一致性哈希算法就很好地解决了分布式系统在扩容或者缩容时,发生过多的数据迁移的问题。 一致哈希算法也用了取模运算,但与哈希算法不同的是,哈希算法是对节点的数量进行取模运算,而一致哈希算法是对 2^32 进…

基于SSM+Jsp+Mysql的超市管理系统

开发语言:Java框架:ssm技术:JSPJDK版本:JDK1.8服务器:tomcat7数据库:mysql 5.7(一定要5.7版本)数据库工具:Navicat11开发软件:eclipse/myeclipse/ideaMaven包…

图片管理系统:原理、设计与实践

title: 图片管理系统:原理、设计与实践 date: 2024/4/9 20:04:25 updated: 2024/4/9 20:04:25 tags: 图片管理存储组织上传采集处理编辑搜索检索展示分享AI应用 第一章:图片管理系统概述 1.1 图片管理系统简介 图片管理系统是一种用于存储、组织、处理…

【Java网络编程】IP网络协议与TCP、UDP网络传输层协议

1.1、IP协议 当应用层的数据被封装后,想要将数据在网络上传输,数据究竟要被发往何处,又该如何精准的在网络上定位目标机器,此时起到关键作用的就是“IP协议”。IP协议的作用在于把各种数据包准确无误的传递给目标方,其…

力扣HOT100 - 56. 合并区间

解题思路: class Solution {public int[][] merge(int[][] intervals) {// 先按照区间起始位置排序Arrays.sort(intervals, (v1, v2) -> v1[0] - v2[0]);int[][] res new int[intervals.length][2];int idx -1;for (int[] interval : intervals) {//直接加入的…

前端实现打开新标签页后,再次定位到该标签页

需求 A 页面中点击按钮可以打开新的标签页 B 并且向 B 页面发送消息数据。 当新的标签页 B 未关闭且符合同源策略时&#xff0c;再次点击按钮&#xff0c;可以自动跳转到标签页 B 并且发生消息数据。 B.html <script>window.onmessage evt > {console.log(evt.d…

wps的1)2)3)编号,怎么更新

全部选中->格式刷->把它刷了必须全部选中

应急响应-挖矿脚本检测指南威胁情报样本定性文件清除入口修复

一、演示案例-挖矿样本-Win&Linux-危害&定性 危害&#xff1a;CPU拉满&#xff0c;网络阻塞&#xff0c;服务器卡顿等 定性&#xff1a;威胁情报平台上传解析分析&#xff0c;文件配置查看等windows样本 linux样本 二、演示案例-Linux-Web安全漏洞导致挖矿事件 某公司…

20240403-算法复习打卡day43||● 1049. 最后一块石头的重量 II ● 494. 目标和 ● 474.一和零

1049. 最后一块石头的重量 II class Solution { public:int lastStoneWeightII(vector<int>& stones) {vector<int> dp(15001, 0);int sum 0;for (int i 0; i < stones.size(); i) sum stones[i];int target sum / 2;for (int i 0; i < stones.siz…

C/C++与Python:各自的优势与前景展望

在讨论C/C和Python这两种编程语言的前景时&#xff0c;我们必须认识到每种语言都有其独特的定位和应用场景&#xff0c;并不存在绝对意义上的“谁更有前景”。它们分别在不同的领域发挥着重要作用&#xff0c;而且在未来的技术发展过程中&#xff0c;二者都将继续保持其不可替代…

600MA线性锂电池充电芯片 - YB4054DJ

描述: YB4054一款完整的单节锂离子电池充电器。其SOT23-5的封装与较少的外部元件数使得YB4054成为便携式应用的理想选择。采用了内部PMOSFET架构&#xff0c;加上防倒充电路&#xff0c;不需要外部检测电阻器和隔离二极管。热反馈可对充电电流进行自动调节&#xff0c;以便在大…

接口自动化测试要做什么?一文3个步骤带你成功学会!

先了解下接口测试流程&#xff1a; 1、需求分析 2、Api文档分析与评审 3、测试计划编写 4、用例设计与评审 5、环境搭建&#xff08;工具&#xff09; 6、执行用例 7、缺陷管理 8、测试报告 了解了接口测试的工作流程&#xff0c;那"接口自动化测试"怎么弄&#xff1…

深入浅出Redis(十一):Redis四种高级数据结构:Geosptial、Hypeloglog、Bitmap、Bloom Filter布隆过滤器

引言 Redis提供丰富的数据结构来解决各种场景下的问题&#xff0c;前段时间的一篇文章深入浅出Redis&#xff08;一&#xff09;&#xff1a;对象与数据结构已经深入浅出的说明Redis中的常用基础对象与数据结构 本篇文章将作为那篇文章的补充&#xff0c;深入浅出的解析另外四…

“春招市场”鸿蒙岗位增长163%!你想活出怎样的代码人生?

前段时间“智联招聘崩了”登上微博热搜。不少网友都感叹&#xff0c;可想而知今年的就业压力有多大&#xff0c;找工作真的太难了…… 金三银四&#xff0c;大家的求职热情暴涨到服务器都承受不住&#xff0c;都想在1179万毕业生中脱颖而出&#xff0c;开年春招就已经热辣滚烫……

B站广告推广操作教程及费用?

哔哩哔哩&#xff08;B站&#xff09;作为国内极具影响力的年轻人文化社区&#xff0c;已成为众多品牌与企业触达目标受众、提升品牌影响力的重要阵地。然而&#xff0c;面对B站复杂的广告系统与精细化运营需求&#xff0c;许多广告主可能对如何高效开展B站广告推广感到困惑。云…

03-JAVA设计模式-组合模式

组合模式 什么是组合模式 组合模式&#xff08;Composite Pattern&#xff09;允许你将对象组合成树形结构以表示“部分-整体”的层次结构&#xff0c;使得客户端以统一的方式处理单个对象和对象的组合。组合模式让你可以将对象组合成树形结构&#xff0c;并且能像单独对象一…

Python零基础从小白打怪升级中~~~~~~~文件和文件夹的操作 (1)

第七节&#xff1a;文件和文件夹的操作 一、IO流&#xff08;Stream&#xff09; 通过“流”的形式允许计算机程序使用相同的方式来访问不同的输入/输出源。stream是从起源&#xff08;source&#xff09;到接收的&#xff08;sink&#xff09;的有序数据。我们这里把输入/输…