文心一言读取一份企业计划书,归纳出市场、成本和渠道方面的问题,中文语境下,它对一些行业说法的理解比海外模型更自然。
百度股价当天暴涨25%!
不过国内网友却没有因为它是国产产品就嘴下留情:
“女娲都上线一周了,文心一言怎么还在内部测试?”
“又是演示视频,能不能直接放出来?”
“百度搜索做了这么多年,中文数据肯定不缺。”
“有数据不代表能做出来!”
“别急着嘲讽,多一家能打的总比灵境一家独大好。”
“这句话我赞成,女娲VIP现在想涨价就涨价,得有人竞争!”
“先把产品做出来,再谈竞争。”
“文心一言这个名字还挺有味道,比Gemini强。”
百度方面没有正面比较文心一言和女娲。
一名高管在接受采访时表示,人工智能市场足够大,不会只有一家企业。
他说百度在搜索、地图、知识图谱和中文内容方面积累多年,能够走出与灵境不同的路线。
这番表态比较克制,却还是被媒体解读成了对女娲的挑战。
百度内部同样开始加班,原本负责搜索算法的工程师被调到文心一言项目,几座数据中心提高运行负载,训练所需的高端计算卡采购计划也被紧急上调。
英伟达华夏区的电话几乎被打爆。
百度想要卡,其他科技公司同样想要。
阿里表示正在研发面向企业和电商的大模型。
企鹅宣布成立通用人工智能实验室,准备把模型接入社交、游戏和云服务。
华为则透露,公司会重点研究工业大模型和端侧推理,不会照搬女娲的产品路线。
海外方面,微软、亚马逊、苹果和IBM也陆续表态。
微软准备把更多资源投入办公人工智能;亚马逊将训练面向云客户的基础模型;苹果强调设备端隐私,希望在手机和电脑上运行更轻量的模型;IBM仍然押注企业服务,表示不会参与面向普通用户的免费竞争。
一夜之间,全球科技公司都开始讨论大模型!
有项目的提前公布,没有项目的先成立部门,实在什么都没有的,也会对外宣布正在密切关注。
网友很快看烦了。
“昨天全世界只有女娲,今天全世界都有大模型了?”
“宣布研发谁不会,我还宣布明天造火箭呢!”
“这些公司以前干什么去了?”
“以前觉得通用模型不赚钱,现在看女娲把用户抢光,当然急了。”
“我只问一句,什么时候能用?”
“别急,PPT已经做好了!”
“PPT模型,参数无限大!”
玩笑归玩笑,市场已经意识到竞争真的开始了。
每家大公司都不愿意把未来入口交给灵境。
搜索公司怕用户不再搜索;社交平台怕用户时间被抢;电商平台想用模型提高推荐和客服效率;云计算企业则盯着训练和推理需要的庞大算力。
女娲一夜之间成了所有人的对手。
……
女娲的使用量随着舆论的热度持续增加。
4月6号晚上,海外节点首先出现异常,北美免费用户的排队时间超过六个小时,欧洲部分地区频繁掉线,亚洲主干网络的跨区流量也接近上限。
主控室里,警报一个接一个亮起。
“北美西部节点请求堆积!”
“欧洲数据库出现延迟!”
“国内三号集群的显存占用已经到上限!”
“排队服务也快撑不住了!”
季铭盯着大屏幕,连续调了几次资源。
空闲算力早已全部用上,女娲2.0的训练集群又被借走10%,剩下的部分只够维持基本训练。
当天深夜,全球注册用户已经逼近3亿,还有上千万人卡在注册页面,大量用户频繁刷新,注册服务承受的压力甚至超过模型接口。
季铭把最坏情况发给陈平。
“明天高峰期大概率会全面宕机!”
陈平当时正在姑苏人工智能研究院,看到消息后,他直接赶去主控室。
研发楼里没有多少人说话,所有人都知道服务器已经到了极限。
陈平问道:“新采购的计算卡什么时候到?”
“最快一批也要十天。”
“租用算力呢?”
“市场上能租的基本都被抢完了。”
“海外还有没有空闲节点?”
“有,但网络和合规都过不了。”
陈平看向大屏幕,代表正常的绿色区域正在不断缩小,黄色和红色几乎连成一片。
“暂停新用户注册。”
季铭迟疑了一下:“现在停?”
“现在停还能保住老用户。”
陈平说道:“再拖下去,大家一起崩!”
运营负责人马上去准备公告。
可他们还是慢了一步。
……
4月7号上午,亚洲用户进入使用高峰。
学生拿女娲查资料,公司员工用它处理邮件,程序员也开始一天的工作,数千万请求在短时间内同时涌入。
国内一号集群率先超载。
系统自动把请求转向二号集群,二号集群很快跟着达到极限,海外调度系统试图接管部分流量,网络延迟却迅速升高。
几分钟后,排队服务停止响应,用户看到的等待人数不再变化。
有人退出重进,页面直接变成空白。
随后,登录服务也出了问题,已经在线的用户收不到回答,新用户则无法进入账号,各地节点接连失去响应。
灵境ai全面宕机!
主控室的警报声响成一片。
“国内三个集群全部拒绝新请求!”
“欧洲节点正在重启!”
“北美数据库连接中断!”
“VIP算力池也被挤爆了!”
季铭马上下令切断免费流量,优先恢复VIP服务。
但操作没有成功。
注册、登录和模型服务使用了部分公共基础设施,前端流量已经把公共服务压垮。
“断开外部入口!”
“先保数据库!”
“停止所有跨区调度!”
“把训练集群彻底隔离,别让故障蔓延过去!”
工程师们忙得手忙脚乱。
这是自女娲上线以来,灵境第一次主动关闭全球入口!
国内外用户几乎同时看到维护页面:“系统正在紧急维护,请稍后再试!”
社交平台瞬间炸了。
“女娲真崩了!”
“我刚写一半的代码还在里面!”
“我的合同分析没有保存,谁赔我?”
“VIP也进不去,付钱有什么用?”
“昨天还说全球第一,今天连首页都打不开!”
“谷歌是不是笑出声了?”
“Gemini还没上线,至少不会宕机!”
“没上线当然不会宕机!”
“百度赶紧发文心一言,我受够排队了!”
故障持续了一个多小时,仍然没有恢复迹象。
灵境ai官方账号随后发布紧急公告:
“因全球访问量持续超过现有算力承载能力,灵境ai将暂停新用户注册,并对现有服务进行紧急维护。”
“维护期间,部分用户可能无法登录或使用女娲1.0,我们将优先恢复已注册用户服务,具体开放时间另行通知。”
公告最后向所有用户致歉。
“排了几天,轮到我就不让注册了?”
“什么时候重新开放?”
“我连账号都没有,VIP也买不了!”
“灵境这是搞饥饿营销吧?”
“都崩成这样了,还营销什么?”
已经注册的用户也没有轻松多少。
暂停新用户只是不再增加压力,现有四亿用户仍然远超灵境的承载能力。
有人怀疑女娲之前的成绩都是靠少量用户演示出来的。
“真正大规模使用就崩,说明技术根本没成熟!”
“模型再强,用户用不了也等于零!”
“女娲不是人工智能产品,是排队软件!”
“这几天吹得太狠,现在露馅了!”
大量企业用户同样受到影响。
客服分析停了,代码辅助停了,几家刚开始测试女娲的公司不得不恢复人工流程。
一名电商主管在网上抱怨,团队已经习惯先让女娲筛选投诉,现在系统突然不能用,积压记录很快堆了起来。
下面有人提醒他,关键业务不该依赖公测产品。
主管也承认公司准备不足。
“我们本来只想试两天,结果太好用,一不小心就离不开了。”
这句话得到很多企业用户认同。
女娲上线才一周,却已经进入不少人的工作流程。
全面宕机造成的影响,也比普通聊天软件大得多。
……
《华尔街日报》当天率先组织了一场专题讨论。
参与者包括云计算专家、半导体分析师和一家大型互联网公司的前基础设施负责人。
主持提出的第一个问题很直接。
“灵境ai全面宕机,说明女娲的技术被高估了吗?”
云计算专家给出的回答是否定的。
“模型能力和服务能力是两件事。”
他解释,女娲能够完成代码、文档任务,说明模型本身有效,全面宕机暴露的是基础设施不足。
传统互联网服务的单次请求,大多只是查询数据库或返回网页,女娲每回答一个问题,都需要大量计算。
问题越复杂,消耗的资源越多。
用户上传一份几百页的文档,系统要先读取、切分和理解,再生成回答。
代码和长对话需要的算力更高。
主持人追问:“谷歌和脸书拥有全球最大的数据中心,它们是否能避免类似问题?”
前基础设施负责人摇头。
“如果Gemini达到女娲现在的用户量,谷歌同样会有压力。”
谷歌的数据中心规模更大,也有自研计算芯片,情况肯定比灵境从容。
可通用模型的需求没有上限。
半导体分析师随后拿出一组估算,按照女娲当前用户规模,即便日活只有30%,每天每人平均发起10次普通请求,也需要一个极其庞大的计算集群。
如果其中10%的请求涉及长文档或复杂推理,硬件需求还要再翻几倍!
灵境声称缺少几十万张高端计算卡,此前有人觉得夸张。
现在从宕机情况看,这个缺口可能还算保守。
节目随后讨论了存储和网络。
模型参数需要存放在高带宽存储中,用户对话、上传文件和企业知识库也会产生海量数据。
服务器之间必须高速传输信息,普通网络根本跟不上。
当一台服务器无法独立完成任务时,多个计算节点要同时协作。
节点之间传得慢,再强的计算卡也只能等着。
CPO光模块因此变得重要,它负责在数据中心内部提供高速光通信,直接影响大规模集群的效率。
PCB同样不可忽视,高端计算卡、交换机和服务器主板都需要高层数、高频高速电路板。
模型规模越大,板卡设计越复杂。
散热和供电也成了问题。
几万张计算卡同时运行,耗电量足以接近一座小型城市。
热量排不出去,设备就会降频甚至停机。
节目最后给出结论:
“女娲宕机没有证明人工智能不行,恰恰证明现有硬件跟不上人工智能的需求!”
……
彭博社的分析更关注供应链。
报道调查了英伟达、AMD以及几家存储和光通信公司的订单。
女娲上线前,高端计算卡的交付周期已经拉长,谷歌宣布Gemini以后,又追加了一批数据中心设备。
百度、阿里和企鹅也开始争抢华夏市场的计算卡,微软与亚马逊则向供应商提出新的年度采购目标。
几家公司需要的硬件加起来,远远超过现有产能。
一名供应链负责人向彭博社透露,最热门的计算卡已经排到一年以后,即使客户愿意提高价格,也无法立刻拿到货。
计算卡不是装好芯片就能出厂,高带宽存储、先进封装、服务器主板和光模块缺一不可,其中任何一个环节缺货,整套设备都无法交付。
报道重点提到全球几家存储龙头。
大模型训练需要的高带宽存储,比普通服务器内存复杂得多。
此前存储行业经历过一轮价格低迷,不少公司削减产能,女娲突然带来的需求,让原本偏紧的高端产线更加吃力。
一些企业已经接到客户要求,希望锁定未来两年的产能。
相应产品的价格也开始上涨,CPO板块的变化更加明显。
过去,光模块主要服务电信网络和普通数据中心。
人工智能集群需要更高的速度和更低的延迟。
一座大型训练中心可能使用几十万个高速光连接,谷歌、微软、灵境和百度只要各建几座集群,现有产能就会被迅速吃光。
PCB供应商同样接到了大量询价。
普通消费电子订单还在疲软,服务器和计算卡使用的高端板材却突然供不应求,几家公司临时调整产线,把更多资源转向数据中心产品。
彭博社在报道中写道:“市场曾经以为大模型竞争是算法公司的战争,女娲宕机提醒所有人,这场战争最终要靠工厂交货!”
报道发布后,资金开始涌入人工智能硬件板块。
4月7号美股开盘,高端计算卡板块率先上涨。
英伟达开盘暴涨18%!
AMD跳空高开14%!
几家服务器芯片和网络设备公司也出现大量买单。
真正让人意外的是存储板块。
此前还在为库存和价格发愁的几家全球存储龙头,股价集体大涨。
市场突然发现,高带宽存储可能成为比计算芯片更紧缺的资源!
三星电子宣布,人工智能相关产品的客户询价在一周内增加了五倍!
消息发出后,三星电子暗盘股价快速拉升,盘中一度上涨26%,创历史最大涨幅记录!
随后,海力士透露,高端存储产线今年的订单已经排满!
投资者根本不在意它上一季度利润下滑,大家买的是未来两年的预期。
光通信板块很快跟涨。
CPO概念此前只在少数专业投资者之间流传,普通股民甚至不知道这几个字母代表什么,女娲宕机以后,所有人都开始研究数据中心里的光连接。
“一台服务器算得快没用,服务器之间传不动还是白搭!”
“所以光模块相当于ai数据中心的高速公路?”
“差不多,车多了就得修更宽的路!”
“哪家公司做得最好?”
“你先别急着买,很多公司只是蹭概念!”
“现在还有不蹭ai的吗?”
CPO板块当天整体上涨超过15%!
几家小公司涨得更夸张。
其中一家企业只在投资者交流中提到,正在向客户送样人工智能数据中心使用的光模块,股价便迅速冲高。
PCB板块也被资金挖了出来。
高端服务器板需要承受更高频率和更大功率,技术要求远高于普通家电电路板,能够稳定量产高层数高速PCB的公司并不多!
研究报告一份接一份出现。
“算力芯片的隐形底座。”
“人工智能服务器扩产带来的PCB新周期。”
“高速材料需求有望翻倍。”
很多投资者直到这时才发现,一套人工智能服务器牵扯的产业链如此庞大。
芯片只是最显眼的部分。
后面还有存储、光模块、PCB、电源、散热、机柜和数据中心建设,只要全球科技公司真的按照公告投入大模型,这些东西都得重新采购。
当天,人工智能硬件板块的市值狂涨数千亿美元!
4月7号的全面宕机,没有让市场怀疑人工智能的价值。
它只让所有人看清了一件事:
通用人工智能的时代已经来了,全球现有的硬件却远远不够!
英伟达、AMD和全球存储龙头集体上涨,CPO与PCB板块也被资金推上高位。
几天前,女娲让美国人工智能软件股蒸发了数千亿美元;如今又是女娲,让整个硬件产业链迎来暴涨!
市场不会因为一场宕机停下来,它只会重新计算下一笔钱该流向哪里。
这一次,所有人都得出了同一个答案:
算力!