白莲花

WAIC上演超节点混战:观众扎堆拍照,业内呼吁算力产业生态真正开放_我的网站

整蛊专家

A |     8月25日消息,今日,豆包工作正式发布。    本文来源:时代周报 作者:朱成呈          今年WAIC,“超节点”在现场火了。作为豆包面向生产力场景推出的全新Agent产品与品牌,豆包工作能围绕用户目标自主拆解任务、调用工具、持续推进复杂工作流程。

B | 豆包工作还与飞书深度打通,让Agent基于企业上下文更准确地完成工作。         走进世博展览馆,华为、阿里巴巴、百度、中兴通讯、中科曙光、天数智芯、沐曦股份、摩尔线程等国产算力厂商,几乎都把各自最新的超节点产品摆在展台最显眼的位置。     目前,豆包工作电脑版已可通过官网下载,用户也可在最新豆包电脑版中直接使用。         一排排没有屏幕的黑色机柜,成为最引人关注的展品之一。即日起下载登录或升级,便可免费领取30天订阅权益。

C |          真武M890×磐久AL128超节点 时代周报记者摄          时代周报记者注意到,中科曙光带来全国产十万卡AI超集群"曙光8000(登峰)",阿里巴巴展示"真武M890×磐久AL128超节点",中兴通讯推出OEX超节点,百度带来天池512超节点,沐曦股份展示曦景S600超节点,壁仞科技发布支持1024卡Scale-up扩展的下一代NPO光互连分布式解耦架构超节点,华为则首次线下展示1024卡昇腾950超节点真机。

D |          无论是写方案、整理会议纪要、起草报告、做调研总结,还是做表格、分析数据,豆包工作都能交付高质量的任务结果。在更复杂的制作场景中,豆包工作还能生成和编辑图片、视频、网页甚至应用,能力覆盖面在同类产品中位居前列。         这些外观并不起眼的黑色机柜前,许多观众举着手机排队拍照,不少厂商甚至安排机器人在机柜旁互动,让原本冰冷的算力设备成为展会"打卡点"。    除了生成能力,强大的AI协作编辑能力让豆包工作更可“指哪改哪”。         这种变化并非偶然。     用户对生成的文档、表格、PPT 或网页里的任意部分,直接框选后便可进行改动,而非重新生成,既节省了算力消耗,也提升了任务完成速度。过去几年,AI产业竞争更多集中在单颗芯片的算力、功耗和制程;而随着大模型训练和推理迈入万卡、十万卡时代,行业开始意识到,仅有高性能芯片已经不足以支撑模型持续扩张。如何将数百、数千甚至上万张AI卡高效连接,并通过网络、软件和调度系统充分释放集群性能,正成为新的竞争重点。

E | 人和AI之间也不用反复“再来一遍”,而是打磨到成品交付。         换句话说,AI产业竞争正逐渐从芯片本身,转向芯片之上的系统能力。    在更复杂的工作场景中,豆包工作还能直接操作浏览器和电脑。

F |          这一趋势同样体现在大会官方评选中。     获得用户授权后,豆包工作便能跨软件完成任务,用专业软件处理数据、浏览网页收集信息、填表单、比对资料。今年WAIC三项"镇馆之宝"均与超节点相关,分别为中科曙光AI超集群"曙光8000(登峰)"、阿里巴巴"真武M890×磐久AL128超节点"以及中兴通讯"OEX超节点"。需要长时间运行的任务,它还能调用云电脑继续执行,即使电脑关机,任务也能持续推进。         在业内人士看来,这不仅意味着几款产品获得认可,更意味着国产AI算力竞争正在进入新的阶段。         "随着大模型加快进入各类业务场景,算力需求正从训练进一步扩展至推理和边端计算。峰值性能仍是重要指标,但产品的实际表现,越来越取决于芯片、软件、集群和应用之间的协同效率。"天数智芯副总裁邹翾在WAIC期间表示。

G | 同时,用户还可通过手机远程操控电脑,在外出时继续推进未完成的工作。         “单卡时代”过去了?          如果说过去AI产业竞争比拼的是发动机,那么如今比拼的更像是一整套动力系统。

H |     围绕更多样化的工作需求,技能、连接器、工作伙伴等AI生态能力也必不可少。         随着模型参数规模持续增长,先进大模型训练往往需要数万张GPU协同运行。此时,真正影响训练效率的,不再只是单颗GPU性能,而是整个系统如何组织这些GPU完成高效协同计算。     用户在豆包工作中可根据自己的任务需要扩展能力边界,调用不同的工具和外部能力来处理复杂流程,这些工具覆盖了数据分析、内容策划、科研、金融等多个不同专业方向。         曦景S600超节点 时代周报记者摄          业内通常将通过高速互连,将数百甚至上千张AI卡组织成统一计算资源池的系统称为"超节点"。此外,用户还能选择多个专业Agent组成工作小队,分工协作完成复杂任务,例如制作数据调研报告时,就能联动数据、研究、设计类智能体,各展所长、协同推进。例如,摩尔线程MTT C256 超节点,就是用一层scale-up网络把256张GPU变成一台数据中心级计算机。    此外,豆包工作较一般Agent工具还有最大的不同——对用户工作上下文的深度理解。     通过与飞书的深度打通,用户在使用飞书账号登录豆包工作后,将完整继承其权限范围内的企业知识和工作上下文。         不过,超节点远非简单地将大量GPU堆叠在一起。

I |     在用户授权范围内,它能够调用飞书中天然沉淀的聊天记录、文档、会议纪要、日程等上下文,并结合相应工具完成工作。    也就是说,豆包工作并不仅仅依赖用户输入的一句话产出结果,而是基于飞书内的真实上下文,更准确地理解目标、判断问题并交付工作。一名摩尔线程现场工作人员向时代周报记者表示,“我们通过高效液冷散热、三盲插设计、完善的RAS机制和集群管理系统,来保障超节点在大规模部署下的稳定性和可维护性。这是基于真实万卡级训练经验沉淀下来的产品化能力,而非单纯的概念堆砌。在豆包工作发布后,飞书内的原豆包企业版入口也已升级为豆包工作。     更进一步的是,用户和豆包工作一起创作的内容和知识,也会持续沉淀回飞书,成为可以二次编辑、分享和复用的企业知识。在下次执行任务时,豆包工作能基于持续丰富的上下文,把活干得更好。”          不同厂商也在尝试不同的系统方案。

J | 天数智芯现场工作人员向时代周报记者称,天数超节点面向大模型训练与高并发推理场景,以国产通用GPU为核心,实现144芯高速全互联,通过高带宽互联、统一资源调度和软硬件协同优化,提供稳定、可靠、可扩展的高质量算力。

K |     在企业级安全方面,豆包工作也打造了严格的全链路Agent安全防护体系,覆盖了设备接入、权限设置、额度管控、数据加密和操作审计等环节。         阿里云现场方面,一名工作人员则表示,磐久AL128超节点服务器是阿里云面向AI大模型时代打造的硬件基座,单柜集成128颗芯片,通过自研ALink互连架构,最大化GPU集群的协同计算效率。    同时,豆包工作严格继承飞书既有权限体系,用户只可在本人权限范围内读取数据和使用工具,个人数据与企业数据相互隔离。         在摩尔线程高级副总裁董龙飞看来,超节点要解决的是在一个大的系统里,如何把一个更大的模型,更大的上下文窗口放进来,还可以更快的推理出来。因为推理的速度慢了之后,调用工具就非常慢,超节点主要是为解决这个问题。目前,豆包工作已成为国内首批通过办公智能体能力与云端基准测试双项认证的办公智能体。         业内人士呼吁算力产业开放          相比单颗芯片,超节点竞争涉及的环节更多,也更加依赖产业链协同。    

              

     【本文结束】如需转载请务必注明出处:      责任编辑:秋白     文章内容举报     
。         天数智芯副总裁宋煜认为,对通用GPU而言,实验室指标能够反映部分性能,但客户业务中的长期运行,更能检验产品在复杂负载和系统协同下的实际能力。

L | 算力能否转化为效率改善、成本下降和资源利用率提升,是衡量其产业价值的重要标准。

M |          这意味着,行业评价标准也正在发生变化。         过去,人们关注TOPS、TFLOPS等芯片参数;如今,更关注训练吞吐率、网络时延、GPU利用率、集群稳定性以及整体拥有成本等系统指标。         由于一套成熟的超节点涉及芯片、交换网络、光互连、液冷、软件平台等多个环节,仅依靠一家企业已很难完成全部能力建设,开放生态因此成为国产算力发展的另一条主线。         中兴OEX超节点 时代周报记者摄          今年WAIC期间,中兴通讯联合壁仞科技、沐曦股份、燧原科技、天数智芯等合作伙伴,共同推出基于OEX+dOCS架构的国产高性能Matrix超节点,正是这一趋势的体现。         曦智科技创始人、董事长沈亦晨认为,当前最亟需补强的,是在庞大算力产业链中构建真正开放的产业生态,使计算、存储、交换、软件、应用等各环节的优秀企业最大化发挥各自优势,共同驱动中国算力基础设施的升级。         如果说芯片时代,比拼的是单点技术突破,那么系统时代,比拼的则是整个产业链的协同能力。         而超节点,也只是更大规模AI基础设施的起点。         “超节点更多是一个高密度的计算单元,把大量AI加速卡通过高速互连组织在一起,相当于把一台‘超级服务器’做得更强。

N | ”一名中科曙光技术工程师向时代周报记者解释,而超集群是在超节点基础上,通过高速网络把成百上千个超节点连接起来,实现十万卡级资源统一调度和协同运行,是一个完整的AI基础设施系统。         该技术工程师进一步指出,真正的挑战不在节点内部,而在节点之间。

o | 随着集群规模从千卡、万卡走向十万卡,跨节点通信会成为影响训练效率和系统稳定性的关键因素。

Current article:http://www.jiaopeikongbenlo.pics/sx4b7/wqwg.docx

Published on:08:46:01


用户评论
用户名:
E-mail:
评价等级:               
评价内容: