阿里云AI基础设施升级亮相模型算力利用率提升超20%_阿里巴巴-SW(hk09988)股吧

股吧首页 > 阿里巴巴-SW吧 > 正文

最近访问：

阿里巴巴-SW吧

返回阿里巴巴-SW吧>>

- 重要股东股权质押数据全览

阿里巴巴-W资讯

发表于 2024-09-20 13:28:10 股吧网页版

阿里云AI基础设施升级亮相模型算力利用率提升超20%

来源：潮新闻作者：记者张云山

　　9月20日，2024云栖大会现场，阿里云全面展示了全新升级后的AIInfra系列产品及能力。通过全栈优化，阿里云打造出一套稳定和高效的AI基础设施，连续训练有效时长大于99%，模型算力利用率提升20%以上。

　　阿里云基础设施全面升级

　　“AI创新需要新形态的云基础设施。”阿里云副总裁、弹性计算及存储产品线负责人吴结生表示，阿里云整合底层的计算、存储、网络等资源，实现了统一调度和软硬一体优化，以满足模型训练和推理的爆发式AI算力需求。基于全新的CIPU2.0，阿里云新推出磐久AI服务器，实现单机16卡、显存1.5T以上，支持SolarRDMA互联。磐久AI服务器采用超钛金电源实现97%以上的高能效，并可通过AI算法预测GPU故障，准确率达92%，保障AI算力的性能和稳定性。在存储方面，阿里云并行文件存储CPFS实现端到端全链路性能提升，单客户端吞吐达25GB/s，高性能数据流动达到100GB/s，为AI智算提供指数级扩展存储能力。为AI设计的高性能网络架构HPN7.0，性能和稳定性也再次提升，其中，集合通信性能提升1倍以上，模型端到端训练性能提升10%以上。通过底层计算、存储、网络等基础设施的升级，阿里云灵骏集群可提供超大规模、超强性能的智能算力，万卡规模性能线性度超过96%，并行存储吞20TB/s，万卡规模下网络带宽利用率超过99%，可支持单集群十万卡级别AI算力规模。面向AI业务，阿里云计算产品也大幅演进更新。本次云栖大会上，容器服务ACK面向AI实现重磅升级，大模型应用冷启动延迟降低85%，并可提供15000个超大规模节点支持。同时，容器计算服务ACS即将推出GPU容器算力。

（文章来源：潮新闻） [点击查看原文]

郑重声明：用户在财富号/股吧/博客等社区发表的所有信息（包括但不限于文字、视频、音频、数据及图表）仅代表个人观点，与本网站立场无关，不对您构成任何投资建议，据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容，远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息，谨防上当受骗！

评论该主题

帖子不见了！怎么办？

作者：您目前是匿名发表登录 | 5秒注册作者：，欢迎留言退出发表新主题

郑重声明：用户在社区发表的所有资料、言论等仅代表个人观点，与本网站立场无关，不对您构成任何投资建议。用户应基于自己的独立判断，自行决定证券投资并承担相应风险。《东方财富社区管理规定》