许可优化
许可优化
产品
产品
解决方案
解决方案
服务支持
服务支持
关于
关于
软件库
当前位置:服务支持 >  软件文章 >  关于fluent 2024R2的GPU加速问题的官方介绍

关于fluent 2024R2的GPU加速问题的官方介绍

阅读数 3
点赞 0
article_banner


Ansys Fluent ®在商业计算流体力学 (CFD) 领域享有盛誉,因其通用求解器的多功能性而备受赞誉。其令人印象深刻的物理能力范围使得找到 Fluent 无法解决的问题似乎是不可能的。Fluent 在全球众多行业领域都有应用,特别是在汽车和航空航天领域,以及能源、材料和化学加工以及高科技行业。

Ansys 最近将对 AMD Instinct™ MI200 和 MI300 加速器的支持集成到其旗舰 CFD 求解器 Fluent 中,大大提高了模拟效率和能力。借助 Fluent GPU 求解器,曾经需要数周或数月才能完成的模拟现在可以在几小时或几天内完成。

Ansys Fluids 产品管理团队总监 Jeremy McCaslin 补充道:“仿真不再是一种商品,而是一种必需品。Fluent 客户需要更快地创新设计,更快地将产品推向市场,并以更可持续的方式完成所有这些工作。”他强调了 GPU 的能源效率,并指出:“大型计算中心消耗大量能源,而使用 AMD Instinct GPU 可以用更少的能源完成类似的计算任务。”

因此,Ansys Fluent 2024 R2 的发布是一个重要的里程碑。“这是我们第一个完全支持 AMD GPU 的版本,使我们的用户能够在 MI200 和 MI300 系列上开箱即用地运行 AMD Instinct GPU,”Ansys 杰出工程师 Rongguang Jia 说道。

McCaslin 描述了 Ansys 对 AMD GPU 支持的长期战略:“我们希望提供能够满足您所有需求的产品。” 通过在新版本中全面支持 AMD Instinct GPU 并战略性地优先开发功能,Fluent 软件旨在提供强大、全面且高效的解决方案。McCaslin 指出:“确保 GPU 支持的功能达到或超过客户期望至关重要。”

AMD HPC 公司副总裁 Travis Karr 补充道:“我们很高兴与 Ansys 密切合作,将业界领先的 Fluent 软件集成到 AMD 的高性能 Instinct 加速器中。Fluent 用户现在可以开箱即用地运行 AMD Instinct GPU,从而提高 CFD 效率并降低能耗。”

支持日益庞大和复杂的模拟

当然,许多客户的主要目标是能够更快地执行模拟并处理更复杂的任务。“曾经需要数周才能完成的高保真模拟,现在通过异构(CPU+GPU)计算,只需一两天即可完成。过去需要几天时间才能完成的模拟,现在只需要吃午饭的时间,从而可以实现更快的迭代和更大的创新,”McCaslin 分享道。他指出,虽然一些客户很高兴能够更快地运行现有模型的模拟,但其他客户则很高兴能够处理更大、更详细的模拟。“就在几年前,运行十亿个细胞感觉非常大。十亿个细胞似乎每天都在变小,”他说。

为此,将 AMD Instinct GPU 与 Fluent 软件集成可带来重大进步。McCaslin 解释说:“Fluent 的耦合求解器非常适合解决稳态问题的客户,因为它显著提高了稳健性和收敛时间。AMD Instinct MI300X 的高内存带宽和容量使其成为需要稳态分析的应用程序的理想选择。”他补充道:“但总的来说,所有模型都非常适合 AMD Instinct GPU。”

Karr 表示同意,“Ansys 有效利用了 AMD Instinct GPU 业界领先的内存容量和带宽,显著加速了复杂的模拟。

AMD Instinct MI300A APU 的一个突出特点是其共享的 GPU 和 CPU 内存,这可以让逻辑复杂的模型受益于继续在 AMD EPYC™ CPU 核心上运行,而计算要求更高的任务则由 GPU 核心处理,而无需大量数据传输。McCaslin 表示:“在 CPU 和 GPU 之间共享内存开辟了许多有趣的机会,可以将事物转移到 GPU 上,这样计算速度会更快。”能够在 CPU 上执行任务而没有数据移动问题,可以更快地向客户交付混合 CPU-GPU 解决方案。

McCaslin 强调了此类发展的实际好处,并指出 GPU 可以高效利用由 CPU 创建并反复修改的大型网格,而无需大量移动数据。“我们不想移动大量数据,只是为了让 GPU 能够访问 CPU 创建的网格,”他解释道。

McCaslin 表示:“我们的客户已经使用 CPU CFD 数十年,这些工作流是多年来开发的。如果我们能向已经在 CPU 集群上运行了 15 年传统工作流的客户展示‘嘿,看,我可以为你提供相同的结果,但速度要快 10 倍,有时甚至更快’,他们就会做出改变。”他指的是采用 AMD Instinct GPU 和异构工作负载。

Fluent 多 GPU 解算器的扩展用例和硬件选项

在之前的版本中,Fluent 多 GPU 求解器仅支持 NVIDIA GPU 卡。在 2024 R2 中,我们扩展了 GPU 硬件选项,在 Instinct MI200 和 MI300 系列加速器上包括 AMD GPU。随着新 GPU 硬件的推出,Ansys 致力于支持新的硬件选项,以便用户可以从最新技术中受益。 图 2. 使用 DrivAer 模型时,基于 NVIDIA GPU 卡的类型和数量的性能提升。 *值得注意的性能统计数据:40 分钟内完成瞬态尺度解析案例,时间步长为 10,000。(MIUPS = 每秒百万次单元迭代更新)

除了硬件兼容性之外,我们还在 Fluent GPU 求解器中引入了新物理学,为新的用例和行业应用打开了大门。

对于航空航天和国防 (A&D) 应用,Fluent GPU 解算器现在支持可压缩流和远场边界条件。这使得从事跨音速至超音速高速飞行器的工程师能够在 GPU 上运行他们的研究。从事环境、大气或其他工业应用的用户也可以从引入可压缩流中受益。

查看白皮书“ Ansys Fluent Native Multi-GPU 求解器:2023 R2 版本中的 CFD 验证研究”,详细了解与传统 Fluent CPU 求解器相比的求解器精度以及实验数据。

此外,对于高科技、汽车和制造领域的工程师来说,现在支持各向异性热导率。这为涉及电动机、印刷电路板 (PCB)、热交换器等的研究打开了大门。

现已完全支持离散条例 (DO) 辐射,为从事燃气轮机、喷气发动机、发电等推进系统的工程师提供高级燃烧研究。

最后,2024 R2 还进行了一些可扩展性改进。在 2024 R1 中,我们看到可扩展性达到 1000 多万个单元的范围,但在此之后可扩展性逐渐减弱。在 2024 R2 中,我们进行了开发工作以提高可扩展性。现在,您可以看到性能和加速改进,每张卡的单元数量要少得多。图 4 显示,每张卡的单元数量少于 400 万个时并行效率超过 70%。







免责声明:本文系网络转载或改编,未找到原创作者,版权归原作者所有。如涉及版权,请联系删

相关文章
技术文档
QR Code
微信扫一扫,欢迎咨询~
customer

online

联系我们
武汉格发信息技术有限公司
湖北省武汉市经开区科技园西路6号103孵化器
电话:155-2731-8020 座机:027-59821821
邮件:tanzw@gofarlic.com
Copyright © 2023 Gofarsoft Co.,Ltd. 保留所有权利
遇到许可问题?该如何解决!?
评估许可证实际采购量? 
不清楚软件许可证使用数据? 
收到软件厂商律师函!?  
想要少购买点许可证,节省费用? 
收到软件厂商侵权通告!?  
有正版license,但许可证不够用,需要新购? 
联系方式 board-phone 155-2731-8020
close1
预留信息,一起解决您的问题
* 姓名:
* 手机:

* 公司名称:

姓名不为空

姓名不为空

姓名不为空
手机不正确

手机不正确

手机不正确
公司不为空

公司不为空

公司不为空