|
本帖最后由 Liv_ 于 2026-6-10 15:07 编辑 2026年使用gmx2026-SYCL-windows版本,使用intelMKL数学库,RAM 24*2 ddr5 8000c36,cpu-265k(5.4+4.8) 使用16个物理核心,gpu-ARC A750 对文件夹中两个算例进行复测。 使用算例:STMV-NPT.tpr 使用命令以及结果: gmx mdrun -s STMV-NPT.tpr -ntmpi 1 -ntomp 16 -nb gpu -pme gpu -bonded gpu -update gpu -pin on -v -nsteps 50000 1 GPU selected for this run. Mapping of GPU IDs to the 2 GPU tasks in the 1 rank on this node: PP:2,PME:2 PP tasks will do non-perturbed short-ranged and most bonded interactions on the GPU PP task will update and constrain coordinates on the GPU PME tasks will do all aspects on the GPU Using 1 MPI thread Using 16 OpenMP threads 50000 steps, 100.0 ps. Core t (s) Wall t (s) (%) Time: 12448.000 778.000 1600.0 (ns/day) (hour/ns) (ms/step) (Matom*steps/s) Performance: 11.106 2.161 15.560 68.551 使用算例:STMV-GMX.tpr 使用命令以及结果: gmx mdrun -s STMV-GMX.tpr -ntmpi 1 -ntomp 16 -nb gpu -pme gpu -bonded gpu -update gpu -pin on -v -nsteps 50000 step 49900, remaining wall clock time: 1 s Writing final coordinates. Back Off! I just backed up confout.gro to ./#confout.gro.1# step 50000, remaining wall clock time: 0 s Core t (s) Wall t (s) (%) Time: 10416.000 651.000 1600.0 (ns/day) (hour/ns) (ms/step) (Matom*steps/s) Performance: 13.272 1.808 13.020 81.924 使用8p8e模拟7950x(5.4+4.8的大小核肯定不如pbo2+7950x),就结果来看,2026win版本使用intel显卡计算速度较2023linux的提升相当显著(我脑测2026linux提升更大)能够把老大A770干掉(28xe pk 32xe),不过距离理论算力还是有巨大差距 ![]() |
| 有没有大佬做做RDNA4架构的AMD GPU测试呀 |
孤忆梦影 发表于 2025-7-7 15:38 你直接搜FP32算力 |
孤忆梦影 发表于 2025-7-7 15:38 gromacs的结果来分析的话,4090大概比4080强30-40%,这与性能对比大致差不多。这样的话,5070 ti大致跟4080差不多,5080比4080好大概15%左右,5090比4090好30%左右。当然这只是估算,软件这几年的变化也很快。 |
| 请问有50系列和40系列的对比吗 |
| 请教一下,编译基于Kokkos包加速的LAMMPS,在编译过程中有何设置可以调优呢,还有请问在进行计算的时候,OMP thread一般选择几为合适呢? |
| 请教一下,我用deepmd的话,低端这几个2080ti,v100,titan v推荐哪个,谢谢 |
Entropy.S.I 发表于 2023-11-2 16:46 打扰了打扰了,老板一方面不肯出钱一方面又想算大体系,为了毕业都是自己花钱攒机子跑计算,昨天看了测评帖子一着急想着双十一要不要把显卡换一下,能快一点是一点。那现阶段我还是不折腾了就用原先的配置吧,谢谢熵大! |
| E大,根据您的数据总表,lammps计算时6900XT的表现要优于7900XTX?按照目前的价格那6900XT很有性价比啊 |
大佬有机会可以测试下D. E. Shaw Research开发的Desmond,非商业的可以免费申请使用的![]() |
Entropy.S.I 发表于 2023-9-15 19:20 厚砖本有一个好处 就是 等工作站/服务器计算结果的闲暇时候 可以撸几把3A游戏 ,当然现在的SoC/CPU核显越来越强了,核显本都能撸好多游戏![]() |
赵小壮 发表于 2023-9-12 19:57 我不用WSL,所以无法给出建议。根据别人使用WSL的反馈,我不认为使用WSL是一个好办法。 无独显轻薄本+高性能工作站/服务器才是最佳方案。自行配置好网络,使用体验远好于厚砖游戏本+WSL。 |
|
显卡哥好强。请问我需要写cuda,刚买了一台笔记本i5-12450H+RTX4060,请问我应该如何搭建开发环境呢,我之前是用的wsl2,写code时候用的vim,请问我还在wsl2 里写cuda会有什么影响吗。谢谢显卡哥 |
手机版 Mobile version|北京科音自然科学研究中心 Beijing Kein Research Center for Natural Sciences|京公网安备 11010502035419号|计算化学公社 — 北京科音旗下高水平计算化学交流论坛 ( 京ICP备14038949号-1 )|网站地图
GMT+8, 2026-8-13 11:51 , Processed in 0.322432 second(s), 32 queries , Gzip On.