找回密码
 立即注册
查看: 116|回复: 1

用7900XTX做了一点点AI测试,感觉AMD的ROCM目前还是不太行

[复制链接]

0

主题

0

回帖

20

积分

新手上路

积分
20
发表于 2023-6-21 23:28:17 | 显示全部楼层 |阅读模式
测试如下,大家可以下我的代码一起测试,模型大概是用lstm神经网络预测股票价格,测试只改变了lstm神经网络的hidden_dim(这个hidden_dim在jupyter notebook的某一个代码单元格里,写得有点丑陋,搜索一下应该能找到)。测试时间采用train model单元格运行的时间(wall time)
A卡7900xtx测试情况:ROCM hidden_dim=128 10s;hiddem_dim=256 22.2s; hidden_dim=512 69s; hidden_dim=1024爆显存
directml hidden_dim=128 25.8; hidden_dim=256 30.6; hidden_dim=512爆显存
N卡rtx4090测试情况 CUDA hidden_dim=128 1.76s;hiddem_dim=256 2.9s; hidden_dim=512 8.02s; hidden_dim=1024 26.1s; hidden_dim=1700 67s; hidden_dim=2048爆显存
作为一位普通用户,如果不对代码做优化的话(我也不知道怎么优化ROCM,也有可能是我代码写得有问题,但是N卡默认表现就很好),rtx4090在这个模型的表现把7900xtx秒飞了,在dim为128的情况下10秒对比1.76秒,256的情况下22.2秒对比2.9只能说非常离谱。而且在显存方面也做了优化,能开更高的hidden_dim,也就是说炼丹方面rtx4080的16g就能和A卡的24g比比了
网上搜了教程,没找到怎么开fp16,反正就是折腾不来。。。光把环境整好就够呛了

附带神秘代码地址https://p an.baidu.com/s/1UtqKGZES dNA0qj5EL7o00Q?pwd=6qnx
提取码:6qnx
回复

使用道具 举报

0

主题

881

回帖

0

积分

新手上路

积分
0
发表于 2023-6-21 23:33:09 | 显示全部楼层
不明觉厉
回复 支持 反对

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|翻墙党

GMT+8, 2026-9-26 13:36 , Processed in 0.088991 second(s), 29 queries .

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表