快科技 9 月 12 日消息,AMD 之前多次表示 NVIDIA 的 CUDA 生态优势已经不足为虑,他们的显卡跑 AI 应用也追上来了,然而 DeepSeek V4.1 Flash 上 AMD 显卡的性价比输了 40 多倍。
在 V4.1 Flash 发布之后,由于它原本就是支持 NVIDIA 显卡开发的,所以 CUDA 平台上可以第一时间跑起来,AMD 在两天后才发布了 V4.1 Flash 的镜像,功能上也做到了开箱即用。
只不过性能就完全不能看了,SemiAnalysis 公布的测试中,MI355X 显卡只能在 50Token/s 以内的速度运行,Token 经济效益差太远了,比 H200 显卡差了 14.8 倍,更是被 B200/B300 这样的显卡甩开了 42.6 倍。

前不久 SemiAnalysis 才夸了 AMD 只用了 2 周时间就把 MI355X 的性能提升了 3 倍以上,再加上每小时芯片成本的效益占优,AMD 是有资本说 CUDA 生态已经没有那么大影响了。
然而这跟本次的落败也不矛盾,因为这里面有个时间问题—— NVIDIA 显卡在各种大模型发布的时候几乎是第一时间就可用,AMD 不仅要落后几天,更重要的是第一时间的性能是不能让人满意的。
MI355X 显卡的理论性能及最终优化的性能绝对不差,是能跟 B200、B300 掰手腕的,但是 AMD 需要投入资源优化之后才行,而不是 N 卡那样开箱即用。
哪怕这个时间段只要两周时间就能缩短,但对各大 AI 平台来说,N 卡不需要折腾就能跑起来,业务稳定性也是 A 卡不能比的,哪怕 MI355X 的每小时成本依然占优,这个问题解决不了,各大厂商还是会高价抢购 N 卡的。
两个学生中一个每次大考小考都能稳定考到 90-95% 以上,一个学生拼命一点期末考试也能拿个 90 粉,但是每次开学初期就不好好学,老师会偏向哪个学生是不言而喻的。



登录后才可以发布评论哦
打开小程序可以发布评论哦