标签: #rocm
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 1 篇
한국어English日本語中文
← 全部文章
把 AMD GPU 与 NVIDIA GPU 的差异,按硬件结构、软件栈、移植路径、生态成熟度这四个层面拆开,不带感情地梳理一遍。从 SM 与 CU、Tensor Core 与 Matrix Core 的对应关系讲起,具体说明 warp 32 与 wavefront 64 到底会在代码里制造出什么样的 bug。区分 HIPIFY 能自动搬过去的部分和必须手动修改的部分,并解释在 cuBLAS 与 rocBLAS 这类库对应表中,为什么
2026-08-02 · 22 分钟阅读 #amd#rocm#hip#nvidia#cuda