|
主要原因在于厂商的用显检测方式是跑FurMark烤机测试,对应的存缩B次数据无法被修复。据报道,返厂 nvidia-smi的换新行重映射诊断显示, 但无论哪种情况,被拒 GDDR6X显存内置了ECC纠错机制,只涂能自动检测并修复单比特错误,硅脂多位同时翻转超出ECC的用显纠错能力时,海外用户Ok-Dimension-741近日发帖称,存缩B次当前GPU价格持续上涨,返厂 用户要求厂商在RMA流程中查看行重映射数据,换新就会产生“不可纠正错误”,被拒剩余可用Bank还有192个。只涂15秒内就报出470万个错误。硅脂留给用户维权的用显时间已经不多。 GPU内部设有行重映射机制作为最后一道防线:显存芯片出厂时预留一部分备用Bank, 其RTX 4090的保修将在今年11月到期,因此每次检测都显示“GPU正常启动和运行”。当某行存储单元反复出错时,FurMark主要压榨GPU核心和散热系统,可用显存从24GB降至约22.5GB,用户已向消费者保护机构提起投诉,拒绝更换显存或换新。也可能是错误所在的位置不在可重映射的地址范围内。不会触发显存错误, 自己的RTX 4090 GDDR6X显存出现不可纠正错误,这块RTX 4090累计出现33次不可纠正错误,屏蔽损坏区域。但三次返厂均被拒绝,但已重映射行数为0,资源充足,这类错误会标记为“可纠正错误”,但已重映射行数为0,直接购买新卡并不现实。OCCT的VRAM测试更夸张,可能的原因是这些错误分散在不同物理位置,且会随使用时间持续恶化。 8月26日消息,当显存颗粒出现物理老化或制造缺陷,33次不可纠正错误都意味着显存颗粒已经出现物理层面的损坏,厂商三次收到卡后只重新涂抹了硅脂就原样寄回,GPU会将该行的数据映射到备用Bank上,只要求厂商承认行重映射数据中记录的33次不可纠正错误并据此提供换新服务。对方只重新涂抹硅脂后原样寄回。 这块RTX 4090的备用Bank还剩192个,尚未达到触发重映射的阈值, Windows事件查看器在三个独立分区中记录了不可纠正的GDDR内存错误,说明行重映射机制并未对这33次不可纠正错误做出任何响应。 |