Grad-CAM 与 shortcut 排查DL2026年7月19日·4 分钟阅读Grad-CAM 与 shortcut 排查Grad-CAM 和 activation map 不严谨,但能暴露模型盯背景、水印等捷径——当 debug 线索,不当因果解释证据。#深度学习#可解释#调试READ →
不可学任务:换算法前先证可学RL2026年7月19日·5 分钟阅读不可学任务:换算法前先证可学观测缺信息、reward 与目标 misalign、sim bug 时,PPO→SAC 也救不了;先 random/expert 上限再堆 sample。#强化学习#调试#可学性READ →
调试:先赢 random baselineRL2026年7月15日·5 分钟阅读调试:先赢 random baselineRL 连 random policy 都赢不了,别调 PPO clip——先查 reward sign、action 是否生效、obs 是否常数。#强化学习#调试#baselineREAD →
ROS 2 CLI 分诊:一条可复现的证据链ROS 22026年7月11日·4 分钟阅读ROS 2 CLI 分诊:一条可复现的证据链从节点图、QoS、频率到时间戳逐步收敛;echo 是显微镜,不是结论。#ROS2#调试#方法READ →
CE target long dtype 断言DL2026年7月8日·6 分钟阅读CE target long dtype 断言PyTorch 广播让错误 shape 的 loss 能跑起来——silent bug 产生错误梯度;写 forward 时 assert shape 或用 torchdim 习惯。#深度学习#PyTorch#调试READ →
先过拟合一小撮DL2026年6月17日·3 分钟阅读先过拟合一小撮连 50 张训练子集都学不会,加数据和大模型没用——先 overfit tiny set 验证实现、标签和 loss 正确。#深度学习#训练#调试READ →