LATENT
首页
文章
归档
关于
搜索
⌘K
TAG · 1 篇
训练
← 全部文章
LLM 2
随想 2
Infra 2
RLHF 1
推理 1
001
为什么你的 loss 掉得漂亮,模型却越来越笨
04 / 18
4 MIN
验证集里有 4.7% 的样本以另一种表述出现在训练集中。这篇写数据去重、评测污染的检测方法,以及为什么漂亮的指标往往是最危险的信号。
LLM
训练
随想
导航
首页
文章
归档
关于
文章
为什么你的 loss 掉得漂亮,模型却越来越笨
重读 Attention:从 O(n²) 到线性的六种妥协
奖励模型是一面哈哈镜
把首 token 延迟砍掉 60% 的那一周
命令
切换亮/暗主题
T
订阅 RSS
↑↓ 选择
↵ 打开
ESC 关闭
微信
扫码添加 · 点击任意处关闭