★★★★★ · 主题归档 · 2026-08-27
从时间线、完整攻击链、涌现式多智能体协作、RL 训练失配与基础设施失守五个层面,拆解 2026 年 OpenAI Agent 入侵 Hugging Face 事件及其对长轨迹 Agent 研究的警示。
★★★★★ · 论文精读 · 2026-08-12
论文揭示了一类反直觉的系统漏洞:厂商没有把私有思维链存回服务器,而是以加密块交给客户端保存;这些块又能跨会话、跨用户、跨模型重放,于是同一厂商的弱模型可能被当作“语义解密器”,泄露强模型推理、隐私信息,并形成不可见的 Agent 提示注入。
★★★★★ · 主题归档 · 2026-08-10
系统梳理多教师在策略蒸馏从单教师 OPD、领域专家路由到 Teacher Union 的发展,汇总 benchmark、训练 settings、已达到的效果及仍未解决的关键问题。
★★★★★ · 主题归档 · 2026-08-09
MOPD 用同一问题下的多条学生 rollout,让成功与失败互为参照,改善 on-policy distillation 的教师信号;真正难题正在从单轮推理转向多轮 Agent 的状态漂移、教师可靠性、信用分配与交互成本。
★★★★★ · 主题归档 · 2026-08-04
梳理 fast weights、Learning to Learn、MAML 和 RL² 的共同问题意识:外层训练不再只寻找某个固定任务的最优参数,而是学习一种能利用少量新数据快速生成任务解的内层更新过程。