lilfry's library
首页 全部文章 AI 未定稿 LeetCode 分类 标签 关于
lilfry's library
取消
首页全部文章AI未定稿LeetCode分类标签关于

 论文阅读

2026

Looped Transformer 不只是重复计算:从 LoopFormer 到 Elastic-Depth Post-Training 08-18
蒸馏不只是压缩:从 Self-Distillation 到 Search Distillation 的研究地图 08-09
读 SFT、RL 与 On-Policy Distillation:后训练真正的变量是 on-policy data 08-09
DLLM 方法综述:从掩码扩散到大语言扩散模型 07-13
读 Qwen Bebop 与 DeepSeek DSpark:Speculative Decoding 正在从技巧变成系统工程 07-11
告别盲目堆算力:让AI编程智能体从经验中学会“思考” 05-05
读 MOPD:后训练正在从单一 RL 走向多教师能力合并 05-05
GroupDPO: Memory efficient Group-wise Direct Preference Optimization 05-05

Hope can set you free.

Powered by Hugo
2025 - 2026 lilfry