lilfry's library
首页 全部文章 AI 未定稿 LeetCode 分类 标签 关于
lilfry's library
取消
首页全部文章AI未定稿LeetCode分类标签关于

全部文章

2026

GroupDPO: Memory efficient Group-wise Direct Preference Optimization 05-05
coding agent数据合成-qwen调研 04-19
时代洪流中的锚点:新一轮科技革命下人文与智能的双向赋能 04-13
fry的香水收集小记1 04-12
一些想法:有关于人类的本源,以及社会的组织 04-09
面试高频:Bradley-Terry vs Plackett-Luce,奖励建模到底差在哪 04-08
读 YaRN:长上下文扩展,核心不是硬拉窗口,而是别把 RoPE 拉坏了 04-07
读《Reasoning with Sampling》:RL 没让模型变聪明,它只是在重分配推理能力 04-07
读 OLMo 3:真正重要的不是新架构,而是训练信号 04-06

2025

深度学习优化算法 09-02
字母异位词分组 06-20
寻找重复子树 03-31
如何用hugo构建自己的博客 03-31
  • 1
  • 2

Hope can set you free.

Powered by Hugo
2025 - 2026 lilfry