最近动态
招募、项目、论文与里程碑,按时间倒序。
2026 年 6 月置顶
招募研究实习生。我正在帮我所在的 LMU 慕尼黑 课题组招募研究实习生。课题组方向为强化学习与大模型 / Web Agent(近期一篇工作被 ICLR 2026 接收),目前在继续推进 RL 在垂类 Agent 应用上的工作。远程;提供充足的 RL / LLM 算力。
要求:可投入全职(每周 ≥40h)或兼职(每周 ≥20h);有丰富的 RL 实践经验、懂相关理论,能独立搭建 Agent 系统。表现突出者通常可在产出工作中获得论文署名。
开始时间:随时接受,预留约一周适应期。有意者请邮件联系我:leo@lsamc.website,附简历 + 简要说明你做过的相关项目,建议附上相关 GitHub repo 链接——RL / Agent 方向最佳,其他方向有突出项目经验同样欢迎。也欢迎先聊聊了解更多。
2026 年 8 月
📄 我们的论文 QuoteBench: How Matched Scores Can Hide Command-Path Failures 已挂 arXiv(与 Yao Zhang、Volker Tresp、Yuanyuan Yang 合作)——它表明 LLM 编码 agent 「分数持平」可能掩盖命令通路上的失败:评测必须报告生成契约、执行路径与验证器,而不能只看分数。 项目主页。
2026 年 7 月
🔨 推出 Human-Crafted Software —— 一个徽章 + 规范,用于「自己设计、亲手编写、且提交源码无 AI 生成或直接编辑」的项目。Proudly human-made —— 对 vibe coding 的一点反向致意。
2026 年 7 月
🧹 新 skill: code-humanizer —— 一个 agent skill,专门清除代码中 AI 生成的结构性 slop(重复造轮子、单实现抽象、 吞异常、复述式注释——16 种模式,保持行为不变)。 GitHub · 技术详情。
2026 年 7 月
🧪 QuoteBench 问世!这是一个聚焦 LLM Agent 的 shell 引号与转义能力的细粒度基准:56 个可执行验证任务、三种工具调用契约,用来区分模型自身的 shell 能力与 JSON / wrapped Agent harness 额外引入的失败。 GitHub。
2026 年 7 月
📘 我参与校对的离散数学教材《离散数学:思维与挑战》正式出版;其中群论与组合两章的校对由我负责。
2026 年 6 月
🌉 Say hello to CaveBridge!一个自然语言界面,用 LLM 前端把 1977 年的《巨洞冒险》带给现代玩家——语言交给 LLM,世界状态仍由原版确定性内核牢牢掌控,绝不漂移。 GitHub · 详情。
2026 年 6 月
🎓 我毕业啦!于南京大学获得信息与计算科学(计算机强基计划)理学学士学位。
2026 年 6 月
🎉 庆祝我的 Linux 离线语音中文输入法 VocoType 突破 160 star!
2026 年 4 月
🎓 正式官宣:我将加入石溪大学(Stony Brook University)电气与计算机工程系(ECE),攻读计算机工程(CE)博士学位。
2026 年 4 月
2025 年 12 月