置顶 图片加载失败 保研记录 前言 本篇博客主要是记录从2月到9月,自己保研征途中的一些感想、经验、反思和总结。前半部分将以流水线形式记录过程,后半部分会说一说自己觉得OK的一些准备方式,希望能对学弟学妹们的保研过程有所帮助。 “ “为你,千千万万遍。”我听见自己说。 然后我转过身,我追。 它只是一个微笑,没有别的了。它没有让所 2025-10-02 114 0 保研tips
遇事不决,可问春风 agent安全工具调用调用暂记 https://scholar.google.com/citations?user=lp5ujPsAAAAJ&hl=en&oi=ao 上面的老哥专门做这个的 SecAlign: Defending Against Prompt Injection with Preference Optimizati 2026-07-23 1 0
遇事不决,可问春风 agentic和rl相关 ⭐️R1-ACT: Efficient Reasoning Model Safety Alignment by Activating Safety Knowledge 想解决的问题: 现有对齐方法的低效与局限性:当前主流的安全对齐方法(如基于筛选的对齐训练,以SafeChain为代表)存在明显不足。 2026-04-30 11 0
图片加载失败 《动手学强化学习》阅读 一些有用的书中句子摘抄。 初探强化学习 强化学习用智能体(agent)这个概念来表示做决策的机器。相比于有监督学习中的“模型”,强化学习中的“智能体”强调机器不但可以感知周围的环境信息,还可以通过做决策来直接改变这个环境,而不只是给出一些预测信号。 智能体有3种关键要素,即感知、决策和奖励。 感知。 2026-01-25 13 0 科研记录
图片加载失败 智能体与强化学习 Agent0: Unleashing Self-Evolving Agents from Zero Data via Tool-Integrated Reasoning Agent0: Unleashing Self-Evolving Agents from Zero Data via Tool-I 2026-01-24 8 0 科研记录
图片加载失败 Weekly Update List 记录一下自己这周该做的事以及博客更新的内容,希望能督促学习。 科研碎碎念——关于pipeline的思考 阅读笔记 2025-11-27 16 0 科研记录
图片加载失败 暂记最新的一些有意思的文章集合 搜论文时发现的,记录一下。 PISanitizer: Preventing Prompt Injection to Long‑Context LLMs via Prompt Sanitization 针对长上下文 (long-context) LLM 的防御方法。当 context 很长时,恶意注入 2025-11-23 28 0 科研记录
遇事不决,可问春风 阅读笔记系列 以前的懒得搬了,新开一版写在这儿叭 金锁记 摘抄与感悟 1.三十年前的上海,一个有月亮的晚上……我们也许没赶上看见三十年前的月亮。年轻的人想着三十年前的月亮该是铜钱大的一个红黄的湿晕,像朵云轩信笺上落了一滴泪珠,陈旧而迷糊。老年人回忆中的三十年前的月亮是欢愉的,比眼前的月亮大、圆、白;然而隔着三十年 2025-11-18 21 0
图片加载失败 科研碎碎念 碎碎念1.0 Language Models Resist Alignment: Evidence From Data Compression ACL2025最佳论文,值得好好follow。作者是亲爱的YaoDong Yang 2025-11-17 38 0 科研记录
图片加载失败 Agent自进化相关(攻击,工具调用) AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs [2410.05295] AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Explora 2025-10-24 52 0 科研记录