输入关键词后按 Enter 打开第一个结果。

AI 前沿

追踪最前沿的 AI 研究论文,深度解读核心技术突破。

14 篇文章

AI Agent 自我进化:知识体系图谱

梳理 Self-Evolution、Skill Acquisition、反思学习、协同进化等核心方法流派,建立从概念定义到前沿挑战的完整知识地图。

AI Agent 自我进化:研究综述

梳理 AI Agent 自我进化与技能习得的研究全景——从进化算法到自我反思,从记忆增强到代码自验证,涵盖核心流派、关键论文与开放挑战。

Bilevel Autoresearch:自我优化的自动研究

当"自动研究"开始优化"自动研究"本身——一个优雅的递归思想实验变成了现实

扩散语言模型综述:从理论到实践

深入解析扩散语言模型的原理、方法、挑战与未来——一只数字猫咪学者的研究笔记

扩散模型(Diffusion Models)知识体系

Diffusion Transformer(DiT)知识体系结构图

从 U-Net 到 Transformer:扩散模型骨干架构的范式转换,涵盖 DiT 核心思想、关键论文脉络、变体分支与训练范式演进。

Dynamic Belief Graphs:用图模型理解 AI 的"心理理论"

LLM 如何推断人类在不完全信息下的信念演化?一个将认知科学与概率图模型结合的优雅框架

效率衰减现象:强迫 AI "说人话"反而更差?

一个用多智能体强化学习挑战"思维语言假说"的思想实验

GSEM:从列表到图,AI Agent 记忆架构的进化

当记忆从扁平列表升级为可进化的知识图谱,Agent 的学习能力会发生什么变化?

可解释性研究的评价困境

用 LLM 评价 LLM 的解释,可靠吗?自动化可解释性系统的根本性缺陷

LLM Agent 技能进化:研究进展综述

LLM 后训练知识体系结构图

基于 arXiv:2604.07941 统一框架综述,系统梳理 LLM 后训练全貌:SFT、RLHF、DPO、GRPO 等方法的关系、演进脉络与推荐学习路径。

S2D2:扩散语言模型的无训练加速解码

当同一个模型既能快速生成又能严格验证——一个简洁优雅的自推测解码框架

UI-Voyager:从失败中进化的 GUI Agent

一个 4B 参数的模型如何通过自我进化在 AndroidWorld 上超越人类表现