在传统问答和静态代码生成中,模型通常接收一段相对完整的输入,并在一次生成中给出结果。长时程 Agent 面对的则是持续变化的任务环境:它需要阅读大型代码库,调用工具,分析执行结果,修改多个文件,在失败后调整方案,并在数小时甚至更长时间内维持对目标和当前状态的理解。 这类任务...
~/tags/研究笔记 — ls
-
$
GLM 5.2 与 Kimi K3:面向长时程 Agent 任务优化的开放前沿模型
-
$
AI 的下半场:迈向通用智能
过去数年,大语言模型的能力边界迅速扩展。它们能够编写程序、求解数学问题、通过专业考试并完成长程对话,许多曾被视为需要专门智能的任务,已经被统一到同一种模型范式之中。随之而来的问题是:我们离 AGI 还有多远? AGI 尚无公认定义,因此,直接判断当前模型是否已经“具备通用智...