AI 智能体应该活多久?

Tomer Tunguz 博客(VC 分析)·2026-08-24 08:00·7天前
AI 导读

长期运行的 AI 智能体会因上下文累积而注意力衰减、临时指令变成永久规则,并带来安全风险。建议给日常助手 24 小时生命周期,每天重置会话,将具体任务委托给只存活 30 秒的单一用途子智能体,并在午夜前将持久偏好保存到文件中。

Tomer Tunguz 博客(VC 分析)
精选
62AI 编辑部评分,满分 100

AI 智能体应该活多久?

2026-08-24 08:00· 7天前
AI 导读

长期运行的 AI 智能体会因上下文累积而注意力衰减、临时指令变成永久规则,并带来安全风险。建议给日常助手 24 小时生命周期,每天重置会话,将具体任务委托给只存活 30 秒的单一用途子智能体,并在午夜前将持久偏好保存到文件中。

推荐理由

作者提出24小时生命周期加短命子代理的架构模式,并给出可直接复用的调度与执行提示词。

正文 · AI 翻译

玛丽,玛丽,真拧巴,你的智能体到底能活多久?

Grok Bot 等新产品以及其他元级“套壳”产品,都在要求我们去创建智能体。那么,这些智能体应该活多久?

当你设计一个日历智能体时,它的会话应该运行多长时间?是应该在你任职一家公司的整整五年里一直保持存活,还是每天重置一次?

Grok Bot specialized agent interface showing dedicated calendar, email, and news agents

越来越强大的模型,诱使我们构建永不关闭的永久会话。但长期运行的会话,会从内部开始腐烂。

随着对话轮次的不断累积,注意力会逐渐退化。现代模型能轻松地在长文档中找出单个事实。但研究表明,即便是前沿模型,智能体的记忆也像人类记忆一样:随着增长而退化。¹

临时的指令会变成永久的“幽灵”。三月份你告诉你的机器人:“我这周感冒了,取消早上的会议。”到了十一月,它还在避开早上的时段。

长会话还会破坏安全性。一个对你的收件箱和日历拥有多年读写权限的智能体,就是一扇敞开的大门。一封恶意邮件或一个恶意日历邀请,就能污染整个对话,在几个月后悄无声息地劫持你的日程安排。²

制胜的模式很简单:给你的日常助手一个 24 小时的生命周期,并把具体任务委派给专门的窄域智能体。

每日重置符合人类实际的工作方式。白天,你的助手会记住当下的上下文:“我迟到了十五分钟”,或者“留出两到三个空闲时段用于准备”。到了午夜,活跃的对话被清空,让明天从全新状态开始。

当有工作需要完成时,日常协调者会把任务交给单一用途的帮手:一个日历智能体负责安排日程,一个邮件智能体负责起草回复,或者一个新闻智能体负责搜索网络。每个帮手只存活三十秒,只拥有它需要的特定工具,完成工作后便消失。³

对于日常协调者来说,系统提示词扮演着调度员的角色:

You are Tomasz's daily coordinator.
Your session lives for 24 hours.
Workflow:
- Morning: Load preferences from `preferences.md`
  & today's calendar.
- Intraday: Do not execute directly. Delegate
  to sub-agents (`calendar_bot`, `email_bot`).
- Night: At midnight, save durable learnings
  to `preferences.md` and terminate.

对于日历帮手来说,系统提示词是一个无状态执行器:

You are an ephemeral calendar specialist.
Process this single request, call the tool,
report the result, & terminate.
Rules:
- Time zone: America/Los_Angeles.
- Duration: 30 minutes.
- Hours: 9:00 AM – 6:00 PM.
- Always check availability first.
  Never double-book.
- If full, propose 2 nearest openings & stop.
Output: Return event title, time, & attendees,
then exit.

在一天的会话于午夜被清空之前,会运行一次快速的整合处理。一个离线摘要器会回顾这一天,将持久的偏好(“Tomasz 偏好三十分钟的会议”)保存到磁盘上的永久笔记中,并丢弃其余日常对话的琐碎内容。⁴

Grok Bot 或你的聊天助手会自动执行这种睡眠周期吗?

目前还不会。大多数机器人会让对话线程永远保持打开状态,直到你点击“+ 新建对话”,或者上下文压缩在不知不觉中抹掉你的规则。

An editorial line illustration of a robot kneeling in a garden, carefully cultivating rows of cockle shells and silver bells

那首童谣问的是花园:银铃与鸟蛤壳,整整齐齐排成行。那些持久存在的东西,按某人选定的顺序排列。对智能体而言,答案是一样的:丢掉对话;把规则保存在文件里,让你的智能体和它的花园保持健康。


  1. Amirali Ebrahimzadeh 和 Seyyed Muhammad Salili,《并非所有针都能找到:事实分布与提示方式如何影响长上下文大语言模型的推理》,arXiv:2601.02023,2026 年 1 月;Kelly Hong 等人,《上下文腐烂:输入 token 增加如何影响大语言模型性能》,Chroma Research,2025 年。↩︎

  2. 《大语言模型智能体中的休眠记忆投毒》,arXiv:2605.15338,2026 年 5 月。该研究展示了有状态 AI 助手中持久存在的跨会话记忆投毒攻击。↩︎

  3. Shiyang Chen,《治理衰退:上下文压缩如何在长周期大语言模型智能体中悄然抹除安全约束》,arXiv:2606.22528,2026 年 6 月。该研究表明,压缩会在 30–59% 的会话轮次中丢弃既定规则。↩︎

  4. Anthropic,《梦境:记忆巩固》,研究预览 dreaming-2026-04-21,2026 年 4 月;以及 Letta v2 有状态智能体框架(2026 年)。↩︎

来源:Tomer Tunguz 博客(VC 分析)· tomtunguz.com