Agent 与自动化 4.0 · 优秀 2026-08-14 · 文章

Agent 限流状态机:额度是编排状态,不是模型属性

把 Agent 额度建成状态机:normal near-limit (checkpointed off-peak-wait / auto-continue-armed / fallback / hard-stop)三个官方旋钮不可混写:DeepSeek off-peak 是时间/价格调度(2026-08-16 16:00 UTC 生效半价),Claude Code desktop auto-continue 是限额重置后续跑,OpenAI Ultrafast 是速度档资格而非额度重置核心结论:进入 near-limit 的第一动作是 checkpoint,不是换模型;缺 checkpoint 的限流会伪装成模型不行

回到归档

Agent 限流状态机:额度是编排状态,不是模型属性

  • ID: 2f4b0c1d
  • 原文链接: (本地 Obsidian 综合,无外部 URL)
  • 作者: gracker
  • 日期: 2026-08-14
  • 分类: agents
  • 来源类型: article
  • 标签: llm-agent, quota, rate-limit, orchestration, state-machine, checkpoint
  • 质量评分: 4/5
  • 抓取时间: 2026-08-14T15:38:57Z
  • Obsidian 证据: 调研/2026-08-14-调研-Agent限流状态机.md(材料包 DeepResearch/2026-08-14-evening-…/master-research.md)

中文导读

把 Agent 额度建成状态机:normal → near-limit →(checkpointed → off-peak-wait / auto-continue-armed / fallback / hard-stop)。三个官方旋钮不可混写:DeepSeek off-peak 是时间/价格调度(2026-08-16 16:00 UTC 生效、半价),Claude Code desktop auto-continue 是限额重置后续跑,OpenAI Ultrafast 是速度档资格而非额度重置。核心结论:进入 near-limit 的第一动作是 checkpoint,不是换模型;缺 checkpoint 的限流会伪装成「模型不行」。

为什么值得关注

overnight 长程任务的实用框架:启动写 task_id/goal/checkpoint_path/quota_mode,每工具环刷新 checkpoint,恢复后三步自检,账本记 quota_events。附误判表(半夜停了≠模型崩了)。

正文存档

date: 2026-08-14 tags: [llm-agent, quota, tooling, research] sources: [opencli-twitter, github, local-research] relevance: high slot: evening summary: 把 Agent 额度建成状态机:normal → near-limit → off-peak-wait / auto-continue-armed / fallback / hard-stop;三家旋钮不可混写。

执行摘要

  • 本次产出文件:/Users/chris/Library/Mobile Documents/iCloud~md~obsidian/Documents/Obsidian/调研/2026-08-14-调研-Agent限流状态机.md
  • 材料包:[[DeepResearch/2026-08-14-evening-Agent限流状态机-MobileHarness-研究材料/master-research]]
  • 关键发现:1)DeepSeek off-peak 是时间调度;2)Claude desktop auto-continue 是限额重置后续跑;3)OpenAI Ultrafast 是速度档资格,不是额度重置;4)缺 checkpoint 时的限流会伪装成「模型不行」
  • 主要 takeaway:overnight 任务先写断点与 quota_events,再谈换模型

Agent 限流状态机

晨间路由表 v2 已经给 quota_mode 留了列。这一页只回答:列里的值怎么跳、跳的时候先做什么。

为什么要单独成文

长程 agent 停住时,默认叙事经常是能力问题。8/13 之后至少有三条官方/产品旋钮直接打在额度与调度上:

1. DeepSeek API peak/off-peak,off-peak 半价,2026-08-16 16:00 UTC 生效 2. Claude Code desktop:usage limit 后的 auto-continue 勾选 3. OpenAI Ultrafast:select customers + 扩容,同模型速度档

把它们塞进「换更强模型」会丢信息。正确单位是状态,不是模型名。

状态与转移

| 状态 | 含义 | 典型触发 | |------|------|----------| | normal | 可继续跑 | 成功响应 | | near-limit | 要准备停或改道 | 429、usage warning、剩余额度阈值 | | checkpointed | 断点已落盘 | 本地 harness 写出 diff/下一步 | | off-peak-wait | 等低峰窗口 | DeepSeek 类峰谷价任务可推迟 | | auto-continue-armed | 等额度重置后续跑 | Claude desktop 勾选 | | fallback | 换 backend / 降 effort / 缩任务 | 有次选且任务允许 | | hard-stop | 停,不伪装成能力失败 | 无断点、敏感任务、账单熔断 |

normal → near-limit
near-limit → checkpointed → off-peak-wait → normal
near-limit → checkpointed → auto-continue-armed → normal
near-limit → fallback
near-limit → hard-stop   # 无 checkpoint 或策略禁止

先记住一个结论:进入 near-limit 后的第一动作是 checkpoint,不是换模型。

三家旋钮不要写成同一个功能

| 信号 | 旋钮类型 | 映射状态 | claim_level | 边界 | |------|----------|----------|-------------|------| | DeepSeek peak/off-peak 半价 | 时间/价格调度 | off-peak-wait | official_release | 不保证低峰无限容量;钟点表以 API docs 为准 | | Claude Code desktop auto-continue | 限额重置后续跑 | auto-continue-armed | official_product_account | 只覆盖 desktop 叙事;不替代本地 checkpoint | | OpenAI Ultrafast | 速度档 + 选客 | latency_class 旁路 | official_release | 无资格时不能当 quota fallback | | 路由表 quota_mode | 编排字段 | 全状态 | local_synthesis | 不替代账单审计 |

旁证(不是同一旋钮):

  • Claude Code v2.1.232:跨会话消息、fork 默认、resume 硬化 — 长程恢复面变强,但仍不是 usage auto-continue
  • last30days:auto mode 8/14 对新会话默认 — 这是权限自动批准,别和额度续跑混谈

overnight 默认策略

1. 启动时写:task_id / goal / checkpoint_path / backend / effort / quota_mode=normal 2. 每个工具环或固定间隔刷新 checkpoint:当前 diff、最后命令、下一步、失败原因 3. near-limit:checkpoint → 在 off-peak-wait / auto-continue-armed / fallback 里选一个 4. 恢复后三步自检:读 checkpoint → 重跑最后失败命令 → 确认工作区干净 5. 账本追加 quota_events[]:{ts, from, to, action, backend}

个人开发者默认优先级:

1. 可推迟批量任务 → off-peak-wait 2. 已在 Claude desktop 且勾了 auto-continue → auto-continue-armed 3. 有明确次选 backend → fallback(同时降 effort 或缩任务) 4. 否则 hard-stop,并在任务卡写明「额度/断点」原因

误判表

| 现象 | 错误归因 | 状态机读法 | |------|----------|------------| | 半夜任务停了 | 模型崩了 | 缺 checkpoint 的 hard-stop,或 auto-continue 未开 | | 换模型后突然会了 | 新模型更强 | 可能只是额度恢复、off-peak、上下文更短 | | 连续 429 | 服务挂了 | near-limit;降并发或改窗口 | | Ultrafast 还在 waitlist | 缺新模型 | 速度档资格,不是 reasoning 失败 |

和晨间四列路由怎么拼

  • reasoning_effort:决定愿不愿意为推理花钱
  • latency_class:决定要不要跟手
  • quota_mode:本页状态机
  • desktop_context_permission:上下文源权限,与额度正交

表上有列还不够。跑 overnight 时,调度器读的是状态转移,不是「默认模型」单元格。

边界

  • 未抓 DeepSeek API docs 的精确 off-peak 钟点表
  • 未本机验证 Claude auto-continue 恢复完整性
  • 未写账单金额;所有价格倍数来自官方帖原文
  • 本晚 opencli 在首条官方查询后 429,广域新信号未补

来源信号

四层质检

  • L1:未把渠道数字当本机结果;三家旋钮分开写
  • L2:开头三句交代问题、旋钮、读者可带走的状态机
  • L3:有状态表、转移、overnight 动作、误判表
  • L4:工程记录口吻,无宏大叙事