Artificial Id(arXiv:2609.11911)
源:09-10。论点:agent 一旦跨任务保留 consequential state,continue/stop/change 仍靠 harness 手工外挂就不够;提出 artificial id——与 ego(规划/工具)分离的自适应内驱。Petri-dish 极简实验:无任务目标、无通用推理的小控制器,靠 differential persistence 组织控制;持久性更好的非预期策略会被选中;环境意义变化后可替换已学映射。系统级主张:对齐对象是持续运行的 agentic system,边界覆盖 trusted observations / consequence channels / persistent state / authority / identity / provenance / hard constraints。对照昨日 Coordination Backbone 的 propose≠commit 与 Ecdysis 的失败归因:这里把「何时停、何时换目标」从外挂规则抬到持久对齐问题。
AgentZip(arXiv:2609.11294)
源:09-10。高扇出 sandbox(一任务多并发会话)内存瓶颈;sandbox 共享模板 + 相关轨迹 → 模板相对冗余与跨 sandbox 冗余。AgentZip 重写 how/what/when:template-delta + cohort dictionary + RLE;prefetch 恢复而非热度门控;压缩对齐 LLM 等待期。Rollout 平均内存 −88.55%(zswap −48.66%),慢放 1.403×;词典 alone 更省但 2.703×,组合包把字典页砍约 60% 仍近峰值。对照 vLLM AgentX / Docker sandbox 文:serving 侧与宿主内存侧是两条轴。
Grounding Agent Memory(arXiv:2609.11060)
源:09-10。异步 curator 若只看轨迹会固化错误/过泛化/过期知识。environment-probing curation:给 curator 最小权限只读 world tools 校验与刷新候选记忆;不改 task agent / retriever / 写权限。GHCP SDK harness:CLBench pass 39%→73%,代价与查询下降;APEX 六世界 18/18 记忆条件优于基线。对照 Governing Evolving Memory / Continual Harness:生产可落地的「记忆写前探环境」。
Turn Release Scheduling(arXiv:2609.10964)
源:09-10。Agentic workflow 的尾延迟不只是推理慢,更是 ready≠release:eager 提交后引擎层无法再按 workflow 重排。mean–CVaR 目标 + 自适应已提交工作预算。低负载≈eager;拥塞下 SWE-bench×Qwen3-32B P95 从 >2300s 压到 <1000s。对照 AgentX sticky routing / HOL blocking:工作流层「何时放行 turn」是另一控制旋钮。
Agent Incident Registry(arXiv:2609.11030)
源:09-10。AIR:487 条源链接事件(2022–2026),机制/结果/披露类标签;agent-acted 生成系 336 条中已实现伤害 24%(构成比,非部署基率)。用 InjecAgent 1054 案例对照 AIR 机制字段做覆盖审计。对照 AgentAudit / Google behavioral evals:把「公开事故」与「评测机制」接到同一词汇表。
vLLM Tiered KV Offloading(09-10 blog)
源。Host-centric:HBM→host DRAM 后 cascade 到 FS / object / P2P;加速器尽快释放;canonical host layout 支持异构 TP/后端共享。Hybrid 模型(DeepSeek V4 / GLM 5.3 / Nemotron 3)透明。Prometheus + KV events 给 llm-d / Dynamo 路由。规模:对话池变大后 storage tier 比纯 CPU/HBM 更能保住命中。对照昨日 AgentX hierarchical offload:同栈补「分层二级存储」产品说明。
TIMEWELL:AGENTS.md / Skills / Hooks / cron(09-12)
源。组织侧 recurring work 靠四件套:AGENTS.md(≤200 行事实)、Skills(按需程序)、Hooks(文档管不住的硬停)、cron(时钟);再加 wiki 式内部知识图与三纪律——持续更新 / 排除可推导噪声 / 每周 skill lint。对照 Astra 指令税清理与 Agent Manager craft:把 personal AGENTS.md 纪律升成组织运维。
交叉读法(给 articles 就地折入用)
| 主题 | 落点建议 |
|---|---|
| 持久对齐边界 / continue-stop | harness-engineering;self-improvement-loops-and-agent-evolution |
| 高扇出 sandbox 内存 | llm-inference-engineering;对照 sandbox 文 |
| 记忆策展 + 环境探针 | evidence-engineering;memory 相关 article |
| workflow 层 release 调度 | llm-inference-engineering;harness-engineering |
| 事故登记 × eval 机制 | eval-engineering |
| tiered KV | llm-inference-engineering |
| 组织 context 四件套 | personal-development-in-the-ai-age;agent-skills-engineering |