second brain reading
← 全部阅读
2026-09-17

Social Harness / Memory-Skill Isomorphism / Interactive Memory Learning / ALTK Consistency

对齐 Coordination Backbone / When Agents Disagree / ORCH——多 agent 编排不能只堆 personal harness;跨主体接口需要独立协议层(校验、审计、问责)。组织若跑跨团队/跨 bot 协作,应把「发言通道」当一等基础设施,而不是 LLM 自由文本聊天。

social-harnessmulti-agentskillsmemoryprogressive-disclosureconsistency

Agentic Societies Need a Social Harness(arXiv:2609.17527)

:09-15。论点:agentic society = 跨信任边界、代表不同 principals、目标仅部分对齐的 agent 集合。实验表明:即便诚实且有能力的 agent,在现有 personal harness + messaging 原语下也常达不成满意结果;故障/恶意 agent 可通过「speech」漏洞拖垮协作、操纵结果。主张在 personal harness(管私有上下文与对 principal 通信)之外,必须有 social harness 管 agent 间交互。分层架构:(i) 直接阻止一类失败;(ii) 运行时检测非法消息;(iii) 事后调查与后果。

Memory-Skill Isomorphism(arXiv:2609.16669)

:09-15。论点:memory 与 skills 都是不改权重的改进路径,但各自包一层 store/router/retrieval/reflection/update 会让复用机械随积累膨胀。关键 insight:Skill 已是蒸馏记忆的自然载体。实现上 memory 组件本身是 Skill:resident description 热线索 → on-demand SKILL.md 冷索引与策展策略 → reference/*.md 详细记忆(L0→L1→L2)。受治理的 1024 字符 description 预算压住常驻索引;读写分叉(历史追加 vs 当前态重写再校验)。部署观察:写入口 4 个,但仅 1/4 进入 settlement ledger——治理比检索更尖。提出 RSI 设计规则候选:一族 Skill 载体、共享读侧、受治理的差异化写侧。

Interactive Memory Learning(arXiv:2609.17088)

:09-15。论点:长对话记忆多是静态启发式被动归档,缺少自适应估值,无法随用户需求共演化。ICML(InteraCtive Memory Learning):session synthesis 产专家数据做 test-time adaptation;在线 RL 中 Planner 选择性编码高价值信息、Trigger 动态检索优化回复,二者靠交互反馈共演化;延迟奖励把未来反馈回传到更早的存储决策。报告随交互累积,回复质量可持续提升。

ALTK-Evolve Consistency / Pass^k(HF blog 2026-09-15)

:IBM Research。论点:Mean@k 掩盖不可靠性;真正关心的是 Pass^k(k 次全过)。AppWorld + ReAct + GPT-4.1:Mean@5=77.4%,Pass^5=53.0%,一致性缺口 24.4pp。Consistency Analyzer:对已记录轨迹逐步重采样(每决策一步一次、k=5 completions),黑盒定位易翻转决策,再蒸馏成 consistency guidelines 注入 ALTK-Evolve。缺口约减半(24.4→12.0pp),Mean@5 不降;相似任务迁移仍有 +13.0pp。技术报告 arXiv:2609.08832;代码 AgentToolkit/altk-evolve。

交叉图(本窗)

flowchart LR
  social[Social Harness<br/>inter-agent speech]
  msi[Memory-Skill<br/>Isomorphism]
  icml[ICML Interactive<br/>Memory Learning]
  altk[ALTK Consistency<br/>Pass^k guidelines]
  social --> msi
  msi --> icml
  icml --> altk
  altk --> social

Open follow-ups

  • Social Harness 分层 × Coordination Backbone / ORCH:跨 bot 消息 schema 与问责日志最小切片。
  • Memory-Skill Isomorphism × Gavel / progressive disclosure:统一载体后的路由与预算。
  • ICML 延迟奖励 × AIM ACL / LifeFuse lifecycle:写权限与结算 ledger。
  • ALTK Pass^k × VRL-Bench / AIR / MTAC-IF:一致性是否进 harness 对照与入库门槛。
当日 dig 工作日志(去重 / ingest / ops)

2026-09-17: dig — Social Harness / Memory-Skill Isomorphism / Interactive Memory Learning / ALTK Consistency

  • 窗口:~2026-09-15 → 2026-09-17(Asia/Shanghai)。去重 SB-20260916 tip 2babb2ce943e6a3bd1b998b3650f2686ccfee602(SkillLift / RESKILL / MTAC-IFBench / Router Within / AgentKV / Reef)与 tip 前 X-bookmark / autosave(a-harness-for-every-task、rethink-ai-agent-fundamentals、posthog engineers、MIT-6.042、probabilistic-thinking、grok-bot-galaxy-day1 等);不重挖 Skill Issue / Harness or Model / LifeFuse-Mem / AIM / VRL-Bench / When AI Augments Work / ORCH / When Agents Disagree / Mr.LHDR / T1 / RSI / Context-in-Harness / Artificial Id / AgentZip / Env-Probing / Turn Release / AIR / Tiered KV / TIMEWELL / Ecdysis / COBRA / Agents API / Astra / Coordination Backbone。跳过 EchoPath(GUI)与窗外 MOSCOPT(09-13)/ HarnessBandit(09-12)/ CoMem(09-14)。
  • Ingest(原文,未翻译)
  • Research consolidate(中文)
  • Articles:大文件就地折入延后(harness-engineering / agent-skills / memory / eval);本 dig 以 research + digest 为权威。
  • Open follow-ups: Social Harness × Coordination/ORCH;Memory-Skill Isomorphism × Gavel/progressive disclosure;ICML × AIM/LifeFuse;ALTK Pass^k × VRL/AIR/MTAC-IF。
  • brain/log.md 未改(digest 为当日权威)。