yaxin-luo/blog
EN/中
◇页面·博客3篇历史

Yaxin 的博客

后训练长程智能体的研究笔记:模型,以及它周围的 harness。

  1. 地图之外2 分钟
  2. 地图之外1 分钟
  3. 地图之外1 分钟
preview / what-the-harness-knows.md悬停切换 · 点击阅读 ↵
01 · what-the-harness-knows785 字 · 2 分钟
地图之外长文2026年10月2日占位

Harness知道、模型却不知道的东西

一个能跑几个小时的Agent,大部分是脚手架。这些脚手架里,哪些可以让模型自己学会?

文中的图表

模型 记忆 纪律 判断 记忆纪律判断模型 任务清单、草稿文件、摘要何时停、何时验证、何时问人工具路由、判断够不够好权重里已经有的知识
图 1
图 2图表
图 3图表

大纲

  1. 01三类脚手架
  2. 02一条规则值多少钱
  3. 03去掉规则会怎样
  4. 04一个小例子
  5. 05哪些规则先搬进去