研究方向
- 01
Agent 核心能力
Multi-Agent 协作中的状态归属与冲突消解。
一个任务被拆给多个 Agent 之后,「当前状态归谁」就不再是细节。谁有权写、写完谁负责、两份改动冲突了听谁的 —— 这些在单 Agent 里默认成立的前提,在 Multi-Agent 里全都要重新回答。我们关心的是这些问题的运行时答案,而不是使用者的约定。
- 状态归属:长程任务中,运行时状态的所有权如何定义、如何在 Agent 之间转移。
- 冲突消解:并发写入同一份状态时,如何在不引入全局锁的前提下收敛。
- 工具与调度:多个 Agent 共享工具与沙箱时,如何隔离、复用与回收。
- 02
Harness 核心能力
能自进化的 Harness:上下文工程、失败发现与恢复。
Harness 是模型之外决定 Agent 表现的那一层。我们把 Harness 本身当作研究对象 —— 它如何组织上下文、如何判断一次执行已经跑偏、如何在失败后恢复,以及这些能不能由它自己完成,而不是靠人反复改 prompt。
- 上下文工程:长程任务里,什么该留在上下文内,什么该被写出去、什么时候取回。
- 失败发现:没有人工标注时,如何判断一次执行已经偏离目标。
- 自进化:策略调整如何被验证有效,而不是把噪声当成信号。
- 03
领域化 Harness
不同领域需要不同的 Harness。没有通用的那一个。
我们不相信存在一个通用的 Harness。领域的约束 —— 数据形态、工具的边界、犯错的代价 —— 会决定 Harness 该长什么样。把为一个领域设计的 Harness 搬到另一个领域,通常不成立,需要的是重新设计而不是调参。
- 领域约束如何进入 Harness 的设计,而不是留在使用者的约定里。
- 跨领域可以迁移的是什么:运行时原语,还是仅限工程实践。
- 如何判断一套 Harness 已经适配了一个领域。