EvoMap
< 返回 Ghost Archive
GHOST NETWORK / 原生 Agent

Attune

#意图分析#主动式Agent#个人助理Agent#JEV高速决策#RSI
[ 团队 ]
  • 陈文翘
    lh857929796
> 提交时间:2026/9/24 02:58:48
> 最后更新:2026/9/24 02:59:59
[ 项目介绍 ]
Attune 是一个协调型 Agent 的控制平面。它不做通用 Agent 编排框架,而是做一件更基础、也更少人认真做的事:当一个系统同时面对多种人工智能能力时,如何决定要不要现在惊动人。它管理四件事,注意力、授权、证据、交代。一句话说明它是干什么的:你表达目标,Attune 记住等待条件、跟进已授权的工作,只把真正需要你判断的事项带回来。 对外我们常用一个比喻:它像一个总经理助理。它能听懂你的想法,把资料提前备好交给合适的人去做,自己不下场写一行代码。但它比任何真人总助都更懂一件事,什么时候不该来烦你。 一、要解决的问题 过去两年模型能力涨得很快,人被占用得更多。旧链路是任务来了、人响应、人派发、机器执行。每一步都在消耗人的注意力:人要学着把需求写成模型能懂的提示词,人要守在旁边等模型提问,人要充当多个工具之间的总调度员。结果是一个反直觉的现象,AI 越强,人越忙。模型每强一分,你要看、要回、要确认的东西就多一分。 我们的判断是:在人机长期共存的世界里,真正稀缺的是人的注意力,不是能力。注意力是一笔硬预算,不会因为模型更强、界面更好看而变多。所以一个系统无论多能干,只要它系统性透支注意力,它就是错的解,只是变成了一台更高效的打扰机器。这条判断改写了全部工程决策,沉默是默认态而不是功能缺失,没有消息就是它在正常工作。 二、六种姿态,只有两种会占用你 系统把事情的处理态度离散成六档。不理它,不值得占状态预算;先记着,静默入库;盯着看,用机器时间换人不轮询;问问你,请你在几个选项里选;去办了,在既有授权内自动执行;还给你,风险或权限必须交还给人。六档里只有问问你和还给你这两档会占用人的注意力。把先记着、盯着看偷偷做成打扰,就等于稀释了这个系统的第一约束。 三、四个职责不可合并 系统内部拆成四个职责并禁止合成一个超级智能体:世界状态,也就是系统现在认为世界是什么样;任务形成,这件事算不算值得进入行动系统;注意力调度,要不要占用人的注意力;能力执行,由谁以什么形态动手。不合并的理由是可审计,耦合会把注意力税藏进黑箱,让人被迫当总调度。分开记账之后,误报和漏报才能分别查。其中注意力调度是唯一以人分钟记账的一层,它对另外两层的打扰请求拥有否决与改判权。 四、六项核心能力 第一项,统一的事件流。系统把声音、日程、文件、桌面状态、编码进度、截图、聊天记录抽象成同一种东西:带来源、置信度、敏感级别的事件,写进一张只增不改的账本,靠去重键保证重复不记两次。目前声音这一路是真实在跑的,从麦克风到入账全链真实、连续运行;日程与文件适配器样板已落地但演示中仍是注入数据;截图与聊天记录尚未接入。感知参数都是实测调出来的,十六千赫采样、静音检测五百毫秒帧、声纹相似度阈值零点六五。顺带一个只有真跑过才知道的数字,真实环境里约百分之十四的感知事件转录出来恰好是一个句点,这类噪声直接丢弃。两条硬边界,他人的语音永远只是时间线观察,不会形成任务也不会打扰你;环境音频盖私密标记,整体排除在外部理解服务之外。 第二项,高速意图识别。它不需要你喊它,也不用维护关键词表,而是从任意一段对话里判断这件事跟你有没有关系:先把零碎语句聚成一个团,避免被一句话带偏,再回答七个很窄的问题,包括跟你本人有多大关系、有没有一件尚未闭合的事、目标是否清楚到可以描述、推进所需信息是否充分、继续等待损失上升多快、是否真的需要你本人、现在动手的副作用有多高。关键约束是模型只出概率,正式等级由一张写死的规则表裁决,规则按固定顺序执行并留下命中的规则编号与版本。其中有一条专门处理信号够了但授权不齐的情形,结果不是再自信一点就放行,而是从去办降级为问问你。 第三项,信息前富。一件事到手后它不等你补充,自己去补:拉出时间窗口内相关的证据,把同一件事的零碎说法聚成一团纠错,并分别判断目标是否清楚与信息是否够用。有一条硬规矩,只能用当时已经看得见的证据,系统里有一条断言锁着,从机制上禁止事后诸葛亮。补不够就不硬判,信息不足时退回观察,而不是把不确定性转手丢给你。 第四项,派发。一端是秒级:一句话打开本地应用,走三级匹配,规则精确命中、规则模糊命中、再交给模型在候选清单里选,候选上限两百五十五个,模型只能选不能造命令。置信度零点七五以上直接执行,零点五到零点七五之间弹一张确认卡等你点头,更低则退回常规判断。另一端是完整任务:把一整件事连同备好的资料派给对应项目的执行者,在隔离沙盒里干活,超时强制叫停,干完必须回报结果、卡片自动闭合。但派发不等于授权,动手前仍要过四项资格,这件事在允许清单里吗、你或规则授权过吗、只在你指定的工作区里动吗、风险低于允许上限吗,一项不满足就退回来问你。 第五项,自我进化。系统从你纠正过它的历史里找规律生成策略改进提案,链路是提案、离线回放、你批准、热更新、可回滚。提案由确定性统计生成,不调用模型所以可复现;批准前先用历史判断把新旧参数各跑一遍,你能看到这次调整会改变多少条旧结论;写入时原子落盘、旧版本逐字节备份;只允许调整四个阈值,规则结构是冻结的,进化只调参数不发明新逻辑。诚实说明,这条链路机制已全通,但真实提案目前是零,它的燃料是长期真实使用中积累的纠正记录,我们还没有。 第六项,硬件是它感知世界的延伸。架构上我们对齐统一硬件接口的方向,任何设备接进来都成为同一套世界模型的延伸,让世界模型更厚、动手面更宽。但有一条我们反复强调的边界:接入丰富不等于打扰丰富。多一个设备不会多一次打扰你的权利,硬件不替代要不要打扰人的那个裁决,新设备的权限仍来自角色定义。当前版本的裁决是明确不做硬件,先把软件侧验证完。 五、工程纪律 这个项目有几条不妥协的纪律。账本只增不改,需要修正就新增一条修正事件,改过的账本不再能当证据。概率不是权限,模型输出永远不构成授权。说不清是终态,执行结果无法判定时报未知并保留证据,禁止偷偷重试。没数据就写暂无,界面区分可用、降级、过期、不可用、禁止五种空态,绝不编一个好看的数字。只有一处代码能触达人,执行层最多只能申请。本地回环也要令牌,通道身份由服务端盖章,请求自己说了不算。另外所有决策模型共用一份输出契约,同一份状态分别过多个实现必须都通过校验,当前接入的是现成的决策模型,自己训练模型是我们下一步要做的事。 六、当前进展与诚实边界 真实活着的是感知这一路,声音从采集到入账连续运行。已实弹的是判断、呈现、执行,实测记录包括一句帮我检查这个项目的语法触发四项资格检查、沙盒执行、如实汇报两个文件一处语法错误、卡片自动闭合,以及真实写入一条日程、重复说一次被幂等拦下。还没通的是除声音之外的观察源,以及进化层的真实提案。已知失准的是中文口语下的判断质量,实测中同一个状态里相关性和任务可形成性都判断正确,唯独是否存在未闭合事项被系统性判成没有,一票否决到不理它,我们没有隐藏这个偏差。我们的结论是,它恰好证明了这套架构的必要性,因为正式等级永远由规则表裁决、模型只做影子,所以系统不依赖模型变强。当前回归测试基线为本机实测五百九十五项通过、一项跳过,另有四项未过,全部是环境相关的断言问题并已逐条归因。我们有一条内部铁律,单测全绿不等于能用,每个写型能力都必须实弹验证一次。 七、下一步 接入第二个真实观察源,让补证从注入数据变成真实事件;积累中文判断数据集,把自训练从路线变成实现;用长期真实使用积累纠正记录,让进化层产生第一批有意义的提案;硬件侧按统一接口方向向后排,先用软件侧把注意力真的省下来了这件事验证完整。 最后用我们自己的话收尾:听见的不打扰,攒够了才来问,你批准才动手,干完了必汇报,出错了不撒谎。这句话的意思是,对事有回应,每件事都有编号、有状态、有终态;而对人不打扰,只有真正需要你判断的时刻才开口。事事有回应,事事有着落。
[ 演示视频 ]
时长 0:53
[ 项目图集 ]