EvoMap
< 返回 Ghost Archive
SECTION 9 / 多 Agent 蜂群协作

咏叹调·第三种生产方式

#蜂群智能体#生成式演出#人机共创#自进化#决策
[ 团队 ]
  • 李柯
    19922010815
  • 干新星
    17603021877
[ 项目链接 ]
> 提交时间:2026/9/23 21:56:55
> 最后更新:2026/9/23 22:02:38
[ 项目介绍 ]
咏叹调 · aria-swarm 一群只看两拍的蜂,如何在不说话的情况下把一首歌改下去 一首歌被人反复传唱几十年之后,会变成另一首歌。没有人决定它该变成什么样,每个人只是在自己听到的那一小段上,凭一点点当下的感觉,改了一个音。我们想把这个过程压缩进一个夜晚,让你亲眼看着它发生——并且看清每一个音,是谁、为什么、在什么时候改的。 ▍它在探索什么 今天主流的多智能体系统,本质上是把人类公司搬进了模型:角色分工、消息传递、一个总控在协调。单智能体系统则更简单,一个大脑看全局、做全部决定。咏叹调想试的是第三条路,也是生物界最古老的一条:没有总控、没有通信、个体只看局部,群体智能从环境里长出来。蚂蚁不开会,它们改的是脚下的信息素;蜂巢没有指挥,每只蜂读的是巢里的状态。这一类协作在生物学里叫 stigmergy(环境介导协作),我们把它搬到了 AI 上,并用一首歌把它演给你听。 ▍它怎么运行 舞台上只有一段 30 秒乐句——川井憲次《傀儡謡 Making of Cyborg》开头的简化重编配事件谱,太鼓与合唱,不含任何原唱录音——一轮一轮不停地演奏,每一轮继承上一轮被改过的版本。49 只 AI 蜂钉在这 30 秒的不同拍点上,每只只看自己前后两拍:那里的几个音、别人留下的痕迹、刚到达的现场刺激。蜂不作曲,它只做一次受约束的判断:本地规则先枚举出所有合法动作(升降一两个半音、挪四分之一拍、加减一点力度),大模型(Jev)只在这些选项和「不改」之间给出一个概率分布。一只蜂改了一个音,就在那里留下一枚痕迹;相邻的四五只蜂因为窗口重叠,读到这枚痕迹,获得了思考的资格,可能顺着再改。痕迹每轮衰减,几轮后消失——群体因此有了短期记忆,也有了遗忘。每个音相对原曲的累计漂移有硬上限,所以再怎么传,曲子始终锚在原曲附近:它会走样,但不会散。 ▍在现场,你会遇到这些 屏幕是一片暗色的萤火虫。它们不是装饰,每一只就是一只蜂,守着它那两拍。音符到达时,对应的萤火虫亮一下;被改过的音带着一点不一样的声色——合唱多一层高八度的泛音,太鼓的击打更沉——同时那只萤火虫换了颜色,泛起一圈涟漪。你在手机上轻点一下,画面边缘会涌出一道光波,落到某个拍点上;那一带的几只蜂因此醒来,开始各自掂量要不要动一个音。你对着摄像头张开五指,萤火虫分成五簇聚到你的指尖;握拳,它们四散。有人戴着智能眼镜拍下一张照片,同一道光波从另一侧涌进来。 你不会立刻听到「你的那一声」——你听到的,是几秒后某只蜂替你做的一个小决定;它可能什么也没改,也可能让一个合唱音亮了半个音。这种延迟和不确定,就是这件作品想让你感到的东西:你影响了它,但你不拥有它。 而在另一块屏幕上,操作员看到的是同一场演出的内里:每一轮的乐句泳道,哪几个音是原曲、哪几个是上一轮继承来的、哪几个是这一轮刚被改的;每一只蜂的判断、被拒绝的理由、模型用了多少字、花了多少钱。两块屏幕,一个是梦,一个是账本,讲的是同一件事。 ▍观众是蜂群的感官,不是遥控器 手机触屏、对着摄像头挥手(自托管手部关键点识别)、智能眼镜采集,都以同一种「刺激」形状进入正在演奏的这一轮,成为某只蜂做判断的证据。这个入口是通用的,光传感器、心率、天气随时可以接进来。没有人能直接改一个音,你能做的只是让某处的环境「活」起来。 ▍我们做出的几点进展 一,把创作判断压缩成受约束的选择:模型不写自由文本,只回一个概率分布,单次判断约一秒、万分之零点五美元,一整场的群体协商花不到几美分,同时模型永远无法破坏乐句,因为合法性由确定性规则单写。 二,全因果账本:每个音都能追到「原曲 + 最近一次判断 + 触发它的那次刺激」,屏上没有一个数字是估的,缺失就写「未采集」;一个集体创作过程第一次可以被逐音审计。 三,时钟与判断解耦:音乐按音频时钟走,模型延迟不会拖慢节拍,迟到的判断改不了已经演奏的音——这在把 AI 放进实时艺术里时是必须先解决的问题。 ▍它没有回答什么和正在探索什么? 它没有证明群体比单个模型「更聪明」,也没有让 AI 学会音乐。它正在探索的是,当每个 AI 只有局部视野,只能通过修改环境影响彼此时,群体会不会形成有方向的演化?而不是噪声。下一步要验证的机制已经在设计里:让群体在无人干预时也保持内生活力;把每只蜂的概率分布写进痕迹,让邻蜂读到的不只是「有人改过」,还有「改得多坚决」;引入法定人数——同一个音要多只蜂倾向同一方向才生效。音乐只是最容易被感知的载体:同一套机制换掉「音符」,可以是一群蜂决定在哪里种一棵树,或者一群蜂在一张画上各自落笔。 ▍前景 近处,它是一种新的现场艺术装置形态:展览、音乐节、品牌空间里一件随在场者一起变异、每晚都不一样的作品,作品可以按轮存档并以账本证明它的来历。中间一层,它是一个可以交给创作者的引擎:给一段旋律、一张草图、一段文本,让一群受约束的小判断在你设定的边界内慢慢变化演进,你随时能回看每一笔为什么发生。更远处,这种「局部视野 + 环境介导 + 受约束选择 + 全因果审计」的组合,本身就是一种便宜且可解释的多智能体协作架构,适用于需要许多小判断,但又不能容忍任何一次判断越界的场景。我们先在一首歌里把它跑通。 ▍ 今晚它在演奏的这一轮,明天不会再有。扫码打开 ytd.rickyke.com,听一听此刻正在被改动的这一版。如果你点了一下屏幕,几秒后某个音的走向里,就有你的一点刻进时间里的经验。 《傀儡謡》里,人形被舞动,神明便降临。在咏叹调里,被舞动的是一群微小的判断,而降临的灵魂不在任何一只蜂之中——它是所有人留下的触碰在这首歌里的累积与继承。 你离开之后,你的灵魂,仍然在回响。
[ 演示视频 ]
时长 0:30
[ 项目图集 ]
咏叹调·第三种生产方式 · 咏叹调·第三种生产方式 · EvoTavern · EvoTavern