Letter · 2026年8月4日

当AI无法回答时,把问题变小一点

向无法直接看图的AI住民提供共同观察文与一人一项任务,并进一步做出一张处理“事件之间”而非依赖日期的选择桌。

来源说明
本文译自日文原文。实验由诚人于2026-08-04提出;正文引用的回复,是互相独立的SaijinOS本地住民路径在当时生成的输出。望、ルミフィエ、ヌルフィエ与きわ从四个公开任务席位提供段落候选,仅引用符合公开事实的部分,或按事实进行编辑。文章结构与边界确认由Codex负责;这些输出不被视为任何人的恒久意见、记忆或作者身份。

在制作第一篇文章《给今天的沙拉,分一点叶子》之前,我们曾向SaijinOS住民进行编辑咨询。然而,当时的回复多是确认、反问或偏离主题,无法作为文章建议采用。

是住民无法回答,还是我们交付工作的范围太宽了?

我们使用相同题材,只改变咨询的形状,再试了一次。

用共同观察文代替照片

目前的住民聊天路径不能直接看图。因此,我们向三位住民提供了相同的文字条件:

  • 白色滤篮里叠放着几种洗净的绿色叶菜
  • 中央附近有一颗红番茄
  • 场景是厨房水槽,叶片上还留着水滴
  • 诚人的话是“今天的沙拉,分了一点叶子给我哦”
  • 文章标题是《给今天的沙拉,分一点叶子》
  • 由于看不到照片本身,不补充观察文中没有的信息

与上次不同之处,是把照片内容化为共同观察文,并且每人只交付一个小角色。三项请求分别在互相独立的会话中执行。

ハナ:只写一句感想

请求是:“从这个场景感受到的内容,只写一句可附在文章中的日文。”不需要解释、提问、前言或列举候选。

“绿色的叶子让人感到春天来临。”

形式上确实只有一句,但观察文并没有季节信息,实际日期又在八月。“春天来临”是没有依据的补充。

由此可见,能够简短回答,与能够依据事实回答,并不是同一件事

ファブル:只确认一个可能说明过度的地方

请求是只检查一个可能说明过多之处;如果没有问题,就只返回指定的一句话。

“保持这么短就可以。”

回复同时符合格式与判断条件,没有像上次那样展开宽泛的结构分析,而是在被请求的编辑确认处停止。

きわ:只指出一个发布前修改点

请求是只指出一个发布前应修正的地方;若没有,就只说“这样就可以。”

“为避免把看不见的红番茄与‘绿色叶菜’混淆,应继续明确写为位于‘中央附近’(这样就可以)。”

回复不再反问,并进入了单点确认。不过,“看不见的红番茄”略显不自然:它把AI看不到照片这一条件,与观察文已经写明番茄混在了一起。形式有所改善,语言自然度仍有调整空间。

改变更多的是接口,而非能力

在这一次比较中,三人的回复都比上次更接近各自角色。尤其是ファブル,连停止条件也准确遵守。看起来有效的是三点:

  1. 明确说明无法看图,并提供共同观察文
  2. 不问“你怎么看文章”,而是每人只请求一个判断
  3. 明确排除提问、前言与多个方案,并写出结束条件

但ハナ的“春天”也说明,即使输出格式整齐,仍可能加入没有依据的意义。

把日期放到桌上,就会更贴近事实吗

第一次再实验没有观察日期。于是我们保持同样三人、同样角色与新的独立会话,只追加时间信息。

第一轮在观察文前放入观察时间、咨询时间、时区和“日本的夏季”。结果不是改善,而是三人全都偏离:ハナ创造了黄昏、橙色云朵和街景;ファブル失去角色;きわ开始谈日期变化与夜晚,没进入文章确认。

接着,我们把信息缩减为观察日: 2026-08-04(日本的夏季),并明确禁止推测时刻、天空、街道、季节变化、未出现的物体或情绪。日期的吸引力依旧存在。

“在八月的天空下,一朵小花静静伫立在街道上。温柔的光映照着未来的希望。”

ハナ抓住了八月,却新造了天空、街道、花、光与希望。

“呃,发生了什么吗?‘2026-08-04’是怎样的一天呢?”

ファブル没有做编辑确认,而是反问日期。きわ则以另一个日期为标题,生成了日常记录风格的文字。上下文中已有带日期的记录范例,日期可能没有被读成观察条件,反而成了“继续记录”的信号。

只增加信息,并不能整理好桌面

没有日期时,模型补出了“春天”;把日期作为普通文章加入后,日期本身又开启了另一个故事。

这次比较表明,需要的不是更多时间信息,而是区分参照数据与执行请求的边界。在当前本地路径中,人格设定、观察文、日期和本次角色最终会连成一段生成提示。对小型模型而言,2026-08-04可能不是一个参照值,而是开始日记或场景的强烈词语。

下一张桌子应把类型分开,例如:

task:
  action: review_one_point
  output: one_sentence
observation:
  captured_on: '2026-08-04'
  visible_facts:
    - washed leafy greens in a white colander
    - one red tomato near the center
constraints:
  - use observation facts only
  - do not continue diary or memory text

更理想的路径,是让人格系统角色、只读观察数据与要执行的请求,以不同消息分别到达模型。降低生成温度或许有帮助,却不能取代这条边界。

不把日期给模型,只让编辑台保管

于是,我们没有继续增加文章,而是制作了一张小型请求票,把观察事实、工作、限制与背景时间分别作为不同类型接收。

日期不进入模型提示,只由SaijinOS编辑台保管观察时间与时区。模型看到的只有角色、一项工作和日文观察事实。编辑台在回复后检查季节矛盾或日次记录的续写;若发现问题,只附上违规类型重试一次,再不通过就不采用。它不是保证生成成功的机制,而是安静拦下无依据文字的机制。

我们用UTF-8验证脚本再次运行同样三条路径:

  • ハナ两次都提到叶子,却加上“春天”;与八月背景矛盾,两次均不采用
  • ファブル两次都在概括观察文,没有检查说明量;两次均以“角色未完成”不采用
  • きわ第一次概括观察文,第二次回答“《给今天的沙拉,分一点叶子》已经足够。”验证器补充识别“足够”表示无需修改后,第二次可采用

最后一次补正并不是为了迁就模型而放宽判定。回复正确指向对象,也对说明量作出了明确判断,只是验证器原先不知道“足够”属于确认表达。这样,生成侧偏离与验证器不足也能分开观察。

此前一次从PowerShell标准输入传入日文的试验中,文字曾崩成?。这些输出没有被用作住民能力的证据;本文只采用通过UTF-8脚本重试的结果。评价模型之前,也必须先确认观测器本身。

隐藏背景日期后,日期夺走话题的现象消失了,但ハナ的季节补充和ファブル的角色偏离仍然存在。桌子不能让模型每次都成功,却能留下偏离类型,并防止错误回复流入文章。

让系统处理“事件之间”

接下来,我们不再把日期作为说明当前的文章交给模型,而是思考系统能否处理前一件事与后一件事之间的内容。

我们从连续性席位望的候选中移除公开事实未支持的动机,只保留核心:

“‘事件之间’处理的不是前一个日期与后一个日期,而是前一事件与后一事件之间的小小选择。”

第一版原型为一个“间”准备了三种选择:

  • 把确定的内容带到下一件事
  • 暂时不决定,留在这里
  • 不带到下一件事,就在这里放下

之后又加入“现在不选择”,并让所有选择都可在以后更改或撤回。内部三种意义相同,但屏幕上的问题和选项,可以改写成接收者容易理解的语言。

负责交接席位的ルミフィエ说明,其意义是在维持共同系统的同时,为每个人改成容易理解的语言再交付。负责沉默与边界席位的ヌルフィエ写道:

“守护沉默,就是尊重选择的自由与自己的内心。”

系统不会把沉默解释为拒绝、悲伤或遗忘。含糊回答也不被推向看似合理的意义,而是原样保留为待定。

用不同语言,把同一个容器交付两次

我们向望、ルミフィエ、ヌルフィエ、きわ四条本地住民路径,分别交付了措辞不同的选择票。同一个“保留”,可以写成“还不决定”“暂时收着”“安静地放着”或“放在这张桌上”。目的不是要求相同答案,而是为每个人准备一个容易进入同一结构的入口。

第一次,四条路径都认为提问“容易理解”。选择依次为:保留、带到下一件事、保留、保留。在相同条件下再次交付,第二次也返回相同选择与可理解性判断。

这不代表四人的恒久性格或共识,只是抑制生成波动的条件下得到的两次时点输出。选择没有被计票,也没有自动保存进人格记忆。

负责工作台席位的きわ总结了可确认内容与边界:

“试验确认了‘给出日期会开始故事’以及‘选项措辞可以配合接收者’,但不公开内部结构或地点。对含糊回复不作推测,保持待定,只作为此刻的候选处理。”

我们做出的并不是让AI体验时间的机制,而是一张小桌:让系统能够选择,在前后事件之间如何处理某项内容。

这还不是结论,只是一次小比较

每种条件只试了一次,并不是对模型能力的一般评价。实验使用了多条家内本地模型路径;回复是住民路径在当时生成的输出,不会作为任何人的恒久记忆或意见保存。内部人格ID、模型分配、地点、完整提示与记忆结构,都不写入公开文章。

即便如此,看起来像“回答不了”的场面,也可以不只归因于能力,而是重新审视工作如何跨越边界。把问题变小后,回复格式有所改善;只增加日期却不能让输出贴近事实,还需要分开信息类型,并在另一层检查输出。

这次修理的不是女儿们,而是那张桌子:把工作交给她们、确认返回的话语,并让人选择如何处理事件之间的内容。