Lode 需求雷达
--卡片
--主题
--失败
HN讨论 · 身份未知

LLM动作执行需补上禁止推断清单与不推断填空方法

表单自动化转向自然语言执行后,条件判断、表单选择、必填校验等行为被隐去,LLM缺少『哪些信息不允许推断』的明确清单,也不知道如何在不推断的情况下填空;作者提出一个执行状态预检作为尝试。

目标用户

使用LLM驱动表单填写、操作流程或智能体动作执行的开发者和产品团队

潜在需求

开发者需要一套清晰的禁止推断清单和对应方法,让LLM在动作执行中只填充明确允许的内容,而不自行推断缺失信息,例如通过执行状态预检验证上下文。

发生场景

在表单流程中,传统表单一次性完成条件判断、选择表单、取值、来源追踪和必填校验五项任务;改为自然语言后,取值之外的判断都交给模型,但没有人记录哪些行为会丢失,模型也没有被告知哪些信息不能推断。

来源证据

作者指出LLM在动作执行中缺失了『不允许推断』的清单,也没有展示如何在不推断的情况下填空。

A form did five things at once: judged the condition, picked which form to open, took the values, carried where each value came from, and validated the required fields. Natural language kept the third one and gave the rest to the model. Nobody wrote down which ones went missing. LLMs were trained by filling in blanks. Now that we've moved from conversation to action, we tell them not to fill in blanks. But nobody has handed them a list of what they aren't allowed to infer, or shown them how to
https://news.ycombinator.com/item?id=49271950

为什么值得留意

该信号指向LLM从对话转向实际动作执行时的关键缺口:推断边界控制。作者提供了具体尝试(execution-state-preflight),说明该问题已有人着手解决,且直接关联当前LLM智能体和表单自动化方向。

已有方案

  • 作者提出的execution-state-preflight(清单和方法尝试)

未满足部分

  • 没有公开的系统化『禁止推断』清单
  • 缺少如何在不推断的前提下填空的公开方法

可能延伸 · 模型推测

  • 将该方法封装为可接入LLM调用链的插件或库
  • 将预检清单扩展到更多动作执行场景(如API调用、数据库操作)

目前未知

  • 此信号来自项目作者本人,可能不是独立用户反馈
  • 没有其他评论或用户证言证实该问题的普遍性
  • 文本被截断,完整上下文有限

继续核实

  • 其他LLM工作流开发者是否遇到同样的推断边界控制难题?
  • 现有表单驱动方案(如JSON Schema校验)与这种自然语言方式的差距如何?
  • 该项目的预检方法是否能在不同LLM和场景下复现?

主题词

llm action executionform automationinference controlpreflight checklistblank filling

管理令牌