这次实验在演示里运行得很好,但进入真实数据后,边界情况迅速超过了主流程。失败带来的判断问题不在模型,而在于任务本身没有稳定规则。继续增加 Prompt 只会让系统更难解释。最终我们保留信息整理部分,把关键决策交还给人。
这次实验在演示里运行得很好,但进入真实数据后,边界情况迅速超过了主流程。失败带来的判断问题不在模型,而在于任务本身没有稳定规则。继续增加 Prompt 只会让系统更难解释。最终我们保留信息整理部分,把关键决策交还给人。