站内内容与 AI 工具一站式检索。
研究对开源Laya与托管Jev两个系统1决策模型在11个智能体决策点上做配对评估,共7283个基础用例加6640个鲁棒性变体。Jev在9个决策点显著更准,但两者在零样本模型路由上均未超随机水平。