跳到正文
原文
arXiv cs.AI· Priyanath Maji, Spandan Ghose Chowdhury·· 8 小时前AI 评分36

风险感知自适应评估:在有限预算下发现高影响失败

Risk-Aware Adaptive Evaluation: Finding High-Impact Failures Under Limited Budgets

AI 导读

研究提出风险感知的上下文 Thompson Sampling 策略,结合场景上下文向量、固定影响分数与评估中观察到的失败结果,按固定试验预算自适应分配智能体评测。

来源:arXiv cs.AI · arxiv.org