功能指南

多模型运行、判定与继续执行

选择模型并确认当前采样轮次,理解运行进度、逐回答判定、部分成功、继续执行和固定费用边界。

9 分钟更新于 2026年8月19日核验于 2026年8月19日
本页目录

一次 AIV 运行可以选择 1~10 个当前可用模型。系统按问题、模型和采样轮次创建结果,并保存实际回答、品牌提及和确定性判定。

提交前

  • 确认项目、问题集和冻结知识版本正确。
  • 使用旧问题集产生的历史运行提示不支持现行三率时,先生成新版问题集并重新运行。
  • 只选择本次确实需要观察的模型。
  • 核对采样轮次、预计智贝、当前组织余额和价格提示。
  • 同一项目同时只能有一个待处理或处理中的运行;不要连续提交相同配置。

运行详情会展示什么

  • 问题与模型结果进度、成功和失败数量。
  • 模型渠道状态以及最近更新时间。
  • 测量完成率、质量状态、三率与 AIV 综合分。
  • 按页展示的逐回答问题、轮次、通过状态、判定摘要和回答原文。
  • 结构化报告的生成、成功或失败状态。

部分成功和继续执行

有效样本不足时,运行可能显示“数据待补充”,但只要认知、推荐和权威三个计分维度各有至少一个有效样本,三率和综合分仍会按已有有效样本发布,测量完成率继续反映缺样程度。

“继续执行”只在整轮运行处于失败状态、所有回答均失败或无效且当前成员有运行权限时出现。部分成功的运行不提供该入口。继续执行只处理原运行中的失败结果,复用原计费,不重复收取本轮分析固定费用。

报告失败不等于模型重跑

报告生成失败时,已有问答和指标仍会保留。点击“重新生成报告”只重新整理本轮既有证据,不会再次执行模型监控,也不会补算历史问题集缺少的指标。

操作结果与文档不一致?

先确认当前组织、任务状态和页面提示,再搜索对应错误现象。

继续排查