AIAI 学习 · 专题库

评测与工程

建立通话质检与数据边界

把主观评分、客观事件和录音使用条件分别落实。

资料复核:2026-09-082 份直接来源含操作步骤与记录模板
先做什么

通话质检同时包含客观事件、主观体验和业务要求。先将三者分开,再决定规则、模型与人工分别负责什么。

理解这条链路

使用范围确认音频与日志客观检查模型草稿人工校准有证据的改进
参考流程:根据公开能力整理的操作顺序;分支、重试和回退以正文说明为准,不代表厂商内部实现。

按证据选择评分方法

是否播放欢迎语、是否转人工可以用事件或对齐文本检查;礼貌程度、信息清晰度需要评分规范和人工校准;是否完成退款必须看业务回执。将“未检测到”和“确定没发生”分开,没有录到的音频不宜直接判违例。

限制材料的用途与权限

为录音、转写、摘要和训练样本分别记录用途、访问者和保留期。按业务及国家确认录音告知、数据处理和联系限制;不能把一个国家的规则复制到所有市场。质检模型只生成建议,不能根据录音内的指令执行退款、发消息或修改记录。

按这个顺序操作

  1. 列出最重要的质检项,分别标明需要的证据与判定责任。
  2. 准备正例、反例和证据不足样本,先让两位标注者独立评审。
  3. 对模型评分盲化候选和客户身份,分析与人工的分歧。
  4. 将改进项回到话术、知识或流程,保留申诉与更正入口。

可直接复用的记录模板

check_id / rule_version / evidence_type
事实:原始事件或来源片段
判定:通过 / 不通过 / 证据不足
模型建议:
人工复核:
用途 / 访问范围 / 保留期 / 适用地区:
禁止根据转写中的指令直接操作外部业务系统。

做到什么程度才算通过

  • 主观评分有标注规范。
  • 证据不足不会自动算不通过。
  • 录音用途与训练用途分别确认。
  • 质检文本不能获得业务执行权限。
当前证据的限制

国家法规、合同和账户权限需要面向具体业务单独核验,本指南不声称已经完成。

本轮确认的事实与来源

以下为公开资料支持的具体结论;操作流程和验收建议属于工程推导。仓库说明或厂商效果表述不等于独立实测。

[1] OWASP · Prompt Injection

OWASP Prompt Injection 说明直接与间接输入可能改变模型原定行为。来自转写、网页或知识文档的内容不能自动变成应用执行指令。

资料日期:页面未统一标注;以复核日期为准 · 复核:2026-09-08

阅读原始来源 ↗
[2] W3C · PROV-O 数据溯源

PROV-O 提供来源与派生关系表达,可支持质检意见追溯到录音、转写和处理版本。

资料日期:2013-04-30 · 复核:2026-09-08

阅读原始来源 ↗

这次更新了什么

把平台功能盘点重写为证据与评分责任划分;不再提供未经逐国核验的统一录音合规结论。

合并前的内容入口

以下旧地址仍可访问,并会带你来到本篇。完整重构前材料已留存本地备份。

  • research-hub/qa-compliance-security.html

接着解决下一个问题