Vocalink · Phase 1 · 中英双语审核 · AI + 人工双轨
🎯 审核目标:在实时语音社交场景中,以 < 2 秒延迟识别并处置违规内容,保障用户体验与平台安全。
| 层级 | 机制 | 延迟 | 覆盖率 |
|---|---|---|---|
| L1 实时 | AI 自动审核(NLP + 音频分析) | < 2 秒 | 100% |
| L2 深度 | AI 深度分析 + 人工抽检 | < 10 秒 | 高风险 100% |
| L3 人工 | 7×24 人工审核团队 | < 5 分钟 | 举报 100% |
| L4 事后 | 离线模型迭代 + 趋势分析 | 每日 | 全量 |
| 内容类型 | 审核方式 | 语言 |
|---|---|---|
| 实时语音(ASR 转写后) | L1 实时 AI + L3 人工抽检 | 中文 + 英文 |
| 翻译文本(字幕) | L1 实时 AI | 中文 ↔ 英文 |
| 用户资料(昵称/头像/签名) | L1 AI + L2 人工审核 | 中文 + 英文 |
| 私聊文字消息 | L1 AI + 举报触发 L3 | 中文 + 英文 |
| 礼物/虚拟物品名称 | L2 上架前审核 | 中文 + 英文 |
| 举报内容 | L3 人工优先处理 | 中文 + 英文 |
| # | 类别 | 示例 | 严重度 | 默认处置 |
|---|---|---|---|---|
| 1 | 仇恨言论 | 种族/宗教/性别歧视 | 紧急 | 立即封号 + 报警 |
| 2 | 骚扰/霸凌 | 持续骚扰、人身攻击 | 高 | 警告 → 封号 |
| 3 | 色情/性暗示 | 露骨语音、性交易暗示 | 高 | 立即封号 |
| 4 | 暴力/威胁 | 人身威胁、自残引导 | 紧急 | 立即封号 + 报警 |
| 5 | 未成年人风险 | 与未成年人不当互动 | 紧急 | 立即封号 + 报警 |
| 6 | 诈骗/钓鱼 | 投资诈骗、身份盗用 | 高 | 封号 + 冻结资金 |
| 7 | 垃圾/骚扰广告 | 反复发送推广信息 | 中 | 限流 → 封号 |
| 8 | 虚假信息 | 谣言、误导性内容 | 中 | 标记 + 降权 |
| 9 | 自残/自杀 | 自残描述、自杀倾向 | 紧急 | 介入 + 资源引导 + 报警 |
| 10 | 知识产权 | 未授权音乐/内容播放 | 低 | 内容移除 |
| 组件 | 技术 | 功能 |
|---|---|---|
| ASR 输出拦截 | Kafka consumer | 实时消费 ASR 文本流 |
| 关键词匹配 | Aho-Corasick 算法 | 毫秒级多模式匹配 |
| NLP 分类 | BERT-base(中英双语微调) | 语义理解 + 上下文 |
| Perspective API | Google Perspective | toxicity / insult / threat 评分 |
| 音频分析 | 声学特征 + 情绪识别 | 尖叫/哭泣/暴力声音检测 |
| 决策引擎 | 规则 + ML 打分 | 综合判定 + 动作执行 |
| 风险分 | 判定 | 动作 | 延迟 |
|---|---|---|---|
| 0-20 | 安全 | 放行 | < 500ms |
| 20-40 | 低风险 | 标记 + 后续抽检 | < 1s |
| 40-60 | 中风险 | 警告用户 + 降权 | < 1.5s |
| 60-80 | 高风险 | 中断通话 + 转 L3 | < 2s |
| 80-100 | 极高风险 | 立即封号 + 报警 | 即时 |
| 指标 | 目标 | 测量方式 |
|---|---|---|
| 拦截延迟 P95 | < 2 秒 | 从 ASR 输出到决策 |
| 准确率 | > 95% | 人工标注验证集 |
| 误杀率 | < 2% | 用户申诉率 |
| 召回率 | > 98% | 漏网违规抽检 |
| 覆盖率 | 100% | 所有通话必经审核 |
| 项目 | 配置 |
|---|---|
| 团队规模 | 15 人(Phase 1)→ 30 人(Phase 2) |
| 排班 | 7×24 三班制(早 8-16 / 中 16-24 / 夜 24-8) |
| 语言 | 中文(简/繁)+ 英文(新加坡/马来西亚口音) |
| 响应 SLA | L1 紧急 5 分钟 / L2 高 30 分钟 / L3 中 2 小时 |
| 培训 | 每周培训 + 月度考核 + 心理支持 |
| 工具 | 自研审核工作台(标签 + 快捷操作 + 上下文) |
| 次数 | 处置 | 持续时间 | 解除条件 |
|---|---|---|---|
| 第 1 次 | 警告通知 | — | — |
| 第 2 次 | 禁言(无法发送语音/文字) | 24 小时 | 自动解除 |
| 第 3 次 | 禁言 + 功能限制(无法匹配) | 7 天 | 自动解除 |
| 第 4 次 | 临时封号 | 30 天 | 人工申诉审核 |
| 第 5 次 | 永久封号 | 永久 | 不可申诉 |
| 步骤 | 动作 | 时限 |
|---|---|---|
| 1. 用户举报 | 通话中/通话后一键举报 | 即时 |
| 2. 自动保护 | 立即断开双方 + 屏蔽对方 | 即时 |
| 3. 优先审核 | L3 人工插队处理 | < 5 分钟 |
| 4. 处置通知 | 通知举报人处置结果 | < 10 分钟 |
| 5. 反馈收集 | 举报人对处置满意度评分 | 24 小时内 |
| 新加坡法律 | 对应违规 | 平台义务 |
|---|---|---|
| Penal Code §298 | 宗教/种族仇恨言论 | 立即移除 + 可报警 |
| Penal Code §377A(已废除但相关) | 非自然性行为 | 内容审核参考 |
| Protection from Harassment Act | 网络霸凌/骚扰 | 用户可申请保护令 |
| Children and Young Persons Act | 未成年人剥削 | 强制报警 |
| Undesirable Publications Act | 淫秽内容 | 立即移除 |
| Computer Misuse Act | 黑客/诈骗 | 封号 + 报警 |
| Misinformation Act 2024 | 虚假信息 | 标记 + 降权 |
| PDPA §26 | 隐私侵犯 | 移除 + 通知 DPO |
🚨 强制报警情形(不等待用户举报):
| 步骤 | 动作 | 时限 |
|---|---|---|
| 1. 用户提交申诉 | App 内"申诉"入口 | 封号后 30 天内 |
| 2. 自动受理 | 生成申诉单 + 通知用户 | 即时 |
| 3. 人工复审 | 不同审核员独立复审 | < 48 小时 |
| 4. 结果通知 | 维持/撤销 + 说明理由 | 复审后即时 |
| 5. 二次申诉 | 可升级至高级审核员 | < 5 个工作日 |
| 情形 | 补偿 |
|---|---|
| AI 误杀(确认误判) | 恢复账号 + 赠送 100 金币 + 道歉信 |
| 审核员误判 | 恢复账号 + 赠送 200 金币 + 人工道歉 |
| 系统错误批量影响 | 全量恢复 + 补偿 + 公开声明 |
| 类型 | 管理方式 | 更新频率 |
|---|---|---|
| 基础词库 | 内置(仇恨/色情/暴力核心词) | 季度更新 |
| 动态词库 | 运营实时添加(新趋势/新骗局) | 实时 |
| 白名单 | 误杀词排除(如医学/学术用语) | 按需 |
| 本地化词库 | 新加坡/马来西亚特有俚语 | 月度 |
| 版本 | 日期 | 修改内容 | 作者 |
|---|---|---|---|
| V1.0 | 2026-08-15 | 初始版本 | Safety Team |