音视频实时决策 Lab所有实验 ↗
08 / VOICE MODERATION

听清内容,给出审核建议。

每个停顿语段独立审核,直接判断内容类别与风险,不经过转写。

连接未启动WebSocket · clef-omni
01本地 VAD语音 / 停顿
→
02Clef Omni内容分类 · 单次请求
→
03审核建议通过 / 标记 / 复核
→
04结果展示预设模板 · 可继续输入
LIVE SESSION尚未开始
Ⅱ
准备好听你说

打开麦克风,或用内置语音体验真实 VAD → 模型判断。

语音概率 —尚无语音片段

开麦后,VAD 在本机运行;停顿切片才发送到 Cloudflare。不保存录音。建议戴耳机体验插话。

不开麦,也能体验

真实合成音频 · 同一条 VAD 链路

示例文字只用于展示;模型收到的是音频,不包含示例答案。

对话记录

录音无转写 · 不引入 ASR

你的语音片段、模型交接与演示回复会显示在这里。

这一次,模型怎么判断?

等待输入

表达语气 —

审核建议

等待输入

结合上下文判断,防骗提醒与诈骗诱导分别处理。

内容类别

内容风险评分

模型审核建议

VAD 静音窗口300 ms
模型推理—
提交至结果—
静音起至结果—
查看本次原始判断
尚无数据

状态轨迹

真实事件 · 最近 30 条
  1. 开始后观察状态如何轮转。
文字对照测试(不经过 VAD)

仅比较语义决策;不计入音频链路测试。

看懂这次实验

每个 VAD 语段结束后,一次 Clef 推理直接审核其中的表达,返回内容类别、风险评分与处理建议。防骗提醒、引用和直接诱导需结合语境区分;证据不足时转人工复核。回复采用模板,标记仅在当前演示中展示,不自动封禁、不发送通知。不会判断说话人的身份或真实意图。内置语音均为合成示例。