AUDIO. VISION. REAL-TIME DECISIONS.
理解音视频,
实时决定下一步。
从语音轮次到画面判断,观察 clef-omni 如何理解输入、选择行动。
八个交互实验,实时呈现每一次决策与概率。
01 / GESTURE↗
◯ △ ✓
手势识别
随手画一个形状,看看模型能否认出你的意图。
画布 · 两阶段判断02 / INSPECT↗
▦✓
视觉检测与工单
检查电路板、评估产品、审核图片,或为工单分流。
4 个场景 · 内置示例03 / ASSIST↗
▤ → ✦
截图建议
给模型一张截图,让它建议一个有用的下一步。
理解屏幕 · 建议行动04 / NAVIGATE↗
▲ · · · ■
机器人网格
让模型逐步转向、移动,找到并拾取红色方块。
3 个场景 · 逐步决策05 / VOICE AGENT↗
〰 ✦ ↗
Voice Agent
从声学停顿到语义接话:实时观察轮次、语气与工具判断。
真实 VAD · WebSocket · 可打断回应06 / PACKAGE↗
▱
包裹验收助手
选择包裹图片,直接判断外观、封装与处理建议。
图片检查 · 一次判断07 / PARKING↗
P
停车位状态
选定一个车位区域,观察空闲、占用和看不清时的判断。
固定车位 · 真实图片 · 概率决策08 / MODERATION↗
〰
语音内容审核
直接听语音,区分普通交流、辱骂与欺诈诱导等内容。
内容审核 · 语境对照 · 人工复核01 / GESTURE
画一笔,看懂你的意图。
随手画一笔,松开即识别。也可以点击示例,观察模型的判断。
可连续补画多笔,系统以最新完整画布为准。画新图形前请先清空。
试试这些手势点击替换画布 · 自动模式下立即识别
查看实际提交给模型的图像
自动裁去空白、等比放大;不改变图形方向或替换笔画。
在画布上绘制,松开后自动识别;也可以点击下方示例。
02 / INSPECT
从输入,到明确的判断。
选一张固定样例,看看模型如何判断。无需上传,打开即可体验。
固定体验样例选好后点击「开始分析」
与同设计、同朝向的良品进行对比。
分析结果、概率与评分将显示在这里。
03 / ASSIST
这一刻,什么最有帮助?
选择邮件、文章、外语通知或报名表,看看模型建议做什么。也可以上传自己的截图。
选择一个截图场景点击切换 · 再获取建议
四张虚构界面示例,仅供体验。模型自行判断;本页只展示建议。
使用自己的截图
默认示例正在加载,选好截图后点击获取建议。
04 / NAVIGATE
每一步,都由模型决定。
蓝色三角是机器人,灰格是墙,红块是目标。选择动作时会提供网格图和完整状态。
最多 24 步;可随时停止自动运行。
点击「走一步」,观察模型选择。