智涌飞轮

具身数据 · 采集 × 效用计量 × 独立验证合作洽谈工作台登录
REAL-WORLD DATA × VALIDATION

数据的效用,看得见

业内按「有效小时」验收(质检口径)——我们给有效小时标上效用含量。下面全部是我们的实测数据:小模型对照实验(单卡小时级、三种子、脚本可复跑),不是示意图。
81pp
同样预算两臂效用差
斜率≈1
回放剂量-救回曲线
33%<80%
我们否决过自己的判定器
π0.5 两臂对照

同样预算,效用差 81 个百分点

0% → 86%
垂域精选 50 条
任务成功率 · 跨种子复现 71–81% · 基于仿真基准,真实迁移以 POC 为准
0%
通用底座 500 条
同样训练预算,数据换了分布,一分不涨
量效曲线(CL1-b 实测)

掺多少旧数据,救回多少旧技能

回放剂量 20%
旧技能救回率 19%(近似线性 · 斜率≈1 · 三种子一致)
这是数据的「剂量-响应曲线」——数据的价值第一次可以按剂量计价
六道闸 · 逐闸实跑

一批数据怎么被拦下 / 放行

演示批 A(拦截批)出具时间 2026-09-09 · 演示批 B(干净批)出具时间 2026-09-09 · 历史回放读数
REPLAY · REAL RUN

最近真跑(真实管道·真实数据)

六道闸管道最近一次完整读数(真实采集批次,非演示样本)——GPU 实例停机期间历史读数照常可查,实例恢复后此卡自动更新。
batch9-av15-conv7fail
总评 拦截
闸① PASS · 闸② PASS · 闸③ WARN · 闸④ BLOCK
出具 2026-09-16 22:29
工件 · 我们否决过自己的判定器

人工金标盲判 vs 判定器(真数据,10 条)

语义闸判定器报了 17.5% 错配率——发布前我们抽 10 条让人工盲判对表:一致率只有 33%,远低于 80% 门槛。 读数作废、不对外。这是校准环的第一次真实拦截。
一致率 3/9 = 33% < 门槛 80% → 判定器读数作废(假阳性 6 · 假阴性 0 · 1 条人工判「看不清」不计)
现场试吃(真训练 10 分钟出前后对比)
计算实例按预约开通——留下邮箱,我们安排用你带来的任务现场真跑一单对照
判据与阈值来源:200 条实测数据体检 + 四组验证实验(π0.5 效用对照 / CL1 持续学习 / G1 几何盲区 / X1 语义校准),全部可复跑、可查证。
如实标注的局限:几何哨兵的盲区随数据分布变化(我们自己的双数据集实验证明);语义判定器曾被我们的人工校准环否决过一次(33%<80% 门槛,读数作废)—— 敢把短板印在自己质检报告上的,才开始配当裁判。
数据样例已脱敏,原始素材不出采集域。 · 国曙具身数据生产网络 · 验证报告全文见 六道闸验证报告

真跑模式 · 现场真验一条

上面两批是历史演示;这一栏是真验——点击后云服务器直连 GPU 实例,用真实管道对一条真实样本现场跑四道质检(约 1-2 分钟,读数即下方)。

读取中…