数据与表格 · 仅汇总数据
家庭机器人与开放场景 · 语料汇总
家庭机器人研究的语料规模、来源构成与历史候选标签分布,配合任务与失败恢复笔记阅读。原始平台内容不再分发。
- 资料版本
- 2026-08-31 汇总快照
- 最近复核
- 来源
- 本站已公开数据汇总
- 复核状态
- 汇总算术、来源合计与公开字段已复核
使用边界
使用前先看
核对家庭机器人研究语料的规模、时间范围、来源集中度和结构问题。
208,755 条记录的聚合统计;6 类来源;JSON 与 CSV 汇总。
不含原始文本;机器候选标签不等于人工确认的任务或需求。
公开汇总
数据概览
统计单位是记录,不是人数或已验证需求。以下字段来自 2026-08-31 的公开汇总。
- 记录
- 208,755
- 来源类型
- 6
- 时间字段
- 2023-01
— 2026-08
主要来源
- Reddit184,00888.15%
- Hacker News19,0239.11%
- YouTube3,5811.72%
结构检查
- 重复记录 ID
- 0
- 无效 JSON 行
- 0
- 缺少既有文本哈希
- 1
- 逐条语义复核
- 未进行
最大来源占 88.15%。这是来源集中度,不是市场份额;机器候选标签也不是人工确认的需求。
查看三组数据的方法、交叉重复与完整边界 →这份快照怎样进入任务研究
快照覆盖 2023-01 至 2026-08 的开放场景记录。它的作用是帮助发现家庭任务、失败情形和替代方案的线索,再回到具体场景做人工判断;它本身不能回答家庭是否愿意长期采用或付费。
六类来源中,Reddit 占 88.15%,Hacker News 占 9.11%。平台讨论的出现频率不能外推为家庭用户分布,也不能替代接管次数、维护负担和长期使用行为。
标签与旧报告如何处理
E0–E5 是历史机器处理产生的候选结果。本轮核对了标签合计,没有逐条确认发言所指的产品、角色、上下文及实际行为,因此不沿用旧报告中未经复核的“需求已闭合”结论。
有一条记录缺少原有文本哈希。按规范化后的完全相同文本检查,本组与本地 AI 组共享 133 条文本,与 AI 眼镜组共享 72 条;这不是人物去重或语义去重。
复核到哪里
公开层只提供结构汇总、月份范围和输入摘要。原始反馈、个人标识、内部产品方案以及未经授权的第三方内容保持私有。完整方法和可复算层级见研究数据说明。
引用时请注明 Roy.Tong、标题、资料版本和本页地址。公开阅读不扩大第三方内容的再分发权。查看收录与引用规则