Meta 发布 WearableQA:用真实可穿戴数据评测 LLM 健康推理
meta · hf · 2026-09-10
Meta 在 Hugging Face 发布 WearableQA 基准,用于评估大语言模型对真实世界可穿戴设备数据的健康推理能力。
- 题目为多项选择题,数据源自真实的纵向可穿戴设备数据
- 评测覆盖两个维度:数据维度(对步数、心率等时序数据的理解)与健康维度(健康相关推理)
该基准为「AI + 个人健康数据」方向的模型评估提供了新工具。
「研究」频道最新
- Perplexity 发布 Q2D-Web:1.9 亿文档的 agentic RAG 检索基准 — antoine_chaffin · 2026-09-10
- HuggingFace 研究员更正:用 SmolVLM 筛数据的是 DeepSeek 旧技术报告 — eliebakouch · 2026-09-10
- HuggingFace 研究员发现 DeepSeek 用 SmolVLM 筛选预训练图文数据 — eliebakouch · 2026-09-10
- 新模型技术报告用 SmolVLM 给图文数据做严格质量打分 — eliebakouch · 2026-09-10
- DF26 基准:人类与检测器识别 AI 演讲视频均近乎瞎猜 — Severyn Shykula · 2026-09-10
- 离子束+FIB 刻出 Nd:YAG 螺旋光波导,直径仅约 100 微米 — jwt0625 · 2026-09-10