Meta releases WearableQA, a benchmark testing LLM health reasoning on real wearable data

meta · hf · 2026-09-10

Meta has released WearableQA on Hugging Face, a benchmark for evaluating how well large language models reason over real-world wearable device data in health contexts.

It offers a new evaluation tool for models working with personal health data.

Original post →

More from Research

Research channel →