用国家课程构建数据,让 LLM 更懂文化
davlanade · x · 2026-08-28
论文提出了 CuCu 框架,利用国家级社会研究课程作为基础,通过多智能体 LLM 自动将教科书课程转化为开放式、文化特定的问答对,用于监督微调(SFT)。研究者将其应用于韩国课程,构建了包含 3.41 万个 QA 对的 KCaQA 数据集。实验表明,该数据集覆盖了文化特定主题,并能生成符合当地社会文化背景的回复,解决了 LLM 在非英语文化背景下表现不均的问题。
「研究」频道最新
- 新研究用修饰 tRNA 救治囊性纤维化无义突变 — anshulkundaje · 2026-08-28
- vLLM 深度测评:MTP、EAGLE 等 5 种推测解码在 AMD 显卡上的实战表现 — vllm_project · 2026-08-28
- 11 年机器人进化对比:量产与全身 RL 控制是关键 — chris_j_paxton · 2026-08-28
- Agent-Core 规范:定义智能体的内核安全与任务合约机制 — BLUECOW009 · 2026-08-28
- 谷歌开源 SAM:主权智能体网络框架 — adnan_hashmi · 2026-08-28
- Marin 535B-A23B 训练进度 7%,团队将分享设计决策与权衡 — bariskasikci · 2026-08-28