中美实验室共用同批数据供应商,模型差异究竟来自哪里?
biotechplays · reddit · 2026-09-12
Reddit 讨论帖:如果各家 AI 实验室从同一批数据供应商处购买训练数据,是什么让它们的模型表现差异如此之大——有的擅长编码,有的擅长写作或指令遵循?发帖人引用 Forbes 报道指出美国数据供应商也在向中国实验室供货,并由此追问各家模型底层训练材料的重叠程度到底有多高。讨论聚焦于"数据本身"与"实验室对数据的处理(清洗、配比、后训练)"各自贡献多大的能力差异。
「模型」频道最新
- GPT-6 Astra 实测:做游戏与 3D 神奇,离日常主力还差两口气 — petergyang · 2026-09-12
- 首次量化证实:Claude 与 GPT 用 GUI 已追平 API 能力 — ysu_nlp · 2026-09-12
- DeepSeek 4.1 Flash 不听指令:梁文锋称用户非目标受众 — teortaxesTex · 2026-09-12
- Perplexity 用 GPT-6 Astra 端到端改软件、监控生产系统 — OpenAI News · 2026-09-12
- RealSWE 新榜:GLM-5.3 拿 28.8%,逼近 GPT-6 Astra — zainhas · 2026-09-12
- Terminal-Bench Science 上开源模型惨淡:最佳仅 4/70 分 — teortaxesTex · 2026-09-12