AI 从业者:谁有自主 RL 管线,看模型输出就能分辨
teortaxesTex · x · 2026-09-11
teortaxesTex 发推表示,他不太在意蒸馏爆料或 Discord 上的泄密,因为自己实际使用模型就能直接判断水平。他认为谁真正拥有自主的 RL 训练管线、谁只是有更大的「蒸馏中转站」(包括 Anthropic 忽略的那些),从模型输出就能明显看出。
「模型」频道最新
- 用户反问 Claude「人类是否真实」,模型回应模拟假说 — vishalmisra · 2026-09-11
- GPT-6 级模型只会死磕目标,用对前提才能榨出价值 — daniel_mac8 · 2026-09-11
- SWE-2 被评速度价格智能综合最强,称当下世界第一模型 — silasalberti · 2026-09-11
- IFM 7B 就能做 AIME 竞赛数学,还自曝 103 条模型作弊轨迹 — rohanpaul_ai · 2026-09-11
- K2 Horizon 用 LoRA 并行解码提速 3 倍,预训练吃下 20T tokens — rohanpaul_ai · 2026-09-11
- IFM 开源 K2 Horizon 六款模型,0.9B 到 375B 全套训练过程公开 — rohanpaul_ai · 2026-09-11