模型续评:伦理项目比时间表更耐久
LesaunH · x · 2026-09-22
这是该用户让 Astra 6 Pro 读完自己全部推文后模型评估的续篇。模型给出的最强评价是:作者的「伦理项目」比他的时间表更耐久——即「更强的能力应扩大人的生活空间,而不是制造新的淘汰理由」这一核心主张,并不依赖证明所有怀疑者愚蠢或每次争论获胜。
模型还点出一条自洽线索:从 2020 年用 GPT-3 探索话题、2022 年想要无限上下文与原文链接,到如今让模型把自己的多年上下文作为反思对象,作者的动作始终一致——把原本无法把握之物变成可以审视的对象。
「模型」频道最新
- DFlash2 搭配 GLM 5.3 Flash 处理超长 prompt 会出问题 — TheZachMueller · 2026-09-22
- 「MiMo 首创大规模 MOPD」:圈内热议 MiMo-V2.6 向 DeepSeek 叫板 — teortaxesTex · 2026-09-22
- 数字母测试翻车不冤:Jev 逐字母输入 strawberry 时 168/168 全对 — BLUECOW009 · 2026-09-22
- MiMo-V2.6 疑为开源界最大单次 RL 训练,罗福莉称难度超 DeepSeek R1 — teortaxesTex · 2026-09-22
- 博主自纠:落地 SF 发现真正惊喜是 MiMo-2.6,胜过 Grok 4.7 且更便宜 — kimmonismus · 2026-09-22
- cHHillee 力挺 Tinker:托管训练也能拥有自己的 post-training 代码 — cHHillee · 2026-09-22