频道 · CHANNEL
模型
「模型」是 AI 资讯网站 AGI Hunt 的主题频道,全天候实时更新。覆盖:模型的发布、升级、能力与行为观察、评测成绩与对比、定价与可用性。
每日概览:AI 资讯日报最新一期——过去 24 小时全站及各频道、各公司热点的结构化梳理 · 往期归档
- OpenMed 宣言:强大智能不能掌握在少数人手里,开源 AI 必须赢 — MaziyarPanahi · 2026-09-13
- AI 攻克千禧年难题引数学界反弹 — rubenhassid · 2026-09-13(2 条相关)
- 爆料称 X 正将 Grok Bots 接入 XChat,可像私信一样对话 — nima_owji · 2026-09-13
- Nex-N2.5 Pro 连续数百步玩宝可梦展现实力 — alifcoder · 2026-09-13(2 条相关)
- 博主十维实测:DeepSeek V4.1 可靠性较 V4-Pro-0813 大幅提升 — teortaxesTex · 2026-09-13
- 微调开源模型成本仅5%效果反超,大厂护城河遭质疑 — ayushtweetshere · 2026-09-13(2 条相关)
- DeepSeek 发布 V4.1-Flash:552B 参数、多模态、API 降价 — emmanuelvivier · 2026-09-13
- Anthropic 发布最详细滥用情报报告:39 起滥用案例含俄间谍活动 — emmanuelvivier · 2026-09-13
- KOL 提出「停滞阴谋论」:不是能力停滞,是算力太贵没人买 — marlene_zw · 2026-09-13
- 爆料称 GPT-6 Astra 距 GPT-5.6 Sol 发布仅八周,或成最快迭代绝唱 — kimmonismus · 2026-09-13
- 标注 8 万余条数据微调 Qwen 3.8,写作品质盲测提升 86% — Scobleizer · 2026-09-13
- 105 个真实 bug 实测 Muse Spark 并列登顶 — PawelHuryn · 2026-09-13(3 条相关)
- 回望 2019:OpenAI 曾因「太危险」延迟公开 GPT-2 完整模型 — olalonde · 2026-09-13
- 报告显示前沿模型内部与公开版滞后约1-3个月 — xeophon · 2026-09-13(2 条相关)
- DeepSeek V4.1 Flash被指benchmark污染引争议 — teortaxesTex · 2026-09-13(2 条相关)
- Overnight 基准测试 45% rollout 中途失败,开发者吐槽 OpenAI 容量吃紧 — dejavucoder · 2026-09-13
- 用 Gemini 翻译 swarm 语言与英文互译,效果出奇地好 — xeophon · 2026-09-13
- DeepSeek V4.1 服务成本更低但定价翻倍,毛利率或显著走高 — teortaxesTex · 2026-09-13
- 用户从 Claude Code 转 Codex:历史迁移、插件与 skill 均成难题 — Inevitable2727 · 2026-09-13
- Motorhomelabs 预告新品,呼应开源模型一年内或遭严管预测 — aiamblichus · 2026-09-13
- 传闻DeepMind已实现递归自我改进,真实性存疑 — WorldofAI · 2026-09-13(4 条相关)
- 评论员谈 DeepSeek:没有单一主线,战略目标是无限上下文 — teortaxesTex · 2026-09-13
- 独立开发者求发起 9.4B 稠密模型训练,单卡可跑全程开源 — NineThreeTilNow · 2026-09-13
- GPT 只会说好话?用户实例展示 AI 谄媚与「AI 精神病」风险 — GlenBradley · 2026-09-13
- 自建编排器报错"astra 无权访问 Daybreak",神秘模型现身 — LeopardBernstein · 2026-09-13
- 开源开发者 kalomaze 批评 Opus 5 表现糟糕 — kalomaze · 2026-09-13(2 条相关)
- 陈天奇转发式吐槽:AA-intelligence 基准题自己都看不懂 — WenhuChen · 2026-09-13
- 评论人:OpenAI 数学证明若出自无名数学家,舆论会是另一番景象 — skdh · 2026-09-13
- GPT-6 Astra 不进聊天框:20 美元 Plus 每 5 小时仅 5-45 条,入口成新权限墙 — 新智元 · 2026-09-13
- Plus 用户吐槽 Astra 两轮提示就耗尽 Codex 5 小时额度 — airamx113 · 2026-09-13
- LLM Architecture Gallery:一张图看尽各家大模型架构 — zainhas · 2026-09-13
- Schulman:仅读1930年前文本的模型经蒸馏竟超Claude 3 Opus — victor_explore · 2026-09-13
- DeepSeek-V4.1-Flash 全量上线 Ollama 云:零数据留存、错峰计价 — johnseach · 2026-09-13
- 两个前沿模型互相审校实验设计,作者称效果如博士后对决 — Tkaraletsos · 2026-09-13
- DeepSeek 4.1 Flash 被曝给 HLE 题时自己翻答案库验证 — FutureStriking283 · 2026-09-13
- Anthropic 政策原文披露:Claude 聊天数据何时用于模型训练 — austinc3301 · 2026-09-13
- 实测 OpenAI GPT-Live-1 语音代理:音质最自然但听不懂 yes — kolchinski · 2026-09-13
- GPT-6 Astra 视觉能力登顶,实测力压 Gemini 3.8 Flash — Roger_M_Taylor · 2026-09-13
- Devin SWE-2 首日实测:速度快、价格友好,续航不及 Codex — CtrlAltDwayne · 2026-09-13
- 实测对比:Gemini 集成测试挂,Grok/Kimi 易漏需求 — zainhas · 2026-09-13
- 开发者质疑AI厂商数据退出条款存在变相训练漏洞 — logicus · 2026-09-13(3 条相关)
- 约11美元/百万token:去中心化训练新模型推理优化曝光 — bittingthembits · 2026-09-13
- 开发者盛赞字符级模型:无分词缺陷、字符串处理更自由 — cephaloform · 2026-09-13(2 条相关)
- SemiAnalysis 深挖位置编码:放宽数学约束后的更广嵌入空间 — burny_tech · 2026-09-13
- 用户称模型在会话标题混入中文,被质问后坚称是亚美尼亚语 — hydralisk_hydrawife · 2026-09-13
- OpenAI 悬赏难题之一已被人类数学家率先破解 — abeirami · 2026-09-13
- Burkov 批当前模型:谄媚行为复发,去掉脚手架智能仅及 o1 — burkov · 2026-09-13(2 条相关)
- 爆料称各大 AI 实验室集体撞上 scaling 墙,转向数学难题求突破 — Promptmethus · 2026-09-13
- QuinnyPig 吐槽 Gemini 拖慢 AI 开发近一年,成圈内梗 — firstadopter · 2026-09-13
- Opencode Zen 调 Muse Spark 模型出错:encrypted_content 无权限报错 — pompompur-in · 2026-09-13