频道 · CHANNEL
模型
「模型」是 AI 资讯网站 AGI Hunt 的主题频道,全天候实时更新。覆盖:模型的发布、升级、能力与行为观察、评测成绩与对比、定价与可用性。
每日概览:AI 资讯日报最新一期——过去 24 小时全站及各频道、各公司热点的结构化梳理 · 往期归档
- 实测各 LLM 订阅真实代币价值:Grok Heavy 40 倍 ROI 最高 — thesaraharminta · 2026-09-11
- AI 研究者观察:纳维-斯托克斯突破后,怀疑派也开始相信 AGI 已至 — cloneofsimo · 2026-09-11
- 用户抱怨 gpt-6-astra 聪明又离谱,回退旧模型搭配使用 — rudrank · 2026-09-11
- GPT Pro 用户困惑:Codex 5.3 Spark 为何单独计量用量 — takshit2 · 2026-09-11
- 256k 上下文用到 80% 和 1M 用到 80% 效果一样吗 — BriefServe453 · 2026-09-11
- Pro 用户连续 4 天 90% 时间无法用 Codex,客服只有机器人 — Effective-System-727 · 2026-09-11
- DeepSeek 发布 V4.1-Flash,支持百万上下文 — matlabulous · 2026-09-11(2 条相关)
- 研究者澄清:Gemini 3.1 Pro 智能体实验在封闭模拟中进行 — QuintinPope5 · 2026-09-11
- 用户吐槽:OpenAI 200 美元档体验两周内已缩水回 100 美元水平 — AIandDesign · 2026-09-11
- 开发者实测 DeepSeek-V4.1-Flash 刷新开源 Boeing 基准 — victormustar · 2026-09-11(2 条相关)
- 新翻译模型评测频漏掉最强者,引业界共鸣 — bclavie · 2026-09-11
- 点评:所谓高质量数据集在基础审查下几乎无样本幸存 — xeophon · 2026-09-11
- HN 热议 DeepSeek V4.1 Flash 去审查 FP8 版本 — soltanov · 2026-09-11
- Codex Astra 6 周额度太苛刻,月付 600 美元用户直呼用不起 — AIandDesign · 2026-09-11
- 用户吐槽 ChatGPT 辩论中阴阳怪气,四次叫停仍屡教不改 — Dull_Bathroom5421 · 2026-09-11
- GPT-6 Astra 国际象棋 ChessBench 拿下 2340 Elo,排名第 11 — YakFull8300 · 2026-09-11
- 一周模型动态汇总:GPT-6 Sol 传闻、Gemini 4.0 内测、DeepSeek V4.1 Flash 发布 — WorldofAI · 2026-09-11
- GPT-6 Pro 攻 Erdős 问题 #488,产出候选证明并过两道算术验证 — basedjensen · 2026-09-11
- HighLevel 曝获 OpenAI 疑似新模型 GPT-Live-1 alpha 权限,实测语音通话 — OpenAIDevs · 2026-09-11
- CritPt 评测被指严重损坏,蚂蚁已在 F5.1 系统卡中用修复版替代 — xeophon · 2026-09-11
- Polymarket 开盘押注 OpenAI GPT-6 Astra 会否被停止公开访问 — Polymarket · 2026-09-11
- 用户实测:GPT-6 Astra 画 SVG 图标表现相当不错 — floguo · 2026-09-11
- 谷歌 AI 搜索「内心戏」外泄:自我纠结毒理会否采信的草稿被晒出 — real_maximpulse · 2026-09-11
- GPT-6 Astra「99.9%饱和」ARC-AGI-3遭拒签:裸考仅62.7分 — 新智元 · 2026-09-11
- 机器学习学者盛赞 Codex 200 美元月套餐 — burkov · 2026-09-11(2 条相关)
- 新播客聚焦 Meta Muse 常驻智能体与 KV Cache 技术 — altryne · 2026-09-11(2 条相关)
- 技术推演称 Anthropic 蒸馏指控站不住脚:Kimi 与 DeepSeek 实时输出思维链 — bookwormengr · 2026-09-11
- AGI Society 评估黄仁勋与 Brockman 的 GPT-6 Astra 已达 AGI 之说 — bengoertzel · 2026-09-11
- 国产模型被疑路由Claude,博主以开源与成本反驳 — op7418 · 2026-09-11(5 条相关)
- DeepsecBench 安全漏洞挖掘榜:GPT-6 Astra 37.79 分居首 — JohnPhamous · 2026-09-11
- SWE-Together 榜单更新:Claude Fable 5 登顶,Muse Spark 1.3 成性价比之王 — shuchaobi · 2026-09-11
- 网友质疑 AI 日志干预说法:自动服务不会突然输出「这是真的」 — voooooogel · 2026-09-11
- 如何让 AI 摆脱「地牢记得每个冒险者」式空洞文艺腔 — florodude · 2026-09-11
- DeepSeek 4.1 Flash 实测:缓存命中降价 7 倍,编码与 3D 场景生成大跃进 — 卡尔的AI沃茨 · 2026-09-11
- Qwen 团队 Justin Lin:架构过度复杂会埋下 eval 测不出的隐患 — JustinLin610 · 2026-09-11
- OpenAI 演示:GPT-6 Astra 自主构建字体游乐场 — OpenAI · 2026-09-11
- Reddit 用户吐槽 ChatGPT 写故事疯狂滥用换行强调 — Dogbold · 2026-09-11
- 开发者指出 LLM 读文方式不同于人类致写作存两大短板 — abeirami · 2026-09-11(2 条相关)
- 欧洲数学会发声:OpenAI 解 Navier-Stokes 是数学史金字塔,但模型不公开是隐忧 — i_dg23 · 2026-09-11
- 博主实测 Gemini 3.8 Flash:接替 Opus 4.6 成为最佳写作模型 — xiaohu · 2026-09-11
- 讯飞星火X2.5全靠万卡国产910B训练,机器有效时长超97% — 机器之心 · 2026-09-11
- 开发者用新 GPT Live 模型从零搭语音模式,纠结要不要爱尔兰口音 — evielync · 2026-09-11
- Edge0-35B-A3B 预览版登 HF 热榜,主打边缘推理与 MoE 架构 — Edge0 · 2026-09-11
- NVIDIA 公开 IMO 金牌配方:Nemotron 迭代验证零工具证明数学题 — nvidia · 2026-09-11
- DeepSeek 九个月将 KV 缓存压缩 54 倍至亚 KB 水平 — max_paperclips · 2026-09-11(6 条相关)
- 从业者:RL 当红之际,预训练数据整理仍藏着巨大增益 — generativist · 2026-09-11
- OpenAI GPT-Image-2.5 Sunburst 登顶 Image Arena,限时直用至 9 月 13 日 — arena · 2026-09-11
- 质疑:OpenAI「AI 自主数学突破」叙事被指掩盖百名人类数学家参与 — RexDouglass · 2026-09-11
- 开发者调侃:看一堆网站比长链推理对多数人更有用 — willcb · 2026-09-11
- 前沿模型 NSFW 放开无望:OpenAI 收缩各方从严 — Dogbold · 2026-09-11(2 条相关)