频道 · CHANNEL
模型
「模型」是 AI 资讯网站 AGI Hunt 的主题频道,全天候实时更新。覆盖:模型的发布、升级、能力与行为观察、评测成绩与对比、定价与可用性。
每日概览:AI 资讯日报最新一期——过去 24 小时全站及各频道、各公司热点的结构化梳理 · 往期归档
- Muse Spark 1.2 发布:宣称触及成本智能前沿 — zainhas · 2026-08-18
- LiquidAI 推出 3B 参数多模态模型,支持 WebGPU 部署 — LiquidAI · 2026-08-18
- McByte 模型在 SportsMOT 基准测试中刷新SOTA — NielsRogge · 2026-08-18
- 实测 Qwen 3.8 27B 在双 5060 TI 上达 50-60 t/s — chocofoxy · 2026-08-18
- Qwen 3.8 27B 对比 DeepSeek Flash,是否只是刷分? — Best_Sail5 · 2026-08-18
- 用户反馈 Qwen2.5-72B-Instruct 在推理设置异常 — Jebbyk1 · 2026-08-18
- 网友称 DeepSeek V4 Pro 训歪:便宜的 Flash 反而更强 — karminski3 · 2026-08-18
- Qwen3.8-27B 去审查版上架 MLX,适配苹果芯片本地运行 — orcarouter · 2026-08-18(2 条相关)
- Kimi K3 找出 Go 版 TS 编译器栈溢出漏洞 — DanielLockyer · 2026-08-18(2 条相关)
- Qwen3.8-27B 实测:五年前游戏卡双卡跑出 130t/s — IgorCarron · 2026-08-18
- Sakana AI 发布日语推理模型 Namazu — SakanaAILabs · 2026-08-18(3 条相关)
- Grok 4.6 登顶代理法律评测亚军,成本为 GPT-5.6 十三分之一 — XFreeze · 2026-08-18
- Qwen Code v0.21.13 发布:SWE-bench 与 Terminal-Bench 双满分 — qwen-code-ci-bot · 2026-08-18
- Grok 太快太上头:重度账户 24 小时烧掉 30% 额度 — Daniel_Farinax · 2026-08-18
- J-Space 驱动 DeepSeek V4 Pro 多项基准分暴涨 — ccerrato147 · 2026-08-18
- Qwen 3.8 medium think 对比 3.6:谁值得分配思考预算? — deathcom65 · 2026-08-18
- 实测27种编码器:Z-Image解禁版文本编码器并未解除审查 — nathandreamfast · 2026-08-18(2 条相关)
- Grok 4.6 登顶 MedAgentBench,临床智能体任务超 GPT-5.6 Sol — elonmusk · 2026-08-18
- OpenAI 对 GPT-5.6 Sol 降价 50%,SemiAnalysis 称其为份额营销术 — zephyr_z9 · 2026-08-18
- Qwen 3.8 27B 被指过度思考,实测派为深度推理正名 — hiImMate · 2026-08-18(7 条相关)
- OpenAI 新模型 Astra 线索密集传出 — WorldofAI · 2026-08-18(5 条相关)
- OpenAI高管接连离职,舆论吁发布Astra新模型止血 — bindureddy · 2026-08-18(2 条相关)
- Kimi3 架构大改,是否还算 Transformer? — khademinori · 2026-08-18
- Qwen3.8 27B 默认 xhigh 模式意在冲击评测 — frontsideair · 2026-08-18
- Sol 5.6 Ultra 输出极重复,似被 RL 摧毁 — Miles_Brundage · 2026-08-18
- Gemini Flash 两分钟生成 3D 物理特效 — AI_Andrew · 2026-08-18
- Qwen Code 在 SWE-bench 验证中遭遇 56% 执行错误 — qwen-code-ci-bot · 2026-08-18
- Karpathy 预测 LLM 终极形态:端侧推理、工具调用与微调槽位 — cephaloform · 2026-08-18
- Grok 又翻车:给用户生成离谱「注视建议」遭吐槽 — moultano · 2026-08-18
- Claude 读取 Markdown 文件离谱翻车 — yoobinray · 2026-08-18
- Ling-3.0-flash MXFP4 量化 GGUF 发布,自带 MTP 还有 heretic 变体 — pmttyji · 2026-08-18
- Qwen3.8-27B 多模态模型 GGUF 版发布,可本地加速推理 — HauhauCS · 2026-08-18(2 条相关)
- MoE 模型高并发时会退化为加载全部权重吗? — LocalLLaMa_reader · 2026-08-18
- Qwen 3.8 27B 被评为极佳的小模型替代品 — bindureddy · 2026-08-18
- 代码提交显示 Qwen 35B 模型或不会发布 — Mean-Ad1493 · 2026-08-18(2 条相关)
- Unsloth 版 Qwen3.8-27B GGUF 登上 HF 热榜第二,下载量破 270 万 — danielhanchen · 2026-08-18
- James Douma:特斯拉车队规模是 FSD 精细调校的怪兽级优势 — jamesdouma · 2026-08-18
- Fable 自动数据清洗翻车:错用模板致模型退化 — cephaloform · 2026-08-18
- 基准测试末日:为何LLM评估正全面失效 — cyndunlop · 2026-08-18
- Qwen3.8-27B PrismaAqua量化实测:性能逼近BF16 — offgridai · 2026-08-18
- ChatGPT 幻觉用户上传了图片 — SwordaxSy · 2026-08-18
- AI 学者 Zak Kohane 亲测:自写文字被 5 款检测器全判为 AI — zakkohane · 2026-08-18
- 用户反馈 Claude Opus 5 变啰嗦,将指令视为谈判 — ExploreAITogether · 2026-08-18
- 全本地运行:用 Qwen 搭建 AI 自动播客与频道 — sysadmin420 · 2026-08-18
- 实测 Qwen 3.8 两轮提示词生成完整网页游戏 — lordekeen · 2026-08-18
- 网友称目前最好的俄罗斯 LLM 为 GigaChat 3 Ultra — flowersslop · 2026-08-18
- Mixedbread 发布搜索模型 Toast 1 — eliebakouch · 2026-08-18(2 条相关)
- Qwen 2.5 27B 引发缩放定律讨论 — Notrx73 · 2026-08-18
- 小模型多步任务易跑偏:提示词问题还是能力限制? — orelrevivo · 2026-08-18
- 重度用户对比:ChatGPT 模型仍是编程体验最佳 — thatroblennon · 2026-08-18