LLM 时代的工程判断,正在变成可测试的提示词系统
NirantK · x · 2026-07-29
这条回复把上一条的观点往前推进了一步:当你要比较 z-score norm 和 IQR list 这类方案时,过去那种“凭经验拍板”的方式已经不够用了。
- 放在 2022 年,作者可能只会靠直觉选 IQR。
- 现在则必须两个都试,看它们分别适用于什么数据,再把选择标准沉淀成一套经过实战验证的提示词/测试流程。
- 这反映出 LLM 时代的工程方法正在从单次判断,转向系统化实验。
所属事件:大模型时代工程复杂度与测试标准升级(2 条相关)→
「编程与Agent」频道最新
- Relume MCP 结合 Claude Code 的 Markdown 设计工作流 — michalmalewicz · 2026-07-29
- 一场研究演讲比较了 agentic coding 的三类基准 — OfirPress · 2026-07-29
- Kuna 亮相为智能体驱动反编译器,结构化排名逼近 Hex-Rays — moyix · 2026-07-29
- 10万美元对赌:AI编程写不出Ahrefs级SEO工具 — eptwts · 2026-07-29
- 一家 AI agent 创业公司主张:计费应基于事实,而不是散落的 API 调用 — davidcrawshaw · 2026-07-29
- Cursor 多数用户仍只当补全器用,母公司估值已达 293 亿美元 — nikola_mr64990 · 2026-07-29