实测对比:o3 在 OSINT 任务中表现依然强悍
bytebot · x · 2026-07-31
用户 @bytebot 分享了关于 OpenAI o3 模型的实测体验:
- 在 OSINT(开源情报搜集)任务中,o3 的表现依然非常强悍,相比之下优于 5.6-sol pro。
- 但目前 o3 在工作环境中还无法运行。
「模型」频道最新
- DeepSeek 展现自主拆解能力,无需提示即用 subagent — teortaxesTex · 2026-07-31
- DeepSeek V4长上下文表现受限,全压缩层设计或是短板 — bookwormengr · 2026-07-31
- 同价位大模型实测:DeepSeek V4-Flash 多模态胜过 GPT-5.6 Luna — teortaxesTex · 2026-07-31
- DeepSeek V4-Flash 性能暴涨,或因 V4-Pro 充当 RL 教师 — teortaxesTex · 2026-07-31
- DeepSeek 推理 RL 训练受赞,规避模型废话与幻觉 — teortaxesTex · 2026-07-31
- 曝 Gemini 3.5 Pro 或于本周末发布 — gaganghotra_ · 2026-07-31