Deep Research
深度研究与 Agent
Deep Research 是 ChatGPT 内的多轮调研 Agent,能自主检索、阅读、综合、引用,输出 5–30 分钟的结构化报告。本频道讲它的工作机制、适用场景、提示词写法、引用核查方法,以及 Plus/Pro 配额策略。
共 7 篇文章
本频道你会学到什么
以下是这个频道覆盖的核心主题,每篇精选文章都会围绕其中若干点展开。
- 工作机制
- 适用场景
- 提示词写法
- 引用核查
- Plus / Pro 配额
- 导出与协作
测量前沿实验室里的 AI 研发速度:Anthropic 的三项自报指标解读
Anthropic 9-17 发布三项内部测量:研发自动化指数(Claude 主导 26% 的 AI 研发、九成以上工作达协作级)、智能体监督(超十亿决策 0.002% 被拦)与安全算力份额(约 6% / 12%)——附完整方法论与官方自认局限。
阅读全文Humanity's Last Exam 深度解读:2,500 道前沿考题的来路与读法
HLE 是目前被引用最多的前沿推理基准:2,500 道跨学科考题、Nature 发表、还有会换题的动态版 HLE-Rolling。拆解它的来路(众包、bug bounty、题目替换史)、双口径记分(无工具/带工具)与正确的引用姿势。
阅读全文怎么读模型发布里的基准对比图:effort 曲线、对数成本轴与安全干预
模型发布会的 accuracy-vs-cost 图和对比表自带口径选择。用 2026-09-01 的 Claude Fable 5.1 发布公告做实例,拆解 8 个阅读要点:effort 曲线、对数轴、误差范围、partial/strict 记分、缺列、安全干预计零分、自建 setup 与公共榜差异。
阅读全文Deep Research 多模型实战:GPT-5.6 vs Claude 4.5 vs Gemini 2.5 + 第三方研究工具对比
Deep Research(深度研究)在 GPT-5.6 / Claude 4.5 / Gemini 2.5 三家模型下的表现对比 + 与 Elicit / Consensus / Perplexity 等第三方研究工具的差异化定位。选哪个 DR、什么时候用第三方工具,文末给决策表。
阅读全文DeepResearch 输出质量控制:模型选型 + Prompt 调优 + 引用验证
DeepResearch 输出质量参差不齐:本文给出一条系统化质控路径--模型选型(Plus vs Pro vs o-series)、5 段式研究 Prompt、引用验证清单、迭代反馈闭环。
阅读全文Deep Research 提示词模式与配额策略:让 ChatGPT 跑出高质量调研报告
Deep Research 是 ChatGPT 的多轮研究 Agent。本文给出 5 段式研究 prompt 模板、引用核查方法、Plus/Pro 配额策略与 4 个典型调研场景示例。
阅读全文Deep Research 完全指南:让 ChatGPT 自主完成多轮调研
Deep Research 的工作机制、适用场景与提示词写法:如何写一个好的调研 brief,以及如何核查它返回的引用是否可靠。
阅读全文