自动研究
Auto-Research 技能
概述
在执行任务时,Claude Code 可能会遇到不确定性——例如设计选择、算法细节、API 用法或最佳实践。本技能提供了一条“明确同意”的研究路径:先呈现研究结果,在编写代码前等待用户批准。
该技能支持网页研究和可选的 ChatGPT 咨询。在用户明确批准经过脱敏处理的准确文本之前,绝不会将对话上下文、文件、浏览器状态或凭据发送给第三方。
何时使用此技能
- 用户提出的问题存在多种可行方案时
- Claude 对算法细节或 API 用法不确定时
- 需要对比设计/架构选择时
- 用户明确要求搜索网页或咨询 ChatGPT,并批准了拟定的查询语句时
工作流程
步骤 1:提议研究范围 —— 说明将使用的来源、准确的查询语句或脱敏后的提示词、是否有本地/工作区文本将离开机器以及可能的成本。等待用户批准该具体范围。
步骤 2:研究 —— 获得批准后,使用用户明确选择并授权的网页搜索或浏览器会话。使用固定的、用户配置的浏览器自动化连接器;不要自动安装包、使用 @latest,或访问浏览器 Cookie、其他标签页、保存的密码或会话。
步骤 3:呈现 —— 将研究结果提炼为简洁的选项并附上来源,呈现给用户。
步骤 4:等待批准 —— 在用户说“开始”或选择某个选项之前,不要编写代码。
步骤 5:实施 —— 获得批准后,自信地执行。
明确的 ChatGPT 咨询
不要将 ?、?? 或其他简写视为同意。首先提议一个极简的提示词,例如:请评估这个已脱敏的方案的正确性、完整性和可改进之处:<text>。明确标识每一段将被发送的文本。只有在用户确认准确的提示词后,才能打开选定的 ChatGPT 会话,提交该提示词并呈现响应。默认情况下不要包含对话历史。
在提议提示词之前,请脱敏处理密钥、个人数据、私有代码、客户数据和内部 URL。如果无法进行安全的脱敏,则不要提交。
浏览器自动化边界
如果需要浏览器自动化,用户必须单独授权选定的浏览器配置文件和连接器版本。将会话限制在咨询标签页中。不要检查、复用、导出或依赖其他标签页或配置文件的 Cookie。
示例
示例 1:使用 GPT 咨询设计问题
User: PyTorch 中自定义 ADMM 优化器怎么设计?
Claude: 我可以搜索公开资料,或将以下已脱敏问题发给 ChatGPT:
“如何设计 PyTorch 自定义 ADMM 优化器?请比较可行模式。”
不会发送工作区文件或对话历史。是否允许?
User: 允许发送这段文字
Claude: [仅打开授权的咨询标签页,提交批准的提示词]
Claude: GPT 建议采用方案 A,其优缺点如下。是否继续?
User: 行
Claude: [实施代码]示例 2:网页搜索
User: ?? ADMM convergence criteria best practices
Claude: 我可以针对以下脱敏后的查询语句搜索公开资料:
“ADMM convergence criteria best practices”
最佳实践
- ✅ 在编写代码前,务必向用户展示调研结果
- ✅ 使用
page.fill() 进行即时文本注入,而非 keyboard.type()`
- ✅ 每次进行外部咨询前,需重新获得用户批准
- ✅ 在结果中包含来源
- ❌ 不要跳过调研而凭猜测编写代码
- ❌ 不要因为简写触发词而发送上下文、文件或浏览器数据
- ❌ 不要修改用户的浏览器配置文件或会话状态
局限性
- 若使用浏览器咨询,需要用户配置并固定(pinned)浏览器自动化连接器
- ChatGPT 咨询为可选;若普通网页搜索能满足需求,请优先使用
- GPT 响应时间波动较大(通常为 10-30 秒)
- 网页搜索质量取决于可用资源
- 不能替代专家领域知识 —— 最终决定权始终在用户手中
安全与保障注意事项
- 每次提交第三方平台前需获得明确同意,并告知脱敏后的具体文本
- 绝不访问、导出或依赖 Cookie、保存的密码或无关的浏览器标签页
- 绝不提交敏感凭据、Token、私有代码、个人数据或内部 URL
- 不要安装或执行来自非固定版本的浏览器工具包
常见陷阱
| 问题 | 解决方案 |
|---------|----------|
| ChatGPT 显示登录页面 | 让用户自行登录;不要处理 Cookie 或凭据 |
| 提示词包含敏感上下文 | 对其进行脱敏处理,或使用本地推理代替 |
| 浏览器自动化不可用 | 使用网页搜索,或停止操作并询问用户其他批准的方法 |
相关技能
- @systematic-debugging — 用于调试 Playwright 与 ChatGPT 的交互
- @condition-based-waiting — 用于在浏览器中等待 GPT 响应