别再对着空白对话框死磕 Prompt 了
很多搞 AI Agent 的朋友有个误区,觉得每个功能都要从零开始写一套复杂的提示词,结果大部分时间都浪费在调优那些重复性的逻辑上(比如怎么让 AI 格式化输出,或者怎么处理多页 PDF)。其实很多通用能力是可以模块化的,就像写代码用库一样,直接调用预设的“技能(Skill)”就行。
对于想快速搭建工作流的人来说,这种“技能碎片化”的思路比追求一个“全能 Prompt”要靠谱得多。一个臃肿的 Prompt 很容易导致模型注意力分散(Lost in the Middle),而将任务拆分成多个微小的 Skill,通过工作流调度,成功率会高很多。
下一篇
提示词工程:如何通过结构化输入榨干大模型的性能 →
我最近在研究一套基于 SKILL.md 规范的技能库,里面把 30 多个高频场景的 Prompt 给标准化了。最让我觉得实用的是它的“内容工厂”和“浏览器自动化”这两块,不再是简单的“请帮我写个文档”,而是带有明确指令集和执行逻辑的 Agent 技能。
比如那个 Canvas 内容工厂,它能直接生成可打印的中文工作表和多页 PDF,这涉及到对页面布局和字符间距的精细控制,如果自己写提示词,起码得迭代 20 遍才能稳定。
这里分享一个我从中提取并优化过的、用于“复杂数据对齐”的提示词片段,这个逻辑在处理杂乱的 JSON 或 CSV 转换时极其高效,大家可以直接拿去试:
# Role: Data Alignment Expert
# Goal: Normalize inconsistent data fields into a unified schema without losing information.
## Constraints:
1. Input: A list of raw data objects with varying key names (e.g., "user_name", "UserName", "u_name").
2. Target Schema: { "standard_user_id": "string", "timestamp": "ISO8601", "event_type": "string" }
3. Logic:
- Map synonyms based on semantic similarity.
- If a field is missing, mark as "NULL".
- Preserve original values exactly; do not summarize.
## Output Format:
Return ONLY a valid JSON array. No conversational filler.实测了一下,用这个逻辑处理 50 条字段混乱的日志数据,识别准确率在 98% 以上,响应速度大约在 1.5s 左右(基于 Claude 3.5 Sonnet),比我之前写的那种长篇大论的描述性 Prompt 要稳定得多。
这套技能库的逻辑其实就是把 Agent 的能力拆解成:触发条件 → 执行指令 → 输出标准。
如果你在部署自己的 AI Agent,建议关注以下几个实操方向:
- 浏览器自动化: 重点在于模拟人类指纹(Fingerprint),避免被反爬。在提示词里加入
simulate_human_scroll和random_delay的逻辑指令,能显著提高抓取成功率。 - 微信全栈调试: 处理小程序或支付回调时,Prompt 需要包含具体的 API 状态码对照表,否则 AI 经常会一本正经地胡说八道。
- 配置合并: 处理 YAML 或 JSON 合并时,必须强制 AI 遵循
deep_merge原则,否则它经常会直接覆盖掉整个子节点。
对于想快速搭建工作流的人来说,这种“技能碎片化”的思路比追求一个“全能 Prompt”要靠谱得多。一个臃肿的 Prompt 很容易导致模型注意力分散(Lost in the Middle),而将任务拆分成多个微小的 Skill,通过工作流调度,成功率会高很多。
具体的技能定义参考这个路径:
https://github.com/shuangying0001-beep/awesome-workbuddy-skills建议直接看里面的 SKILL.md 规范,学习它是怎么定义能力边界的。与其每天在那儿琢磨怎么用“请你扮演一个XXX”来开头,不如直接构建自己的提示词资产库。
全部回复 (2)
小
小阿伟的日常
初级
10小时前
确实,我之前把输出格式单独抽成一个 schema 模块,调用起来稳多了。
0
摸