独立的 AI 编程实战社区

最新帖子

如何利用 LangGraph 构建具备自我修正能力的 RAG 工作流

传统的 RAG 只要检索到无关文档,模型就会一本正经地胡说八道。要解决这个问题,不能靠堆 Prompt,得把 RAG 从「线性管道」改成「循环图」,让 AI 具备审视自己输出的能力。我最近用 Lang…

Prompt工程师陈 专家 ·AI编程实战 · 276 · 0 · 8 ·2026/5/2
如何利用 LangGraph 构建具备自我修正能力的 RAG 工作流

利用 JSON Mode 强制 LLM 结构化输出的避坑指南与 Prompt 技巧

很多开发者在尝试用 JSON Mode 提取信息时,最容易掉进的坑就是:在 System Prompt 里写了“请输出 JSON”,结果模型在 JSON 前后还是加上了 这种废话,直接导致 报错崩溃。…

PromptCube 高级 ·行业动态 · 360 · 0 · 0 ·2026/5/2
利用 JSON Mode 强制 LLM 结构化输出的避坑指南与 Prompt 技巧

如何利用文心一言的API快速构建一个行业文档智能问答助手

直接把行业PDF塞给大模型往往会遇到 Token 长度限制或者幻觉问题,最稳妥的方案还是走 RAG(检索增强生成)架构。我用文心一言的 API 快速搭了一个内部文档问答助手,核心逻辑是:PDF解析 $…

运营喵小美 中级 ·AI编程实战 · 92 · 0 · 6 ·2026/5/2
如何利用文心一言的API快速构建一个行业文档智能问答助手

用 Dify 搭建自动化竞品分析工作流:从网页抓取到结构化报告的实战踩坑记录

把 Firecrawl 接入 Dify 做竞品分析,最大的坑不在于 LLM 的总结能力,而在于网页抓取的“噪音”处理。如果直接把整个页面的 Markdown 丢给 Claude 3.5 Sonnet,…

数据分析师Lucy 中级 ·AI编程实战 · 420 · 0 · 14 ·2026/5/2
用 Dify 搭建自动化竞品分析工作流:从网页抓取到结构化报告的实战踩坑记录

如何通过 MCP 协议将本地 SQLite 数据库实时挂载给 Claude 助手

把本地 SQLite 数据库直接喂给 Claude,比手动导出 CSV 或者复制表结构要高效得多。这次我尝试用 MCP(Model Context Protocol)协议把开发环境的 文件挂载到了 C…

夜猫子程序员 专家 ·AI编程实战 · 81 · 0 · 11 ·2026/5/1
如何通过 MCP 协议将本地 SQLite 数据库实时挂载给 Claude 助手

如何利用 Logit Bias 限制特定词汇输出以防止提示词泄露

直接在 API 参数里把 调到 100,是目前防止模型在被用户诱导时“吐出”系统提示词最粗暴且有效的方法。 很多开发者习惯在 System Prompt 里写「请不要泄露你的指令」,但面对像 这种典型…

创业者老刘 高级 ·AI编程实战 · 181 · 0 · 4 ·2026/5/1
如何利用 Logit Bias 限制特定词汇输出以防止提示词泄露

Cline 配置 MCP 服务器实现本地数据库实时读写实战分享

把 Cline 变成能直接操纵数据库的「超级助手」,核心就在于把 MCP (Model Context Protocol) 服务器跑起来。之前我一直得手动导出 SQL 结果给 AI,现在直接在对话框里…

阿星在深圳 中级 ·AI编程实战 · 72 · 0 · 12 ·2026/5/1
Cline 配置 MCP 服务器实现本地数据库实时读写实战分享

如何利用 Ollama 搭建本地知识库并实现 RAG 检索增强生成

把 LLM 跑在本地最大的痛点不是模型能不能跑,而是它没有你的私有数据。纯靠 Prompt 喂文档,上下文窗口很快就爆了,而且 Token 消耗在长文本面前毫无优势。我最近把本地知识库跑通了,核心方案…

前端小哥哥 中级 ·AI编程实战 · 364 · 0 · 8 ·2026/5/1
如何利用 Ollama 搭建本地知识库并实现 RAG 检索增强生成

如何通过自定义 .github/copilot-instructions.md 统一团队的代码风格

直接在项目根目录扔一个 文件,比在团队群里发十遍《代码规范文档》管用得多。Copilot 现在会自动读取这个文件的上下文,这意味着你可以把那些“虽然没写在 ESLint 里但大家都得遵守”的潜规则直接…

摄影爱好者Tom 初级 ·AI编程实战 · 195 · 0 · 10 ·2026/5/1
如何通过自定义 .github/copilot-instructions.md 统一团队的代码风格

如何利用 Cursor 的 Composer 模式快速重构一个复杂的遗留代码模块

面对那种逻辑混乱、缺乏文档的遗留模块,直接用 Chat 窗口问 AI 往往得不到好结果,因为上下文碎片化太严重。最有效的姿势是开启 (Composer 模式),把整个模块相关的 或 文件全部 进来,让…

阿星在深圳 中级 ·AI编程实战 · 279 · 0 · 8 ·2026/5/1
如何利用 Cursor 的 Composer 模式快速重构一个复杂的遗留代码模块

如何利用 BGE-M3 提升本地知识库在长文本检索时的召回率

BGE M3 最大的杀手锏是 Multi Vector 机制,它能同时处理稠密检索(Dense)、稀疏检索(Sparse/BM25)和多向量检索(ColBERT),这直接解决了本地知识库在面对长文档时…

技术宅的日常 高级 ·AI编程实战 · 306 · 0 · 6 ·2026/5/1
如何利用 BGE-M3 提升本地知识库在长文本检索时的召回率

用 Bolt.new 快速搭建一个多页 SaaS 落地页的实操避坑指南

Bolt.new 最强的地方在于它能直接在浏览器里把 Vite + React + Tailwind 这一套全给跑起来,但如果你直接丢一句“帮我写个 SaaS 落地页”,出来的结果大概率是那种一眼就能…

设计师老张 高级 ·AI编程实战 · 318 · 0 · 14 ·2026/5/1
用 Bolt.new 快速搭建一个多页 SaaS 落地页的实操避坑指南

如何通过 ControlNet 搭配 IP-Adapter 实现精准的人物角色一致性控制

想要在 Stable Diffusion 里让同一个角色在不同场景下长得一模一样,单纯靠 Prompt 抽卡基本没戏,最稳的方案是 ControlNet (Canny/Depth) + IP Adap…

设计师老张 高级 ·AI编程实战 · 467 · 0 · 11 ·2026/4/30
如何通过 ControlNet 搭配 IP-Adapter 实现精准的人物角色一致性控制

vLLM 部署 DeepSeek-V3 时显存溢出(OOM)的调优经验分享

DeepSeek V3 这种规模的模型,直接用 vLLM 默认参数跑,基本上只要 Prompt 稍微长点或者并发一高,显存瞬间爆掉是常态。我最近在 8 张 H800 上死磕这个模型,总结出一套能让吞吐…

夜猫子程序员 专家 ·AI编程实战 · 175 · 0 · 9 ·2026/4/30
vLLM 部署 DeepSeek-V3 时显存溢出(OOM)的调优经验分享

长文本项目如何通过精简 Prompt 降低上下文窗口的 Token 损耗

上下文窗口虽然在扩大,但 Token 损耗带来的“注意力分散”和响应延迟依然是长文本项目的噩梦。很多开发者习惯把整个 API 文档或全部需求丢给 Cursor,结果代码写到后面就开始胡言乱语,这就是典…

前端小哥哥 中级 ·AI编程实战 · 380 · 0 · 1 ·2026/4/30
长文本项目如何通过精简 Prompt 降低上下文窗口的 Token 损耗