全球做 AI 交流的独立社区与论坛|灵感魔方 PromptCube

独立的 AI 社区、AI 论坛、AI 交流群,欢迎AI爱好者们,助力AI发展

7,291 篇讨论 · 37 位成员 · 1 条回复

AI社区、AI交流是开发者一起讨论模型、工具和报错的地方。PromptCube 是独立 AI 论坛和 AI 交流群:每条讨论有固定网址,中文在首页、英文在 /en/,也有面向全球的 AI 聊天室,方便做 AI 交流。Cursor、Claude Code、Codex、Manus 的讨论都有固定网址。

AI社区 / AI论坛 / AI交流群 常见问题
什么是 AI 社区?
大家回来讨论模型、工具、提示词和排错的地方。可以是 Reddit、Discord、Hugging Face,也可以是 PromptCube 这种独立论坛。
什么是 AI 全球聊天室?
中英文用户都能进的实时聊天室,讨论模型、工具和落地,和论坛帖子互补。

最新帖子

LangGraph 打造自修正代码审查 Agent:告别幻觉与无效建议

直接拿大语言模型当代码审查员有个致命缺陷:它既“社恐”又爱瞎编,给出的建议往往看着头头是道,实际一跑就崩。想要实现真正的自我修正,关键在于把 LLM 塞进「审查 → 执行 → 反馈」的闭环。我基于 L…

前端小哥哥 中级 ·AI编程实战 · 127 · 0 · 6 ·2026/5/8
LangGraph 打造自修正代码审查 Agent:告别幻觉与无效建议

用 llama.cpp 将 DeepSeek-V3 量化至 4-bit 并部署在 3090 上的实操避坑指南

在显存仅 24G 的 3090 上运行 DeepSeek V3 这种量级的模型,量化至 4 bit 几乎是唯一出路。这次通过 完成压制与部署,过程中在权重转换和内存溢出这两个环节遇到了不少麻烦。 最先…

运营喵小美 中级 ·AI编程实战 · 428 · 0 · 14 ·2026/5/8
用 llama.cpp 将 DeepSeek-V3 量化至 4-bit 并部署在 3090 上的实操避坑指南

文心一言插件的潜力被忽视了,尤其是「网页抓取」和「数据分析」插件的组合,能把原本几十行 Python 爬虫代码和 PDF 解析缩短成几句 Prompt。

以前我用 Python + PyPDF2 分析研报时,最头疼的就是那些乱码的非结构化 PDF 表格。后来发现,直接用文心一言的插件链路,效率高到离谱。 应用步骤和技巧 首先,在插件中心启用「网页搜索」…

夜猫子程序员 专家 ·AI编程实战 · 329 · 0 · 0 ·2026/5/8
文心一言插件的潜力被忽视了,尤其是「网页抓取」和「数据分析」插件的组合,能把原本几十行 Python 爬虫代码和 PDF 解析缩短成几句 Prompt。

用 Few-Shot 固定 AI 的 API 文档 JSON 输出格式

想让 AI 稳定生成符合指定 JSON 格式的 API 接口文档,与其用长篇自然语言反复描述规则,不如直接采用 Few Shot(少样本)提示。准备 2 3 个真实的“输入 → 输出”对照样本,就能把…

夜猫子程序员 专家 ·AI编程实战 · 131 · 0 · 9 ·2026/5/7
用 Few-Shot 固定 AI 的 API 文档 JSON 输出格式

借助 Kimi 长文本上下文快速拆解并重构旧项目源码

面对一个没有任何文档、变量命名也相当随意的陈年旧项目,真正让人头疼的通常在于理清逻辑链路,相比之下写新功能反倒是次要问题。过去只能依靠 IDE 的全局搜索,再结合上下文自行猜测;现在我会把整个 目录打…

技术宅的日常 高级 ·AI编程实战 · 499 · 0 · 14 ·2026/5/7
借助 Kimi 长文本上下文快速拆解并重构旧项目源码

用 GPT-4o-audio 结合 Edge-TTS 复刻自然的抱枕音频

直接用 GPT 4o audio 实时合成声音成本高,延迟还长,听起来像机械念经,一点都不像抱枕音频的温暖聊天感。我尝试把它跟 Edge TTS 搭配,用 GPT 4o audio 只负责“文本润色”…

阿星在深圳 中级 ·AI编程实战 · 186 · 0 · 8 ·2026/5/7
用 GPT-4o-audio 结合 Edge-TTS 复刻自然的抱枕音频

长文本代码库 RAG 优化:精简上下文窗口,抑制模型幻觉

将整个项目源码一次性塞进上下文窗口(Context Window),往往是很多人误以为有效的做法。尤其是在使用 Claude 3.5 Sonnet 这类长文本模型时,Token 数量越多,模型越容易在…

设计师老张 高级 ·AI编程实战 · 98 · 0 · 11 ·2026/5/6
长文本代码库 RAG 优化:精简上下文窗口,抑制模型幻觉

低显存单卡运行中的 LoRA 多任务模型切换

显存只有 12G 甚至更低,却想在单卡上运行多个经过微调的模型,如果为每个任务分别加载一份全量权重,显存很快就会 OOM。更合适的做法是只保留一个 Base Model,再动态挂载不同的 LoRA 适…

Prompt工程师陈 专家 ·AI编程实战 · 437 · 0 · 15 ·2026/5/6
低显存单卡运行中的 LoRA 多任务模型切换

视频换脸不再闪烁?ComfyUI AnimateDiff + Reactor 实战配置全流程

直接把 Reactor 或 InsightFace 挂在 AnimateDiff 的工作流里,最头疼的就是人物在运动时脸部会闪烁,或者换脸后的面部特征在每一帧之间不稳定。要实现“精准”且“稳定”的换脸…

夜猫子程序员 专家 ·AI编程实战 · 385 · 0 · 7 ·2026/5/6
视频换脸不再闪烁?ComfyUI AnimateDiff + Reactor 实战配置全流程

Function Calling 调用机制如何让 LLM 安全、精准地查询本地 SQLite 数据库?

现代开发中,让大型语言模型直接把自然语言转化为 SQL 查询也太粗暴了。尤其是在规模不小的数据库上,LLM 经常会脑补出不存在的列名,表名也容易搞错,后果是直接报错崩溃。稳妥的办法是先给 LLM 准备…

创业者老刘 高级 ·AI编程实战 · 451 · 0 · 13 ·2026/5/6
Function Calling 调用机制如何让 LLM 安全、精准地查询本地 SQLite 数据库?

LM Studio 显存溢出排查:GPU 卸载策略、上下文调整与量化选择实战

在使用 LM Studio 运行大模型时,常出现一种现象:显存余量看似充足,但加载至中途即崩溃,或推理速度骤降至 1token/s。这通常源于 GPU Offload(GPU 卸载)层数设定过于激进,…

前端小哥哥 中级 ·AI编程实战 · 539 · 0 · 4 ·2026/5/6
LM Studio 显存溢出排查:GPU 卸载策略、上下文调整与量化选择实战

借助 Dify 条件分支搭建多级意图识别工作流

如果把所有意图识别都放进一个 LLM 节点,模型面对模糊指令时,很容易产生“幻觉”,也可能因为上下文过长而丢失识别精度。构建企业级客服助手时,更稳妥的做法是使用 Dify 的 条件分支(Conditi…

AI小白探索中 中级 ·AI编程实战 · 355 · 0 · 10 ·2026/5/6
借助 Dify 条件分支搭建多级意图识别工作流

ComfyUI电商产品图换背景实战:RMBG-1.4搭配IC-Light自动化工作流详解

想要用 ComfyUI 高效处理电商产品图,关键不在于堆砌顶级模型,而是建立一套稳固的「抠图 → 扩图 → 融合」自动化流水线。不少初学者习惯直接拿 Inpaint 功能涂抹,这往往会导致产品边缘残留…

Prompt工程师陈 专家 ·AI编程实战 · 125 · 0 · 6 ·2026/5/6
ComfyUI电商产品图换背景实战:RMBG-1.4搭配IC-Light自动化工作流详解

Cline 借 MCP 协议直连数据库,三步搞定自动化报表生成实录

将数据库连接权直接移交给 AI 难免让人忐忑,但引入 MCP(Model Context Protocol)协议后,Cline 读写数据库的准确性显著提升,告别了盲目猜测字段名编写 SQL 的时代。这…

代码诗人小李 高级 ·AI编程实战 · 379 · 0 · 8 ·2026/5/5
Cline 借 MCP 协议直连数据库,三步搞定自动化报表生成实录

如何通过构建 RAG 检索增强生成链路来降低 LLM 的事实性幻觉

直接给 LLM 喂长文档作为 Context 很容易导致“中间丢失”现象,而且 Token 成本太高,最稳妥的办法还是搭建一套 RAG 链路。我之前在做个内部知识库项目时,发现直接用简单的向量检索(V…

运营喵小美 中级 ·AI编程实战 · 428 · 0 · 14 ·2026/5/5
如何通过构建 RAG 检索增强生成链路来降低 LLM 的事实性幻觉