灵感魔方 PromptCube
首页
AI模型讨论
提示词分享
工作流交流
问题求助
资源分享
行业动态
AI编程实战
AI越狱
AI 工具合集
搜索
中文
EN
首页
/
行业动态
行业动态
1231 篇帖子
排序:
最新
最热
最多回复
行业动态 — 全部帖子
vLLM 升级支持 FP8 量化:显存占用减半且推理速度显著提升
PromptCube
中级
·
170
·
0
·
1
·
2026/5/23
Gemini 2.0 Flash 实测:多模态实时交互延迟大幅降低
PromptCube
专家
·
152
·
0
·
11
·
2026/5/22
GPT-4o 实时语音模式在多语言翻译场景下的延迟实测分析
PromptCube
中级
·
224
·
0
·
9
·
2026/5/22
GitHub Copilot Extensions 插件生态开放:如何自定义企业级 AI 助手
PromptCube
高级
·
83
·
0
·
4
·
2026/5/21
Cursor 接入 DeepSeek R1 后的全库索引代码重构实测分享
PromptCube
高级
·
480
·
0
·
2
·
2026/5/21
vLLM 升级 PagedAttention 优化:如何有效降低长文本推理显存占用
PromptCube
专家
·
102
·
0
·
3
·
2026/5/21
用 MCP 协议打通本地数据库,实现 AI 实时查询企业私有数据
PromptCube
初级
·
406
·
0
·
7
·
2026/5/21
利用 Function Calling 构建自动化数据分析 Pipeline 的实战经验分享
PromptCube
专家
·
373
·
0
·
13
·
2026/5/21
实测 Bolt.new 快速构建全栈应用:从 Prompt 到部署的端到端工作流分析
PromptCube
中级
·
237
·
0
·
10
·
2026/5/20
文心一言最新升级的智能体能力如何提升企业级工作流效率
PromptCube
专家
·
77
·
0
·
2
·
2026/5/20
Llama 3 8B 量化部署实测:低显存设备如何跑通全参数微调
PromptCube
中级
·
342
·
0
·
14
·
2026/5/20
Windsurf 级联上下文机制如何提升大项目代码重构效率
PromptCube
专家
·
111
·
0
·
7
·
2026/5/20
如何利用 BGE-M3 的多粒度检索能力优化本地知识库的召回率
PromptCube
中级
·
361
·
0
·
2
·
2026/5/19
如何利用 RAG 结合知识图谱有效降低 LLM 的事实性幻觉
PromptCube
高级
·
427
·
0
·
14
·
2026/5/19
Ollama 搭配 Open WebUI 实现私有知识库 RAG 部署全流程指南
PromptCube
中级
·
200
·
0
·
3
·
2026/5/19
‹
1
…
73
74
75
76
77
…
83
›
扫码进群
复制微信号
扫码进交流群
微信扫一扫,加入 AI 交流群
或搜索微信号
luyisi2002
关闭