行业动态 1231 篇帖子

排序:

行业动态 — 全部帖子

vLLM 升级支持 FP8 量化:显存占用减半且推理速度显著提升
Gemini 2.0 Flash 实测:多模态实时交互延迟大幅降低
GPT-4o 实时语音模式在多语言翻译场景下的延迟实测分析
GitHub Copilot Extensions 插件生态开放:如何自定义企业级 AI 助手
Cursor 接入 DeepSeek R1 后的全库索引代码重构实测分享
vLLM 升级 PagedAttention 优化:如何有效降低长文本推理显存占用
用 MCP 协议打通本地数据库,实现 AI 实时查询企业私有数据
利用 Function Calling 构建自动化数据分析 Pipeline 的实战经验分享
实测 Bolt.new 快速构建全栈应用:从 Prompt 到部署的端到端工作流分析
文心一言最新升级的智能体能力如何提升企业级工作流效率
Llama 3 8B 量化部署实测:低显存设备如何跑通全参数微调
Windsurf 级联上下文机制如何提升大项目代码重构效率
如何利用 BGE-M3 的多粒度检索能力优化本地知识库的召回率
如何利用 RAG 结合知识图谱有效降低 LLM 的事实性幻觉
Ollama 搭配 Open WebUI 实现私有知识库 RAG 部署全流程指南